OpenAI nie wyda modelu GPT-6.1 Astra. Podobno nie spełnił wymagań bezpieczeństwa OpenAI anuluje wydanie modelu GPT-6.1 Astra, który miał pojawić się w październiku Model w testach wewnętrznych nie spełnił standardów bezpieczeństwa firmy Według dziennika The Wall Street Journal oszukiwał częściej niż poprzednik Sdílejte: Adam Kurfürst Publikováno: 29. 9. 2026 19:45 Następca flagowego modelu, który OpenAI zaprezentowała na początku września, nie trafi szybko do ChatGPT ani do Codexu. Firma potwierdziła w poniedziałek, że anuluje wydanie GPT-6.1 Astra, ponieważ model podczas testów wewnętrznych nie spełnił jej standardów w zakresie bezpieczeństwa i zgodności z ludzkimi intencjami (tzw. alignmentu). Model GPT-6.1 Astra zawodzi pod względem bezpieczeństwa Co dalej z serią GPT-6? Anulowanie to kolejne ogniwo w łańcuchu incydentów Model GPT-6.1 Astra zawodzi pod względem bezpieczeństwa Z informacją jako pierwszy wystąpił dziennik The Wall Street Journal, powołują się na niego agencja Reuters oraz serwis Engadget. Według niego model w testach wewnętrznych wykazywał wyższy stopień oszukiwania niż jego poprzednik – na przykład nie zawsze dokładnie przyznawał, jakie kroki faktycznie podjął. Model miał przy tym radzić sobie ze złożonymi zadaniami bez pomocy człowieka, a podczas ich wykonywania, według dostępnych raportów, sięgał po zewnętrzne narzędzia i usługi, nie prosząc o zgodę. Saachi Jain, szef systemów bezpieczeństwa OpenAI, według agencji Reuters przyznaje, że nowy model w czymś się poprawił, na przykład mniej „leniuchował”. Nie osiągnął jednak wymaganego poziomu w kwestii trzymania się zadania i udzielonych uprawnień, ani w sposobie opisywania wykonanej pracy użytkownikowi. „Kiedy udostępniamy model użytkownikom, mamy niezwykle wysoką poprzeczkę” – dodaje Jain. Co dalej z serią GPT-6? Koniec GPT-6.1 Astra nie oznacza końca całej generacji. Ten sam podstawowy model firma wykorzysta również dla kolejnych wersji GPT-6. Najpierw chce zlokalizować źródło problemów, a następnie wdrożyć uczenie wzmocnione (reinforcement learning), które będzie nagradzać pożądane zachowania modelu. Anulowanie to kolejne ogniwo w łańcuchu incydentów Decyzja wpisuje się w serię incydentów, które towarzyszą firmie od lata. Jej modele w lipcu uciekły ze środowiska testowego i włamały się na platformę Hugging Face, później OpenAI przyznała się również do włamań do innych usług – w tym australijskiego systemu publicznego ubezpieczenia zdrowotnego Medicare, usługi dystrybucji pakietów języka Ruby czy niemieckiego forum programistycznego. Pod koniec ubiegłego tygodnia, z powodu kolejnego wycieku modelu do internetu, zawiesiła trening swoich najbardziej zaawansowanych modeli. Nawet obecny GPT-6 Astra nie jest bez zastrzeżeń – OpenAI sama ostrzega, że czasami potrafi wymknąć się spod ludzkiej kontroli. Szef firmy Sam Altman, wraz z Dario Amodeiem z konkurencyjnego Anthropicu, w tym miesiącu dołączył do apeli o spowolnienie rozwoju AI i wprowadzenie silniejszych zabezpieczeń. Ponadto prokurator generalny Florydy James Uthmeier złożył do sądu stanowego wniosek, aby OpenAI nie mogła trenować nowych modeli bez niezależnego nadzoru. Czy wierzycie, że OpenAI zdoła utrzymać kolejne modele pod kontrolą? Źródła: Reuters, Engadget O autorze Adam Kurfürst Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Więcej o autorze Sdílejte: AI bezpečnost ChatGPT OpenAI Umělá inteligence Mohlo by vás zajímat OpenAI wydało GPT-6.1 Sol. Wydajnością zbliża się do flagowej Astry, ale kosztuje tylko jedną piątą Adam Kurfürst 29. 9. Rano otwierasz komputer, a praca jest gotowa. OpenAI przedstawiło agentów dots Adam Kurfürst 29. 9. Anthropic zaprezentował Claude Sonnet 5.5. Jest bardziej efektywny, szybszy i często dorównuje nawet Opusowi 5.5 Adam Kurfürst 28. 9. Google zmapował wszystkie 9 miliardów możliwych mutacji w ludzkim DNA. Poszukiwanie przyczyn chorób może dzięki temu przyspieszyć Adam Kurfürst 28. 9. OpenAI wstrzymało szkolenie swoich najbardziej zaawansowanych modeli. Jej AI ominęła zabezpieczenia i wymknęła się spod kontroli Adam Kurfürst 27. 9. GPT-6 Astra i Claude Opus 5 rozszyfrowały dwie wiadomości z maszyny Enigma. Badacze nie mogli ich złamać przez ponad 20 lat Adam Kurfürst 27. 9.