OpenAI nie wyda modelu GPT-6.1 Astra. Podobno nie spełnił wymagań bezpieczeństwa

  • OpenAI anuluje wydanie modelu GPT-6.1 Astra, który miał pojawić się w październiku
  • Model w testach wewnętrznych nie spełnił standardów bezpieczeństwa firmy
  • Według dziennika The Wall Street Journal oszukiwał częściej niż poprzednik

Sdílejte:
Adam Kurfürst
Adam Kurfürst
29. 9. 2026 19:45

Następca flagowego modelu, który OpenAI zaprezentowała na początku września, nie trafi szybko do ChatGPT ani do Codexu. Firma potwierdziła w poniedziałek, że anuluje wydanie GPT-6.1 Astra, ponieważ model podczas testów wewnętrznych nie spełnił jej standardów w zakresie bezpieczeństwa i zgodności z ludzkimi intencjami (tzw. alignmentu).

Model GPT-6.1 Astra zawodzi pod względem bezpieczeństwa

Z informacją jako pierwszy wystąpił dziennik The Wall Street Journal, powołują się na niego agencja Reuters oraz serwis Engadget. Według niego model w testach wewnętrznych wykazywał wyższy stopień oszukiwania niż jego poprzednik – na przykład nie zawsze dokładnie przyznawał, jakie kroki faktycznie podjął. Model miał przy tym radzić sobie ze złożonymi zadaniami bez pomocy człowieka, a podczas ich wykonywania, według dostępnych raportów, sięgał po zewnętrzne narzędzia i usługi, nie prosząc o zgodę.

Saachi Jain, szef systemów bezpieczeństwa OpenAI, według agencji Reuters przyznaje, że nowy model w czymś się poprawił, na przykład mniej „leniuchował”. Nie osiągnął jednak wymaganego poziomu w kwestii trzymania się zadania i udzielonych uprawnień, ani w sposobie opisywania wykonanej pracy użytkownikowi. „Kiedy udostępniamy model użytkownikom, mamy niezwykle wysoką poprzeczkę” – dodaje Jain.

Co dalej z serią GPT-6?

Koniec GPT-6.1 Astra nie oznacza końca całej generacji. Ten sam podstawowy model firma wykorzysta również dla kolejnych wersji GPT-6. Najpierw chce zlokalizować źródło problemów, a następnie wdrożyć uczenie wzmocnione (reinforcement learning), które będzie nagradzać pożądane zachowania modelu.

Anulowanie to kolejne ogniwo w łańcuchu incydentów

Decyzja wpisuje się w serię incydentów, które towarzyszą firmie od lata. Jej modele w lipcu uciekły ze środowiska testowego i włamały się na platformę Hugging Face, później OpenAI przyznała się również do włamań do innych usług – w tym australijskiego systemu publicznego ubezpieczenia zdrowotnego Medicare, usługi dystrybucji pakietów języka Ruby czy niemieckiego forum programistycznego. Pod koniec ubiegłego tygodnia, z powodu kolejnego wycieku modelu do internetu, zawiesiła trening swoich najbardziej zaawansowanych modeli.

Nawet obecny GPT-6 Astra nie jest bez zastrzeżeń – OpenAI sama ostrzega, że czasami potrafi wymknąć się spod ludzkiej kontroli. Szef firmy Sam Altman, wraz z Dario Amodeiem z konkurencyjnego Anthropicu, w tym miesiącu dołączył do apeli o spowolnienie rozwoju AI i wprowadzenie silniejszych zabezpieczeń. Ponadto prokurator generalny Florydy James Uthmeier złożył do sądu stanowego wniosek, aby OpenAI nie mogła trenować nowych modeli bez niezależnego nadzoru.

Czy wierzycie, że OpenAI zdoła utrzymać kolejne modele pod kontrolą?

Źródła: Reuters, Engadget

O autorze

Adam Kurfürst

Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Więcej o autorze

Adam Kurfürst
Sdílejte: