OpenAI wydało GPT-6.1 Sol. Wydajnością zbliża się do flagowej Astry, ale kosztuje tylko jedną piątą

  • OpenAI wydało GPT-6.1 Sol, ulepszoną wersję średniego modelu z serii GPT-6
  • W wielu testach zbliża się do flagowej Astry, ale za tokeny pobiera tylko jedną piątą ceny
  • Z kolei oczekiwany GPT-6.1 Astra najprawdopodobniej nie zostanie wydany

Sdílejte:
Adam Kurfürst
Adam Kurfürst
29. 9. 2026 22:05

Zaledwie tydzień po wprowadzeniu modelu GPT-6 Sol, OpenAI przedstawia jego ulepszoną wersję. Według firmy, GPT-6.1 Sol w programowaniu, pracy z dokumentami i obsłudze komputera zbliża się do flagowego GPT-6 Astra, a za przetworzone tokeny pobiera tylko jedną piątą jego ceny. Deweloperzy i firmy, które pozwalają agentom AI pracować nad dziesiątkami zadań dziennie, za ten sam budżet wykonają znacznie więcej pracy.

W programowaniu może dorównać Astrze, a kosztuje pięć razy mniej

Największy skok nowy model wykonał w programowaniu. W teście DeepSWE 1.1, który przypisuje agentom długie zadania w rzeczywistych projektach oprogramowania, według OpenAI dorównuje GPT-6 Astra przy około jednej piątej kosztów. Ponadto, przewyższa najlepszy wynik poprzednika GPT-6 Sol o 6,4 punktu procentowego, nawet przy krótszym czasie myślenia.

Poprawiła się również specjalistyczna praca z dokumentami. W teście GDP.pdf model odpowiada na pytania dotyczące złożonych plików PDF z dziedziny finansów, opieki zdrowotnej lub prawa, w tym tabel, wykresów i drobnego druku. Tutaj, według OpenAI, pokonuje Claude Opus 5.5 przy mniej niż połowie kosztów i jest blisko Astry. W teście AutomationBench, gdzie agent przechodzi wieloetapowe procedury firmowe z dziesiątkami narzędzi, od sprzedaży po kadry, jest o 2,2 punktu procentowego przed Opusem 5.5 i kosztuje około jednej trzeciej.

Jak radzi sobie z obsługą komputera i w nauce?

Drugą mocną dyscypliną są zadania, w których AI sama klika i pisze w aplikacjach zamiast użytkownika. W teście OSWorld 2.0 GPT-6.1 Sol ustępuje Astrze tylko o 2,1 punktu procentowego, a kosztuje około jedną siódmą. W porównaniu do GPT-6 Sol poprawił się o siedem punktów przy mniej niż połowie kosztów.

W naukowym teście Terminal-Bench Science, gdzie agenci analizują dane, uruchamiają symulacje lub szacują parametry modeli, nowy Sol ponad dwukrotnie zwiększył wynik poprzednika. Jedno zadanie przy maksymalnej intensywności rozumowania kosztuje go średnio 5,47 dolara, podczas gdy Opus 5.5 pochłania 23,21, a Astra 23,80 dolara. Jednak do najbardziej wymagających badań OpenAI nadal poleca Astrę, która z wynikiem 68,1% pozostaje liderem w teście.

Współczynnik błędów nieco spadł, ale Astra nadal prowadzi

W przypadku celowo trudnych zapytań, przy których użytkownicy wcześniej przyłapali ChatGPT na błędzie, nowy model zawiera błąd faktyczny w zaledwie 4,1% odpowiedzi. GPT-6 Sol miał 4,5%, Astra 4,0%. Jednak według samego OpenAI, test nie reprezentuje typowego użytkowania, w którym błędy mają być jeszcze rzadsze.

Firma zgłasza również postęp w tzw. zgodności z ludzkimi intencjami. GPT-6.1 Sol otwarciej przyznaje, czego nie potrafi, i bardziej niezawodnie przestrzega zadań oraz ograniczeń bezpieczeństwa. Na przykład, gdy narzędzie wyszukiwania przestaje działać, zataja to i zaczyna zgadywać tylko w 2,8% przypadków. Starszy Sol zawiódł w ten sposób w 4,9%, Astra w 1,5%, a najtańsza Luna nawet w 28,7% przypadków.

Gdzie jest GPT-6.1 Astra? Podobno w ogóle nie zostanie wydana

Właśnie bezpieczeństwo jest powodem, dla którego obok nowego Solu brakuje jego większego rodzeństwa. Według poniedziałkowych doniesień, OpenAI anulowało wydanie GPT-6.1 Astra, który miał pojawić się w październiku. Według The Wall Street Journal, model w wewnętrznych testach oszukiwał częściej niż poprzednik – na przykład nie zawsze przyznawał, jakie kroki faktycznie podjął – i sięgał po zewnętrzne narzędzia bez zgody.

Saachi Jain z zespołu bezpieczeństwa OpenAI, według agencji Reuters, przyznaje, że model nie osiągnął wymaganego poziomu w przestrzeganiu zadań i udzielonych uprawnień. Firma chce wykorzystać ten sam podstawowy model do kolejnych wersji GPT-6, ale najpierw musi ustalić, skąd wzięły się problemy.

Cena i dostępność GPT-6.1 Sol

Cennik w porównaniu do GPT-6 Sol nie zmienia się: deweloperzy w API zapłacą 2 dolary za milion tokenów wejściowych i 10 dolarów za milion tokenów wyjściowych. Potaniał jednak wielokrotnie używany kontekst z pamięci podręcznej, który teraz kosztuje 0,10 dolara za milion tokenów, czyli połowę dotychczasowej ceny. Oszczędzą głównie zadania agentowe, w których model otrzymuje te same dane wejściowe wielokrotnie.

Abonenci ChatGPT Plus, Pro, Business, Enterprise i Edu mają nowy model dostępny od dziś w ChatGPT Work i w Codexie, w zwykłym czacie na razie go brakuje. Wraz z nim OpenAI wprowadziło również warianty GPT-6 Astra Ultrafast i GPT-6.1 Sol Ultrafast, które są do ośmiu razy szybsze. Oprócz API, użytkownicy nowego poziomu taryfy Pro otrzymają je za około 10 tysięcy koron (500 dolarów) miesięcznie.

Wybralibyście tańszy Sol, czy dopłacilibyście do Astry?

Źródła: OpenAI, Reuters

O autorze

Adam Kurfürst

Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Więcej o autorze

Adam Kurfürst
Sdílejte: