Anthropic wydał Claude Opus 5.5. W testach przewyższa nawet Fable 5.1 i ma być znacznie tańszy

  • Anthropic zaprezentował Claude Opus 5.5, pierwszy model nowej serii 5.5
  • W większości zadań ma dorównywać droższemu Fable 5.1
  • W porównaniu do Opusa 5 otrzymał jednak bardziej rygorystyczne zabezpieczenia

Sdílejte:
Adam Kurfürst
Adam Kurfürst
23. 9. 2026 06:00

Niecałe dwa miesiące po wydaniu Opusa 5, Anthropic ma już jego następcę. Claude Opus 5.5 otwiera nową serię 5.5, a firma pozycjonuje go jako tańszą drogę do wydajności flagowego Fable 5.1. Jeśli pracujesz z Claudem przez API, zwykła praca ma kosztować około 40% mniej niż z Opusem 5. Subskrybenci otrzymają natomiast bardziej hojne limity.

Opus 5.5 w testach przewyższa nawet Fable 5.1

Anthropic w swoim ogłoszeniu podaje, że nowy model przoduje w samodzielnym programowaniu, obsłudze komputera oraz pracy opartej na wiedzy. W teście Terminal-Bench 4.0, który mierzy radzenie sobie ze złożonymi zadaniami w wierszu poleceń, zgłasza 66,4% w porównaniu do 55,8% dla Fable 5.1 i 52,3% dla Opusa 5. Konkurencyjny GPT-6 Astra, według danych opublikowanych przez OpenAI, osiągnął 57,9%.

Wszystkie wyniki pochodzą jednak z testów przeprowadzonych przez samą firmę i na razie nie jesteśmy w stanie ich niezależnie zweryfikować. Anthropic zresztą sam przyznaje, że różnice w testach porównawczych mniej wiarygodnie odzwierciedlają rzeczywistą praktykę. Przewaga nad Fable 5.1 jest według niego w codziennej pracy mniejsza, niż sugerują tabele.

Bardziej obrazowe są konkretne przykłady. Jeden z testerów z nowym modelem podobno zweryfikował i naprawił kod o długości 200 tysięcy linii w niecałe trzy godziny, podczas gdy Opus 5 potrzebował na to samo ponad 20 godzin. W wewnętrznym teście Opus 5.5 przepisał HAProxy, popularne oprogramowanie do rozdzielania ruchu sieciowego między serwerami, z języka C na Rust w 9,5 godziny. Fable 5.1 zajęło to 12 godzin i kosztowało około dwukrotnie więcej.

Zmienił się również sposób, w jaki model pisze. Anthropic reaguje na jedną z najczęstszych uwag dotyczących Opusa 5, która dotyczyła zrozumiałości jego odpowiedzi. Nowy model ma umieszczać najważniejsze informacje od razu na początku, rzadziej używać żargonu i lepiej przestrzegać zasad pisania, które mu zadamy. Ponadto generuje tekst o ponad 30% szybciej.

Cena jest korzystniejsza

Deweloperzy zapłacą około 85 CZK (4 dolary) za milion tokenów wejściowych i 425 CZK (20 dolarów) za milion tokenów wyjściowych, czyli o jedną piątą mniej niż w przypadku Opusa 5. Znacząco potaniało odczytywanie z pamięci podręcznej, które według firmy stanowi większość kosztów podczas programowania i pracy agentów – z niecałych 11 do około 4 CZK za milion tokenów. Ponieważ model zużywa mniej tokenów na to samo zadanie, według Anthropicu oszczędność przy typowym użytkowaniu wynosi wspomniane 40%.

Subskrybenci planów Pro, Max, Team oraz firmowego Enterprise z licencjami na użytkownika otrzymają wyższe pięciogodzinne limity użytkowania. Do tego Anthropic dodaje jednorazowe zresetowanie limitu, które można zachować i wykorzystać, gdy będzie potrzebne – na przykład w momencie, gdy limit wyczerpie się w trakcie niedokończonej pracy.

Opus 5.5 jest już dostępny na wszystkich platformach, w tym w chmurach Amazon Web Services, Google Cloud i Microsoft Azure. Sonnet 5.5 i Haiku 5.5 mają pojawić się w nadchodzących tygodniach.

Dlaczego otrzymał bardziej rygorystyczne zabezpieczenia?

Jest to pierwszy model od czasu, gdy szef Anthropicu, Dario Amodei, w zeszłym tygodniu wezwał, aby rozwój sztucznej inteligencji postępował tylko tak szybko, jak pozwalają na to środki bezpieczeństwa. Przed wydaniem był testowany również przez zewnętrznych oceniających, w tym organizacje METR i Frontier Design. W wewnętrznym audycie zachowania, który sprawdza model w prawie 2 000 symulowanych sytuacji, według firmy osiągnął najlepszy wynik spośród wszystkich dotychczas testowanych modeli.

W biologii i cyberbezpieczeństwie jednak, według Anthropicu, dorównuje on ograniczonemu Mythosowi 5.1, dlatego otrzymał podobne zabezpieczenia jak Fable 5.1. Wyszukiwanie i naprawianie błędów we własnym kodzie będzie nadal możliwe, ale większość zadań z zakresu cyberbezpieczeństwa system automatycznie przekieruje na starszego Opusa 4.8. W porównaniu do Opusa 5, którego filtry były znacznie luźniejsze, jest to odczuwalna zmiana. Zweryfikowane laboratoria i firmy farmaceutyczne mogą ubiegać się o luźniejszy dostęp w nowym programie badań biologicznych, podobny program dla ekspertów ds. bezpieczeństwa zostanie rozszerzony na Opus 5.5 w nadchodzących tygodniach.

Firma jednocześnie przyznaje, że model podczas testów często domyśla się, że jest testowany, co utrudnia oszacowanie, jak zachowa się w rzeczywistym zastosowaniu. Opus 5.5 nie może być już używany z wyłączonym myśleniem i, podobnie jak Fable 5.1, oznacza teksty niewidzialnym znakiem wodnym z powodu europejskiego AI Act, o którym pisaliśmy w sierpniu. W przeciwieństwie do poprzednich Opusów, jest również dostępny w trybie bez przechowywania danych.

Sięgniesz po Opus 5.5, czy pozostaniesz przy droższym Fable 5.1?

Źródła: Anthropic, X

O autorze

Adam Kurfürst

Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Więcej o autorze

Adam Kurfürst
Sdílejte: