28 września Anthropic wypuściła Claude Sonnet 5.5 — drugi model z rodziny 5.5 zaledwie tydzień po flagowym Opus 5.5. Na pierwszy rzut oka nic sensacyjnego: kolejna wersja modelu roboczego. Liczby stojące za premierą tłumaczą jednak, dlaczego warto ją śledzić: to samo zadanie jest teraz wykonywane o 30% szybciej i kosztuje nawet o 30% mniej, choć cena za token nie zmieniła się o grosz.
Sekret tkwi gdzie indziej: Anthropic nie ruszyła cennika — 2 dolary za milion tokenów wejściowych i 10 dolarów za milion wyjściowych, tak samo jak w Sonnet 5. Oszczędność bierze się stąd, że model potrzebuje mniej kroków, tokenów i wywołań narzędzi, by osiągnąć ten sam wynik. Potwierdzają to wcześni użytkownicy: Slack odnotował 14% mniej tokenów wyjściowych na zadanie, Zendesk zyskał 20% szybkości, a Box zmierzył 2,4 razy szybsze działanie przy 12% mniejszym zużyciu tokenów.
Skok w testach jest jeszcze wyraźniejszy niż te procenty. W Terminal-Bench 4.0 wynik podskoczył z 10,3% dla Sonnet 5 do 70,6% — niemal siedmiokrotnie. W GDPval-AA v2.1 Sonnet 5.5 zdobył 1844 punkty wobec 1846 dla znacznie droższego Opus 5.5 — różnica praktycznie zniknęła. Jest też ciekawostka: to pierwszy model Sonnet, który ukończył Pokémon Red, opierając się wyłącznie na zrzutach ekranu z gry.
Podział ról w rodzinie Anthropic pozostaje ten sam: Opus 5.5 zarezerwowany jest do złożonej pracy wymagającej długiego rozumowania i oceny niuansów, a Sonnet 5.5 to koń roboczy do jasno określonych zadań — poprawek kodu, dokumentów, arkuszy, prezentacji. Model jest już dostępny przez API Anthropic, AWS, Google Cloud i Microsoft Azure pod identyfikatorem claude-sonnet-5-5, a zaktualizowany Haiku ma pojawić się "w najbliższych tygodniach" — na razie bez konkretnej daty.
Jest też koszt, o którym Anthropic mówi wprost. Sonnet po raz pierwszy otrzymał te same zabezpieczenia cyberbezpieczeństwa, jakie wcześniej miały tylko Opus i Fable — a firma uczciwie ostrzega, że może to prowadzić do odmów nawet w niegroźnych zadaniach związanych z bezpieczeństwem informacji. Na tle tego, że OpenAI w zeszłym tygodniu również obniżyła ceny GPT-5.6, rywalizacja między laboratoriami AI wyraźnie przesunęła się z pytania "kto jest mądrzejszy" na "kto wykona tę samą pracę taniej".



