Am 28. September brachte Anthropic Claude Sonnet 5.5 heraus — das zweite Modell der 5.5-Generation innerhalb einer Woche nach dem Flaggschiff Opus 5.5. Auf den ersten Blick nichts Spektakuläres: eine weitere Version eines Arbeitsmodells. Doch die Zahlen dahinter erklären, warum man genauer hinschauen sollte: Dieselbe Aufgabe wird jetzt 30 % schneller erledigt und kostet bis zu 30 % weniger — ohne dass Anthropic am Preis pro Token etwas geändert hätte.
Das Geheimnis liegt woanders: Der Tarif blieb unangetastet — 2 Dollar pro Million Eingabe-Token und 10 Dollar pro Million Ausgabe-Token, genau wie bei Sonnet 5. Die Ersparnis entsteht, weil das Modell für dasselbe Ergebnis weniger Schritte, Token und Werkzeugaufrufe benötigt. Frühe Nutzer bestätigen das: Slack meldet 14 % weniger Ausgabe-Token pro Aufgabe, Zendesk verzeichnete ein Plus an Tempo von 20 %, und bei Box lief Sonnet 5.5 2,4-mal schneller bei 12 % weniger verbrauchten Token.
In den Tests fällt der Unterschied noch deutlicher aus als in diesen Prozentzahlen. Beim Terminal-Bench 4.0 sprang das Ergebnis von 10,3 % bei Sonnet 5 auf 70,6 % — fast das Siebenfache. Beim GDPval-AA v2.1 holte Sonnet 5.5 1844 Punkte gegenüber 1846 beim deutlich teureren Opus 5.5 — der Abstand ist praktisch verschwunden. Eine Randnotiz: Sonnet 5.5 ist das erste Sonnet-Modell, das Pokémon Rot allein anhand von Screenshots durchgespielt hat.
Die Rollenverteilung innerhalb der Anthropic-Reihe bleibt bestehen: Opus 5.5 ist für komplexe Arbeit reserviert, die langes Schlussfolgern und Feingefühl braucht, während Sonnet 5.5 das Arbeitspferd für klar umrissene Alltagsaufgaben ist — Code-Korrekturen, Dokumente, Tabellen, Präsentationen. Das Modell ist bereits über die Anthropic-API, AWS, Google Cloud und Microsoft Azure unter der Kennung claude-sonnet-5-5 verfügbar, ein aktualisiertes Haiku wurde für "die kommenden Wochen" angekündigt — ein festes Datum gibt es noch nicht.
Es gibt auch einen Preis, den Anthropic offen anspricht. Sonnet erhielt erstmals dieselben Cybersicherheits-Beschränkungen, die zuvor nur Opus und Fable hatten — und das Unternehmen warnt ehrlich, dass dies auch bei harmlosen Sicherheitsaufgaben zu mehr Ablehnungen führen kann. Nachdem OpenAI vergangene Woche ebenfalls die Preise für GPT-5.6 gesenkt hat, dreht sich der Wettstreit zwischen den KI-Laboren sichtlich weniger um die Frage, wer klüger ist, sondern darum, wer dieselbe Arbeit günstiger erledigt.



