Google hat endlich gezeigt, was eigentlich die große Antwort auf OpenAI und Anthropic in diesem Jahr werden sollte. Das Unternehmen stellte Argon vor, das Flaggschiff-Modell, auf dem die gesamte Gemini-4-Reihe aufbaut. Die Vorstellung kommt rund ein halbes Jahr später als von Sundar Pichai angekündigt, und das bisherige Flaggschiff, Gemini 3.5 Pro, wurde still und leise beerdigt.
Ein Google-Sprecher nannte Argon "das bislang leistungsfähigste Modell des Unternehmens für komplexe Arbeitslasten", vergleichbar bei zentralen Coding- und Cybersicherheits-Benchmarks mit Astra von OpenAI und Opus von Anthropic. Die Zahlen, die Google selbst veröffentlichte, sind ehrlicher als jede Marketingbotschaft: Argon schlägt die Konkurrenz bei mehreren Benchmarks, liegt aber bei zwei von vier veröffentlichten Coding-Tests dahinter.
Einen breiten Zugang gibt es noch nicht. Derzeit testen nur ausgewählte Cybersicherheitspartner Argon, und das Modell ist Teil des freiwilligen Prüfprogramms der Trump-Regierung, bei dem Unternehmen ihre fortschrittlichsten Modelle den Behörden vor einem öffentlichen Start zeigen. Einen Termin für normale Nutzer nannte Google nicht.
Die Verzögerung fällt mit einem Umbau bei DeepMind zusammen: Gründer Demis Hassabis trat als Laborchef zurück, mehrere führende Köpfe des Gemini-Projekts verließen das Unternehmen. Während Google die eigene Struktur ordnete, lieferten OpenAI und Anthropic weiter Updates — ein Rennen, das noch vor kurzem ausgeglichen wirkte, ist inzwischen deutlich ungleicher geworden.
Die Benchmark-Vergleiche stammen aus Googles eigenen Messungen, nicht aus einer unabhängigen Prüfung, und sollten entsprechend eingeordnet werden. Solange Argon nur einer Handvoll Partner vorliegt und kein Starttermin feststeht, kommt der eigentliche Test nicht aus einer Pressemitteilung, sondern aus den ersten unabhängigen Auswertungen — falls und wann sie überhaupt erscheinen.



