Die kurze Antwort Google hat am 30. September 2026 Gemini 4 Argon angekündigt. Breit nutzbar ist es noch nicht: Zuerst kommen ausgewählte Sicherheitsteams im Fairwind Program, danach zahlende API-Kunden und Google AI Ultra. Stand 5. Oktober 2026 ist Argon weder in der API noch in der Gemini-App verfügbar. Für Unternehmen im Mittelstand ändert sich deshalb kurzfristig wenig. Zur Einführung soll Argon 2 $ Input und 10 $ Output pro Million Tokens kosten, danach 4 $ und 20 $.
Von Koray Kavukcuoglu, SVP bei Google DeepMind.
Input und Output, danach 4 $ / 20 $. Enddatum nennt Google nicht.
Weder in der API noch in der Gemini-App.
Laut Google. Den Eingabekontext nennt Google nicht.
Was hat Google mit Gemini 4 Argon angekündigt?
Google hat am 30. September 2026 Gemini 4 Argon vorgestellt, ein neues Spitzenmodell für Programmierung, Wissensarbeit im Unternehmen und Cyberabwehr. Angekündigt hat es Koray Kavukcuoglu, SVP bei Google DeepMind, mit den Worten „Our frontier model for real-world coding, enterprise knowledge work, and cyber defense“. Frontier-Modell nennen die Anbieter ihre jeweils leistungsstärkste Modellstufe. Für die Praxis zählen vier Punkte:
- Noch nicht breit verfügbar. Zuerst bekommen ausgewählte Sicherheitsteams im Fairwind Program Zugang, danach zahlende API-Kunden und Abonnenten von Google AI Ultra. Ein Datum nennt Google nicht. Details im Abschnitt Verfügbarkeit.
- Einführungspreis 2 $ / 10 $. So viel soll Argon zum Start pro Million Input- und Output-Tokens kosten, zwischengespeicherter Input 95 Prozent weniger als der Input-Preis. Danach steigt der Preis auf 4 $ und 20 $; wann, sagt Google nicht.
- Sehr lange Ausgaben. Argon kann laut Google bis zu 1 Million Tokens ausgeben, Gemini 3.8 Flash und 3.1 Pro kommen auf 65.536 Tokens. Wie viel Text Argon als Eingabe verarbeitet, nennt Google nicht.
- Bestwerte laut Google. Google meldet neue Bestwerte, etwa 77,9 Prozent auf DeepSWE v1.1. Das sind Herstellerangaben, mehr dazu im Abschnitt Benchmarks.
Wer bekommt Gemini 4 Argon und wann?
Zuerst eine Gruppe ausgewählter Sicherheitsteams, danach zahlende API-Kunden und Abonnenten von Google AI Ultra; ein Datum nennt Google für keinen dieser Schritte. Für alle anderen ist Argon Stand 5. Oktober 2026 nirgends verfügbar: nicht in der Modellliste der Gemini API, nicht im Changelog, auf keiner Preisseite, ohne Modellkarte, nicht in der Gemini-App und nicht auf Googles Abo-Seite. Die Reihenfolge laut Google:
- Fairwind Program. Den Anfang macht laut Google „a set of trusted cyber defenders“. Fairwind ist Googles Programm mit begrenztem Zugang zu Fähigkeiten für die Cyberabwehr, gestartet am 2. September 2026 mit Gemini 3.8 Flash Cyber. Google spricht von „more than 650 participating partners globally“. Berechtigt sind Regierungen und Cyberbehörden, Betreiber kritischer Infrastruktur, Kerntechnologie-Plattformen und akademische Labore. Ein typischer Mittelständler gehört zu keiner dieser Gruppen, Betreiber kritischer Infrastruktur sind die Ausnahme.
- Zahlende API-Kunden. Danach soll Argon „to developers, enterprises, and consumers“ kommen, „starting with paid API customers and Google AI Ultra subscribers“. Welche Zugänge genau gemeint sind, etwa die Gemini API oder die Gemini Enterprise Agent Platform (früher Vertex AI), schlüsselt die Ankündigung nicht auf.
- Google AI Ultra. Parallel sollen Abonnenten von Google AI Ultra Argon bekommen. Ultra ist ein Abo für private Konten und kostet laut Googles deutscher Abo-Seite 99,99 € pro Monat mit fünffachen oder 219,99 € mit zwanzigfachen Pro-Limits.
Unternehmen nennt Google zwar als Zielgruppe, einen Termin für Google Workspace oder Gemini Enterprise enthält die Ankündigung aber nicht. Neue Modelle, Freigaben und Preisänderungen fasse ich laufend in den KI-Updates zusammen.
Was kostet Gemini 4 Argon im Vergleich zu Opus 5.5, Sonnet 5.5, GPT-6 Astra und GPT-6.1 Sol?
Zur Einführung kostet Argon 2 $ Input und 10 $ Output pro Million Tokens, genauso viel wie Claude Sonnet 5.5 und GPT-6.1 Sol. Nach der Einführungsphase steigt der Preis auf 4 $ und 20 $, das entspricht Claude Opus 5.5. GPT-6 Astra kostet mit 10 $ und 50 $ das Zweieinhalbfache dieses späteren Argon-Preises. Wann die Einführungsphase endet, sagt Google nicht, und auf keiner Preisseite steht Argon bisher. API-Listenpreise in US-Dollar pro Million Tokens:
| Modell | Input | Output | Zwischengespeicherter Input | Verfügbar (Stand 05.10.2026) | Quelle |
|---|---|---|---|---|---|
| Gemini 4 Argon, Einführungspreis | 2 $ | 10 $ | 95 % unter dem Input-Preis, rechnerisch 0,10 $ | nur im Fairwind Program | Google, Argon-Ankündigung (abgerufen am 05.10.2026) |
| Gemini 4 Argon, nach der Einführungsphase | 4 $ | 20 $ | k. A. | Termin nicht genannt | Google, Argon-Ankündigung (abgerufen am 05.10.2026) |
| Claude Opus 5.5 | 4 $ | 20 $ | 0,20 $ | seit 22.09.2026 | Anthropic, Opus-5.5-Ankündigung und Preisseite (abgerufen am 27.09.2026) |
| Claude Sonnet 5.5 | 2 $ | 10 $ | 0,20 $ | seit 28.09.2026 | Anthropic, Sonnet-5.5-Ankündigung (abgerufen am 04.10.2026) |
| GPT-6 Astra | 10 $ | 50 $ | 1 $ | seit 03.09.2026 | OpenAI, Modellvergleich (abgerufen am 04.10.2026) |
| GPT-6.1 Sol | 2 $ | 10 $ | 0,10 $ | seit 29.09.2026 | OpenAI, GPT-6.1-Sol-Ankündigung (abgerufen am 04.10.2026) |
| Gemini 3.8 Flash (zum Vergleich) | 0,75 $, ab 2027 1,50 $ | 3,75 $, ab 2027 7,50 $ | 0,075 $ | seit 02.09.2026 | Google, Gemini-API-Preise (abgerufen am 05.10.2026) |
| Gemini 3.1 Pro, Preview (zum Vergleich) | 2 $, über 200.000 Tokens 4 $ | 12 $, über 200.000 Tokens 18 $ | 0,20 $ bzw. 0,40 $ | seit 19.02.2026 | Google, Gemini-API-Preise (abgerufen am 05.10.2026) |
Kurz erklärt: Beim zwischengespeicherten Input speichert der Anbieter wiederkehrende Teile eines Prompts, etwa lange Anweisungen, und berechnet sie beim erneuten Lesen deutlich günstiger. Die Anbieter zählen Tokens unterschiedlich, der Preisvergleich pro Token ist deshalb nur ein Näherungswert. Bei GPT-6 Astra gelten über 272.000 Input-Tokens höhere Preise, bei Gemini 3.1 Pro über 200.000 Tokens Prompt.
Rechenmuster mit Listenpreisen
Beispielablauf: Eine Automation verbraucht im Monat 10 Millionen Input-Tokens und 2 Millionen Output-Tokens. Gerechnet ist rein mit API-Listenpreisen, ohne Cache, Batch, Aufschläge für sehr lange Prompts und Steuern.
| Modell | Kosten pro Monat |
|---|---|
| Gemini 3.8 Flash, 2026 und ab 2027 | 15 $ bzw. 30 $ |
| Gemini 4 Argon, Einführungspreis | 40 $ |
| Claude Sonnet 5.5 und GPT-6.1 Sol | je 40 $ |
| Gemini 3.1 Pro (Prompts bis 200.000 Tokens) | 44 $ |
| Gemini 4 Argon, nach der Einführungsphase | 80 $ |
| Claude Opus 5.5 | 80 $ |
| GPT-6 Astra | 200 $ |
So liest du die Tabelle: Tokenpreise sagen nichts über die Kosten pro erledigter Aufgabe. Braucht ein Modell weniger Anläufe oder Tokens, kann ein höherer Tokenpreis am Ende günstiger sein. Für die Budgetplanung zählt bei Argon der spätere Preis von 4 $ und 20 $. Abo- und Workspace-Preise findest du unter Gemini-Preise, Details zu den Konkurrenzmodellen in den Artikeln zu Claude Opus 5.5, GPT-6 Astra und GPT-6.1 Sol.
Wie schneidet Gemini 4 Argon in Benchmarks ab?
Laut Google setzt Argon auf mehreren Benchmarks neue Bestwerte, darunter 77,9 Prozent auf DeepSWE v1.1. Alle Werte der folgenden Tabelle sind Herstellerangaben aus Googles Ankündigung. Unabhängige Nachmessungen habe ich für diesen Artikel nicht ausgewertet, und solange Argon nicht frei verfügbar ist, kannst du die Werte nicht selbst prüfen.
| Benchmark (Herstellerangaben) | Argon | Einordnung durch Google |
|---|---|---|
| DeepSWE v1.1 (Software-Entwicklung) | 77,9 % | neuer Bestwert („new state of the art“) |
| AutomationBench (von Zapier) | 51,3 % | Platz 1 |
| LVBench (Verständnis langer Videos) | 91,7 % | Bestwert |
| CWE-bench v1 (Cybersicherheit) | 68 % | geteilter erster Platz |
| Vals Index | k. A. | führendes Modell |
| Gray Swan IPI (Robustheit gegen indirekte Prompt Injection) | k. A. | führend |
Kurz erklärt: Bei einer indirekten Prompt Injection versteckt jemand Anweisungen in einer Webseite, einer E-Mail oder einem Dokument, das ein KI-Modell liest, und versucht so, das Modell umzusteuern. Für Agenten mit Zugriff auf Postfächer oder Browser ist die Robustheit dagegen ein zentrales Sicherheitsthema.
Laut VentureBeat (Sekundärquelle, 30. September 2026) liegt Argon in 13 von 18 veröffentlichten Benchmarks vorn oder gleichauf. Für DeepSWE nennt VentureBeat 74,2 Prozent für Claude Opus 5.5 und 74,1 Prozent für GPT-6 Astra. Was diese Werte für deutsche Texte, Büroarbeit oder eure eigenen Dokumente bedeuten, zeigen erst Tests mit echten Fällen, sobald Argon zugänglich ist.
Vom Modell zum Ablauf
Ein neues Spitzenmodell ändert noch nichts an euren Abläufen. Den Unterschied machen eine Modellwahl, die eine Einstellung ist und kein Umbau, Tests mit echten Fällen und klare Kostenobergrenzen. Wie das aussieht, beschreibe ich unter KI-Automatisierung.
KI-Automatisierung ansehenWarum gibt Google Argon nur stufenweise frei?
Google begründet die stufenweise Freigabe mit Sicherheit: „Safely releasing frontier capabilities at this level requires a phased approach.“ Außerdem beteiligt sich Google am freiwilligen Verfahren der US-Regierung für den Vorab-Zugriff auf Modelle vor ihrer Veröffentlichung und weitet den Zugang nach eigenen Worten schrittweise aus.
Der Schwerpunkt Cyberabwehr passt zu dieser Reihenfolge. Meine Lesart: Ein Modell, das Schwachstellen gut findet und behebt, ist auch für Angreifer interessant, deshalb sollen Verteidiger einen Vorsprung bekommen. Google beschreibt das Ziel des Fairwind Program ähnlich: Vertrauenswürdige Partner sollen einen entscheidenden Vorsprung gegen Cyberbedrohungen bekommen („a critical head start against cyber threats“).
Google ist mit dieser Vorsicht nicht allein. OpenAI hält laut CBS News, CNN und CNBC (Sekundärquellen) GPT-6.1 Astra vorerst zurück, weil das Modell beim Einhalten von Auftrag und Berechtigungen die eigene Hürde noch nicht genommen hat. Anthropic gibt Claude Mythos 5.1 nur über Programme mit geprüftem Zugang frei, derzeit nur für ausgewählte Organisationen in den USA. Für Unternehmen heißt das: Zwischen der Ankündigung eines Spitzenmodells und seiner breiten Nutzbarkeit kann Zeit vergehen, die sich nicht planen lässt.
Was bedeutet Argon für Unternehmen im Mittelstand?
Kurzfristig wenig: Stellt jetzt nichts um, testet das verfügbare Gemini 3.8 Flash und plant das Budget 2027 mit den späteren Preisen. Die folgenden fünf Punkte sind meine Einordnung auf Basis von Googles Angaben, kein Testergebnis.
- Jetzt nichts umstellen. Argon ist nicht verfügbar, und es gibt kein Datum. Projekte, die heute starten, bauen auf Modellen auf, die ihr heute testen könnt.
- Gemini 3.8 Flash testen. Das neueste allgemein verfügbare Gemini-Modell kostet bis Ende 2026 0,75 $ Input und 3,75 $ Output pro Million Tokens und läuft über die Gemini Enterprise Agent Platform auch in der EU-Multiregion mit Verarbeitung in der EU. Wer Gemini für Agenten, Dokumentenarbeit oder Coding prüfen will, startet hier.
- Budget 2027 realistisch planen. Die Einführungspreise der Flash-Modelle 3.6, 3.7 und 3.8 laufen am 31. Dezember 2026 aus; ab 1. Januar 2027 verdoppeln sie sich auf 1,50 $ Input und 7,50 $ Output pro Million Tokens. Plant euer Budget 2027 mit dem doppelten Preis. Bei Argon rechnet ihr mit 4 $ und 20 $, weil Google das Ende des Einführungspreises nicht nennt.
- Die EU-Frage offen lassen. Google sagt nichts dazu, ob und wann Argon in der EU oder in EU-Regionen verfügbar sein wird. Schon das aktuelle Pro-Modell 3.1 Pro läuft in Gemini Enterprise in der EU ohne Datenresidenz und ohne ML-Verarbeitung. Dass Argon sofort mit Verarbeitung in der EU startet, solltet ihr deshalb nicht voraussetzen. Mehr zu Datenregionen im Guide Gemini und DSGVO.
- Die Abhängigkeit von Ultra und API bedenken. Nach Fairwind kommen zuerst die bezahlte API und Google AI Ultra. Ein bezahltes Google-AI-Abo ändert an den Datenregeln privater Konten nichts; die Unternehmenszusagen (kein Training und keine menschliche Prüfung ohne Erlaubnis) gelten nur für Workspace-Konten. Private Ultra-Konten sind deshalb kein Weg, Argon mit Firmendaten zu nutzen. Für Unternehmen bleibt zunächst die bezahlte API mit eigener Integration.
Muster: So bereitest du einen späteren Wechsel vor
Erstens auflisten, wo ihr heute Gemini-Modelle nutzt und mit welcher Modell-ID. Zweitens die Modell-ID als zentrale Einstellung pflegen, damit ein Wechsel eine Zeile ist. Drittens 20 bis 50 echte Fälle mit Ergebnis, Laufzeit und Kosten des aktuellen Modells festhalten. Ist Argon für euren Zugang freigeschaltet, laufen dieselben Fälle noch einmal durch, und ihr entscheidet mit euren eigenen Zahlen.
Wie passt Argon zu den übrigen Gemini-Modellen?
Argon ist als Frontier-Modell angekündigt, im Alltag bleiben vorerst die Klassen Flash-Lite, Flash und Pro. Das neueste allgemein verfügbare Gemini-Modell ist Gemini 3.8 Flash vom 2. September 2026. Aktuelles Pro-Modell bleibt Gemini 3.1 Pro im Preview-Status, Gemini 3.5 Pro führt Google weiter als ‚coming soon‘. Zusätzlich stellt Google ab dem 9. Oktober 2026 die Gemini-App für private Konten um: Ohne Abo gibt es nur noch das Modell Flash-Lite. Flash gibt es ab Google AI Plus, das Pro-Modell ab Google AI Pro.
Welches Modell in welchem Produkt steckt, was es kostet und welche Modelle in der EU laufen, steht im Guide Gemini-Modelle im Vergleich. Den Einstieg in alle Gemini-Themen findest du im Gemini-Guide für Unternehmen, den Plattformvergleich mit Claude und ChatGPT unter Beste KI 2026.
Von der Modellfrage zur Umsetzung
Ihr nutzt Gemini schon in Automationen oder wollt wissen, ob 3.8 Flash für eure Aufgaben reicht und was 2027 auf euch zukommt? Beschreibe mir kurz, welche Abläufe betroffen sind und was ein gutes Ergebnis leisten muss. Wir klären, ob ein Modellvergleich, eine Umstellung oder ein Teamtraining sinnvoll ist.
Unsere Abläufe kurz schildernKostenfreier, unverbindlicher Erstkontakt. Ein fertiges Konzept ist nicht nötig.
Häufige Fragen zu Gemini 4 Argon
Was ist Gemini 4 Argon?
Gemini 4 Argon ist das neue Spitzenmodell von Google, angekündigt am 30. September 2026 für Programmierung, Wissensarbeit im Unternehmen und Cyberabwehr. Laut Google erreicht es auf DeepSWE v1.1 77,9 Prozent und kann bis zu 1 Million Tokens ausgeben. Breit nutzbar ist es noch nicht.
Kann ich Gemini 4 Argon schon nutzen?
Nein, Stand 5. Oktober 2026 ist Argon weder in der API noch in der Gemini-App verfügbar. Zuerst kommen ausgewählte Sicherheitsteams im Fairwind Program, danach zahlende API-Kunden und Google AI Ultra. Ein Datum nennt Google nicht.
Was kostet Gemini 4 Argon?
Zur Einführung 2 $ Input und 10 $ Output pro Million Tokens, zwischengespeicherter Input kostet 95 Prozent weniger als der Input-Preis. Danach steigt der Preis auf 4 $ und 20 $, wann die Einführungsphase endet, sagt Google nicht. Auf Googles Preisseiten steht Argon bisher nicht.
Ist Gemini 4 Argon besser als Claude Opus 5.5 und GPT-6 Astra?
Laut Google setzt Argon auf DeepSWE v1.1 mit 77,9 Prozent einen neuen Bestwert, VentureBeat nennt dort 74,2 Prozent für Opus 5.5 und 74,1 Prozent für GPT-6 Astra. Insgesamt liegt Argon laut VentureBeat in 13 von 18 veröffentlichten Benchmarks vorn oder gleichauf. Das sind Hersteller- und Presseangaben; für eure Aufgaben zählen eigene Tests, sobald Argon verfügbar ist.
Ist Gemini 4 Argon in der EU verfügbar?
Dazu äußert sich Google bisher nicht, weder zur Verfügbarkeit in der EU noch zu EU-Regionen. Stand 5. Oktober 2026 ist Argon ohnehin nur im Fairwind Program nutzbar. Wer Gemini heute mit Datenverarbeitung in der EU braucht, nutzt Gemini 3.8 Flash über die Agent Platform und die EU-Multiregion.
Warum gibt Google Argon nur schrittweise frei?
Google begründet das mit Sicherheit: Fähigkeiten auf diesem Niveau erfordern laut Google eine stufenweise Freigabe. Zudem beteiligt sich Google am freiwilligen Verfahren der US-Regierung für den Vorab-Zugriff auf neue Modelle. Den Anfang machen Sicherheitsteams im Fairwind Program.
Sollten Unternehmen mit KI-Projekten auf Argon warten?
Nein, denn für Argon gibt es kein Datum, und Warten kostet Zeit, ohne dass klar ist, wie viel. Startet mit verfügbaren Modellen wie Gemini 3.8 Flash und legt die Modellwahl als Einstellung an, damit ein späterer Wechsel einfach ist. Plant das Budget 2027 mit den späteren Preisen.
Offizielle Quellen und Stand der Recherche
Dieser Artikel wurde am 5. Oktober 2026 erstellt. Angaben zu Google stammen aus den verlinkten Primärquellen, abgerufen am 05.10.2026; die Preise von Claude Sonnet 5.5 und der OpenAI-Modelle wurden am 04.10.2026 geprüft, die von Claude Opus 5.5 am 27.09.2026. Benchmark-Werte zu Argon sind Herstellerangaben von Google. VentureBeat sowie CBS News, CNN und CNBC sind Sekundärquellen. Google rollt Modelle schrittweise aus; maßgeblich ist die Anzeige in deinem Konto.
- Google: Gemini 4 Argon (30.09.2026, Rollout, Preise, Output, Benchmarks, Begründung der stufenweisen Freigabe; abgerufen am 05.10.2026)
- Google: Fairwind Program und Google DeepMind: Fairwind Program (Start, Partner, Berechtigte; abgerufen am 05.10.2026)
- Google AI for Developers: Gemini-API-Modelle und Changelog (kein Eintrag zu Argon; abgerufen am 05.10.2026)
- Google AI for Developers: Preise der Gemini API und Preise der Gemini Enterprise Agent Platform (Gemini 3.8 Flash, 3.1 Pro; kein Eintrag zu Argon; abgerufen am 05.10.2026)
- Google DeepMind: Modellkarten (keine Modellkarte zu Argon; abgerufen am 05.10.2026)
- Gemini Release Notes und deutsche Abo-Seite (Google AI Ultra; abgerufen am 05.10.2026)
- Gemini-Hilfe: Änderungen der Modellverfügbarkeit ab Oktober 2026 (abgerufen am 05.10.2026)
- Google Cloud: Standorte von Gemini Enterprise und Gemini 3.8 Flash auf der Agent Platform (EU-Regionen; abgerufen am 05.10.2026)
- Google Workspace: Privacy Hub zu generativer KI und Gemini-Hilfe: Datenschutz in Gemini Apps (abgerufen am 05.10.2026)
- Anthropic: Introducing Claude Opus 5.5 und Claude: Pläne und Preise (abgerufen am 27.09.2026)
- Anthropic: Introducing Claude Sonnet 5.5 (abgerufen am 04.10.2026)
- Anthropic: Claude Fable 5.1 und Mythos 5.1 (Zugang zu Mythos 5.1; abgerufen am 27.09.2026)
- OpenAI: Modellvergleich und OpenAI: Introducing GPT-6.1 Sol (abgerufen am 04.10.2026)
- Sekundärquelle zum Benchmark-Vergleich: VentureBeat, 30.09.2026
- Sekundärquellen zur Zurückhaltung von GPT-6.1 Astra: CBS News, CNN und CNBC, jeweils 28.09.2026
Weiterlesen
- Gemini-Modelle im Vergleich: Welches passt zu deiner Aufgabe?
- Was kostet Gemini? Preise und Pläne 2026
- Google Gemini für Unternehmen: der Guide
- Claude Opus 5.5: Preise, Neuerungen und Vergleich mit Fable 5.1
- GPT-6 Astra erklärt: Preise, Pläne und Einordnung
- GPT-6.1 Sol: Preise, Vergleich und Verfügbarkeit
- Beste KI 2026: ChatGPT, Claude oder Gemini?
- KI-Updates: Neue Modelle, Preise und Abschaltungen