Die kurze Antwort Google hat am 30. September 2026 Gemini 4 Argon angekündigt. Breit nutzbar ist es noch nicht: Zuerst kommen ausgewählte Sicherheitsteams im Fairwind Program, danach zahlende API-Kunden und Google AI Ultra. Stand 5. Oktober 2026 ist Argon weder in der API noch in der Gemini-App verfügbar. Für Unternehmen im Mittelstand ändert sich deshalb kurzfristig wenig. Zur Einführung soll Argon 2 $ Input und 10 $ Output pro Million Tokens kosten, danach 4 $ und 20 $.

Angekündigt am 30.09.2026

Von Koray Kavukcuoglu, SVP bei Google DeepMind.

Einführungspreis pro Mio. Tokens 2 $ / 10 $

Input und Output, danach 4 $ / 20 $. Enddatum nennt Google nicht.

Verfügbar am 05.10.2026 nur Fairwind

Weder in der API noch in der Gemini-App.

Maximale Ausgabe 1 Mio. Tokens

Laut Google. Den Eingabekontext nennt Google nicht.

Was hat Google mit Gemini 4 Argon angekündigt?

Google hat am 30. September 2026 Gemini 4 Argon vorgestellt, ein neues Spitzenmodell für Programmierung, Wissensarbeit im Unternehmen und Cyberabwehr. Angekündigt hat es Koray Kavukcuoglu, SVP bei Google DeepMind, mit den Worten „Our frontier model for real-world coding, enterprise knowledge work, and cyber defense“. Frontier-Modell nennen die Anbieter ihre jeweils leistungsstärkste Modellstufe. Für die Praxis zählen vier Punkte:

  • Noch nicht breit verfügbar. Zuerst bekommen ausgewählte Sicherheitsteams im Fairwind Program Zugang, danach zahlende API-Kunden und Abonnenten von Google AI Ultra. Ein Datum nennt Google nicht. Details im Abschnitt Verfügbarkeit.
  • Einführungspreis 2 $ / 10 $. So viel soll Argon zum Start pro Million Input- und Output-Tokens kosten, zwischengespeicherter Input 95 Prozent weniger als der Input-Preis. Danach steigt der Preis auf 4 $ und 20 $; wann, sagt Google nicht.
  • Sehr lange Ausgaben. Argon kann laut Google bis zu 1 Million Tokens ausgeben, Gemini 3.8 Flash und 3.1 Pro kommen auf 65.536 Tokens. Wie viel Text Argon als Eingabe verarbeitet, nennt Google nicht.
  • Bestwerte laut Google. Google meldet neue Bestwerte, etwa 77,9 Prozent auf DeepSWE v1.1. Das sind Herstellerangaben, mehr dazu im Abschnitt Benchmarks.

Wer bekommt Gemini 4 Argon und wann?

Zuerst eine Gruppe ausgewählter Sicherheitsteams, danach zahlende API-Kunden und Abonnenten von Google AI Ultra; ein Datum nennt Google für keinen dieser Schritte. Für alle anderen ist Argon Stand 5. Oktober 2026 nirgends verfügbar: nicht in der Modellliste der Gemini API, nicht im Changelog, auf keiner Preisseite, ohne Modellkarte, nicht in der Gemini-App und nicht auf Googles Abo-Seite. Die Reihenfolge laut Google:

  1. Fairwind Program. Den Anfang macht laut Google „a set of trusted cyber defenders“. Fairwind ist Googles Programm mit begrenztem Zugang zu Fähigkeiten für die Cyberabwehr, gestartet am 2. September 2026 mit Gemini 3.8 Flash Cyber. Google spricht von „more than 650 participating partners globally“. Berechtigt sind Regierungen und Cyberbehörden, Betreiber kritischer Infrastruktur, Kerntechnologie-Plattformen und akademische Labore. Ein typischer Mittelständler gehört zu keiner dieser Gruppen, Betreiber kritischer Infrastruktur sind die Ausnahme.
  2. Zahlende API-Kunden. Danach soll Argon „to developers, enterprises, and consumers“ kommen, „starting with paid API customers and Google AI Ultra subscribers“. Welche Zugänge genau gemeint sind, etwa die Gemini API oder die Gemini Enterprise Agent Platform (früher Vertex AI), schlüsselt die Ankündigung nicht auf.
  3. Google AI Ultra. Parallel sollen Abonnenten von Google AI Ultra Argon bekommen. Ultra ist ein Abo für private Konten und kostet laut Googles deutscher Abo-Seite 99,99 € pro Monat mit fünffachen oder 219,99 € mit zwanzigfachen Pro-Limits.

Unternehmen nennt Google zwar als Zielgruppe, einen Termin für Google Workspace oder Gemini Enterprise enthält die Ankündigung aber nicht. Neue Modelle, Freigaben und Preisänderungen fasse ich laufend in den KI-Updates zusammen.

Was kostet Gemini 4 Argon im Vergleich zu Opus 5.5, Sonnet 5.5, GPT-6 Astra und GPT-6.1 Sol?

Zur Einführung kostet Argon 2 $ Input und 10 $ Output pro Million Tokens, genauso viel wie Claude Sonnet 5.5 und GPT-6.1 Sol. Nach der Einführungsphase steigt der Preis auf 4 $ und 20 $, das entspricht Claude Opus 5.5. GPT-6 Astra kostet mit 10 $ und 50 $ das Zweieinhalbfache dieses späteren Argon-Preises. Wann die Einführungsphase endet, sagt Google nicht, und auf keiner Preisseite steht Argon bisher. API-Listenpreise in US-Dollar pro Million Tokens:

ModellInputOutputZwischengespeicherter InputVerfügbar (Stand 05.10.2026)Quelle
Gemini 4 Argon, Einführungspreis2 $10 $95 % unter dem Input-Preis, rechnerisch 0,10 $nur im Fairwind ProgramGoogle, Argon-Ankündigung (abgerufen am 05.10.2026)
Gemini 4 Argon, nach der Einführungsphase4 $20 $k. A.Termin nicht genanntGoogle, Argon-Ankündigung (abgerufen am 05.10.2026)
Claude Opus 5.54 $20 $0,20 $seit 22.09.2026Anthropic, Opus-5.5-Ankündigung und Preisseite (abgerufen am 27.09.2026)
Claude Sonnet 5.52 $10 $0,20 $seit 28.09.2026Anthropic, Sonnet-5.5-Ankündigung (abgerufen am 04.10.2026)
GPT-6 Astra10 $50 $1 $seit 03.09.2026OpenAI, Modellvergleich (abgerufen am 04.10.2026)
GPT-6.1 Sol2 $10 $0,10 $seit 29.09.2026OpenAI, GPT-6.1-Sol-Ankündigung (abgerufen am 04.10.2026)
Gemini 3.8 Flash (zum Vergleich)0,75 $, ab 2027 1,50 $3,75 $, ab 2027 7,50 $0,075 $seit 02.09.2026Google, Gemini-API-Preise (abgerufen am 05.10.2026)
Gemini 3.1 Pro, Preview (zum Vergleich)2 $, über 200.000 Tokens 4 $12 $, über 200.000 Tokens 18 $0,20 $ bzw. 0,40 $seit 19.02.2026Google, Gemini-API-Preise (abgerufen am 05.10.2026)

Kurz erklärt: Beim zwischengespeicherten Input speichert der Anbieter wiederkehrende Teile eines Prompts, etwa lange Anweisungen, und berechnet sie beim erneuten Lesen deutlich günstiger. Die Anbieter zählen Tokens unterschiedlich, der Preisvergleich pro Token ist deshalb nur ein Näherungswert. Bei GPT-6 Astra gelten über 272.000 Input-Tokens höhere Preise, bei Gemini 3.1 Pro über 200.000 Tokens Prompt.

Rechenmuster mit Listenpreisen

Beispielablauf: Eine Automation verbraucht im Monat 10 Millionen Input-Tokens und 2 Millionen Output-Tokens. Gerechnet ist rein mit API-Listenpreisen, ohne Cache, Batch, Aufschläge für sehr lange Prompts und Steuern.

ModellKosten pro Monat
Gemini 3.8 Flash, 2026 und ab 202715 $ bzw. 30 $
Gemini 4 Argon, Einführungspreis40 $
Claude Sonnet 5.5 und GPT-6.1 Solje 40 $
Gemini 3.1 Pro (Prompts bis 200.000 Tokens)44 $
Gemini 4 Argon, nach der Einführungsphase80 $
Claude Opus 5.580 $
GPT-6 Astra200 $

So liest du die Tabelle: Tokenpreise sagen nichts über die Kosten pro erledigter Aufgabe. Braucht ein Modell weniger Anläufe oder Tokens, kann ein höherer Tokenpreis am Ende günstiger sein. Für die Budgetplanung zählt bei Argon der spätere Preis von 4 $ und 20 $. Abo- und Workspace-Preise findest du unter Gemini-Preise, Details zu den Konkurrenzmodellen in den Artikeln zu Claude Opus 5.5, GPT-6 Astra und GPT-6.1 Sol.

Wie schneidet Gemini 4 Argon in Benchmarks ab?

Laut Google setzt Argon auf mehreren Benchmarks neue Bestwerte, darunter 77,9 Prozent auf DeepSWE v1.1. Alle Werte der folgenden Tabelle sind Herstellerangaben aus Googles Ankündigung. Unabhängige Nachmessungen habe ich für diesen Artikel nicht ausgewertet, und solange Argon nicht frei verfügbar ist, kannst du die Werte nicht selbst prüfen.

Benchmark (Herstellerangaben)ArgonEinordnung durch Google
DeepSWE v1.1 (Software-Entwicklung)77,9 %neuer Bestwert („new state of the art“)
AutomationBench (von Zapier)51,3 %Platz 1
LVBench (Verständnis langer Videos)91,7 %Bestwert
CWE-bench v1 (Cybersicherheit)68 %geteilter erster Platz
Vals Indexk. A.führendes Modell
Gray Swan IPI (Robustheit gegen indirekte Prompt Injection)k. A.führend

Kurz erklärt: Bei einer indirekten Prompt Injection versteckt jemand Anweisungen in einer Webseite, einer E-Mail oder einem Dokument, das ein KI-Modell liest, und versucht so, das Modell umzusteuern. Für Agenten mit Zugriff auf Postfächer oder Browser ist die Robustheit dagegen ein zentrales Sicherheitsthema.

Laut VentureBeat (Sekundärquelle, 30. September 2026) liegt Argon in 13 von 18 veröffentlichten Benchmarks vorn oder gleichauf. Für DeepSWE nennt VentureBeat 74,2 Prozent für Claude Opus 5.5 und 74,1 Prozent für GPT-6 Astra. Was diese Werte für deutsche Texte, Büroarbeit oder eure eigenen Dokumente bedeuten, zeigen erst Tests mit echten Fällen, sobald Argon zugänglich ist.

Vom Modell zum Ablauf

Ein neues Spitzenmodell ändert noch nichts an euren Abläufen. Den Unterschied machen eine Modellwahl, die eine Einstellung ist und kein Umbau, Tests mit echten Fällen und klare Kostenobergrenzen. Wie das aussieht, beschreibe ich unter KI-Automatisierung.

KI-Automatisierung ansehen

Warum gibt Google Argon nur stufenweise frei?

Google begründet die stufenweise Freigabe mit Sicherheit: „Safely releasing frontier capabilities at this level requires a phased approach.“ Außerdem beteiligt sich Google am freiwilligen Verfahren der US-Regierung für den Vorab-Zugriff auf Modelle vor ihrer Veröffentlichung und weitet den Zugang nach eigenen Worten schrittweise aus.

Der Schwerpunkt Cyberabwehr passt zu dieser Reihenfolge. Meine Lesart: Ein Modell, das Schwachstellen gut findet und behebt, ist auch für Angreifer interessant, deshalb sollen Verteidiger einen Vorsprung bekommen. Google beschreibt das Ziel des Fairwind Program ähnlich: Vertrauenswürdige Partner sollen einen entscheidenden Vorsprung gegen Cyberbedrohungen bekommen („a critical head start against cyber threats“).

Google ist mit dieser Vorsicht nicht allein. OpenAI hält laut CBS News, CNN und CNBC (Sekundärquellen) GPT-6.1 Astra vorerst zurück, weil das Modell beim Einhalten von Auftrag und Berechtigungen die eigene Hürde noch nicht genommen hat. Anthropic gibt Claude Mythos 5.1 nur über Programme mit geprüftem Zugang frei, derzeit nur für ausgewählte Organisationen in den USA. Für Unternehmen heißt das: Zwischen der Ankündigung eines Spitzenmodells und seiner breiten Nutzbarkeit kann Zeit vergehen, die sich nicht planen lässt.

Was bedeutet Argon für Unternehmen im Mittelstand?

Kurzfristig wenig: Stellt jetzt nichts um, testet das verfügbare Gemini 3.8 Flash und plant das Budget 2027 mit den späteren Preisen. Die folgenden fünf Punkte sind meine Einordnung auf Basis von Googles Angaben, kein Testergebnis.

  1. Jetzt nichts umstellen. Argon ist nicht verfügbar, und es gibt kein Datum. Projekte, die heute starten, bauen auf Modellen auf, die ihr heute testen könnt.
  2. Gemini 3.8 Flash testen. Das neueste allgemein verfügbare Gemini-Modell kostet bis Ende 2026 0,75 $ Input und 3,75 $ Output pro Million Tokens und läuft über die Gemini Enterprise Agent Platform auch in der EU-Multiregion mit Verarbeitung in der EU. Wer Gemini für Agenten, Dokumentenarbeit oder Coding prüfen will, startet hier.
  3. Budget 2027 realistisch planen. Die Einführungspreise der Flash-Modelle 3.6, 3.7 und 3.8 laufen am 31. Dezember 2026 aus; ab 1. Januar 2027 verdoppeln sie sich auf 1,50 $ Input und 7,50 $ Output pro Million Tokens. Plant euer Budget 2027 mit dem doppelten Preis. Bei Argon rechnet ihr mit 4 $ und 20 $, weil Google das Ende des Einführungspreises nicht nennt.
  4. Die EU-Frage offen lassen. Google sagt nichts dazu, ob und wann Argon in der EU oder in EU-Regionen verfügbar sein wird. Schon das aktuelle Pro-Modell 3.1 Pro läuft in Gemini Enterprise in der EU ohne Datenresidenz und ohne ML-Verarbeitung. Dass Argon sofort mit Verarbeitung in der EU startet, solltet ihr deshalb nicht voraussetzen. Mehr zu Datenregionen im Guide Gemini und DSGVO.
  5. Die Abhängigkeit von Ultra und API bedenken. Nach Fairwind kommen zuerst die bezahlte API und Google AI Ultra. Ein bezahltes Google-AI-Abo ändert an den Datenregeln privater Konten nichts; die Unternehmenszusagen (kein Training und keine menschliche Prüfung ohne Erlaubnis) gelten nur für Workspace-Konten. Private Ultra-Konten sind deshalb kein Weg, Argon mit Firmendaten zu nutzen. Für Unternehmen bleibt zunächst die bezahlte API mit eigener Integration.

Muster: So bereitest du einen späteren Wechsel vor

Erstens auflisten, wo ihr heute Gemini-Modelle nutzt und mit welcher Modell-ID. Zweitens die Modell-ID als zentrale Einstellung pflegen, damit ein Wechsel eine Zeile ist. Drittens 20 bis 50 echte Fälle mit Ergebnis, Laufzeit und Kosten des aktuellen Modells festhalten. Ist Argon für euren Zugang freigeschaltet, laufen dieselben Fälle noch einmal durch, und ihr entscheidet mit euren eigenen Zahlen.

Wie passt Argon zu den übrigen Gemini-Modellen?

Argon ist als Frontier-Modell angekündigt, im Alltag bleiben vorerst die Klassen Flash-Lite, Flash und Pro. Das neueste allgemein verfügbare Gemini-Modell ist Gemini 3.8 Flash vom 2. September 2026. Aktuelles Pro-Modell bleibt Gemini 3.1 Pro im Preview-Status, Gemini 3.5 Pro führt Google weiter als ‚coming soon‘. Zusätzlich stellt Google ab dem 9. Oktober 2026 die Gemini-App für private Konten um: Ohne Abo gibt es nur noch das Modell Flash-Lite. Flash gibt es ab Google AI Plus, das Pro-Modell ab Google AI Pro.

Welches Modell in welchem Produkt steckt, was es kostet und welche Modelle in der EU laufen, steht im Guide Gemini-Modelle im Vergleich. Den Einstieg in alle Gemini-Themen findest du im Gemini-Guide für Unternehmen, den Plattformvergleich mit Claude und ChatGPT unter Beste KI 2026.

Von der Modellfrage zur Umsetzung

Ihr nutzt Gemini schon in Automationen oder wollt wissen, ob 3.8 Flash für eure Aufgaben reicht und was 2027 auf euch zukommt? Beschreibe mir kurz, welche Abläufe betroffen sind und was ein gutes Ergebnis leisten muss. Wir klären, ob ein Modellvergleich, eine Umstellung oder ein Teamtraining sinnvoll ist.

Unsere Abläufe kurz schildern

Kostenfreier, unverbindlicher Erstkontakt. Ein fertiges Konzept ist nicht nötig.

Häufige Fragen zu Gemini 4 Argon

Was ist Gemini 4 Argon?

Gemini 4 Argon ist das neue Spitzenmodell von Google, angekündigt am 30. September 2026 für Programmierung, Wissensarbeit im Unternehmen und Cyberabwehr. Laut Google erreicht es auf DeepSWE v1.1 77,9 Prozent und kann bis zu 1 Million Tokens ausgeben. Breit nutzbar ist es noch nicht.

Kann ich Gemini 4 Argon schon nutzen?

Nein, Stand 5. Oktober 2026 ist Argon weder in der API noch in der Gemini-App verfügbar. Zuerst kommen ausgewählte Sicherheitsteams im Fairwind Program, danach zahlende API-Kunden und Google AI Ultra. Ein Datum nennt Google nicht.

Was kostet Gemini 4 Argon?

Zur Einführung 2 $ Input und 10 $ Output pro Million Tokens, zwischengespeicherter Input kostet 95 Prozent weniger als der Input-Preis. Danach steigt der Preis auf 4 $ und 20 $, wann die Einführungsphase endet, sagt Google nicht. Auf Googles Preisseiten steht Argon bisher nicht.

Ist Gemini 4 Argon besser als Claude Opus 5.5 und GPT-6 Astra?

Laut Google setzt Argon auf DeepSWE v1.1 mit 77,9 Prozent einen neuen Bestwert, VentureBeat nennt dort 74,2 Prozent für Opus 5.5 und 74,1 Prozent für GPT-6 Astra. Insgesamt liegt Argon laut VentureBeat in 13 von 18 veröffentlichten Benchmarks vorn oder gleichauf. Das sind Hersteller- und Presseangaben; für eure Aufgaben zählen eigene Tests, sobald Argon verfügbar ist.

Ist Gemini 4 Argon in der EU verfügbar?

Dazu äußert sich Google bisher nicht, weder zur Verfügbarkeit in der EU noch zu EU-Regionen. Stand 5. Oktober 2026 ist Argon ohnehin nur im Fairwind Program nutzbar. Wer Gemini heute mit Datenverarbeitung in der EU braucht, nutzt Gemini 3.8 Flash über die Agent Platform und die EU-Multiregion.

Warum gibt Google Argon nur schrittweise frei?

Google begründet das mit Sicherheit: Fähigkeiten auf diesem Niveau erfordern laut Google eine stufenweise Freigabe. Zudem beteiligt sich Google am freiwilligen Verfahren der US-Regierung für den Vorab-Zugriff auf neue Modelle. Den Anfang machen Sicherheitsteams im Fairwind Program.

Sollten Unternehmen mit KI-Projekten auf Argon warten?

Nein, denn für Argon gibt es kein Datum, und Warten kostet Zeit, ohne dass klar ist, wie viel. Startet mit verfügbaren Modellen wie Gemini 3.8 Flash und legt die Modellwahl als Einstellung an, damit ein späterer Wechsel einfach ist. Plant das Budget 2027 mit den späteren Preisen.

Offizielle Quellen und Stand der Recherche

Dieser Artikel wurde am 5. Oktober 2026 erstellt. Angaben zu Google stammen aus den verlinkten Primärquellen, abgerufen am 05.10.2026; die Preise von Claude Sonnet 5.5 und der OpenAI-Modelle wurden am 04.10.2026 geprüft, die von Claude Opus 5.5 am 27.09.2026. Benchmark-Werte zu Argon sind Herstellerangaben von Google. VentureBeat sowie CBS News, CNN und CNBC sind Sekundärquellen. Google rollt Modelle schrittweise aus; maßgeblich ist die Anzeige in deinem Konto.

Weiterlesen

Jean Hinz, KI-Berater für den Mittelstand aus Lüneburg

Über den Autor

Jean Hinz

KI-Berater für den Mittelstand, Lüneburg/Hamburg

Ich begleite Geschäftsführungen und Teams dabei, KI vom Einzelexperiment in einen belastbaren Betrieb zu überführen. Schwerpunkt: Prozesse zuerst, Werkzeuge danach. Praxis aus Industrie, Tourismus, Veranstaltungen und weiteren Unternehmensbereichen.

  • Beratung & Umsetzung aus einer Hand
  • Arbeit an euren eigenen Prozessen
  • Seit 2023 KI-Beratung
Vom Modell zur Umsetzung

In 30 Minuten klären wir, welches Modell eure Abläufe heute trägt.

Kein Modell-Hype. Wir schauen auf Aufgaben, Qualität, Kosten und den sicheren Weg in den Betrieb.

Erstgespräch buchen, kostenfrei →

30 Minuten · Unverbindlich · Per Video-Call

Erstgespräch buchen →