KI-Strategie · 3. September 2026

Zwei neue Modelle,
kein Flaggschiff.

Google bringt am 2. September Gemini 3.8 Flash, das dritte Flash-Modell in sechs Wochen, Meta legt am selben Tag Muse Spark 1.3 nach. Beides sind Arbeitspferde, keine Spitzenmodelle, und genau dort tobt jetzt der Preiskampf. Der Faktencheck zu Preisen, Benchmarks und Selbstauskünften, mit einer Entscheidungsregel für kleine Betriebe.

Lesedauer5 Minuten
KategorieKI-Strategie
Gemini 3.8 Flash0,75 $ / 3,75 $ bis 31.12.
Stand3. September 2026
GEMINI 3.8 FLASH: DRITTES FLASH-MODELL IN SECHS WOCHEN, EINFÜHRUNGSPREIS 0,75 / 3,75 DOLLAR BIS JAHRESENDE MUSE SPARK 1.3: 20 % WENIGER WERKZEUGAUFRUFE, 25 % WENIGER TOKENS, LAUT META ARTIFICIAL ANALYSIS: MUSE SPARK 1.3 BEI 62 PUNKTEN, GÜNSTIGSTES MODELL PRO GELÖSTER AUFGABE AB 59 PUNKTEN ABER: GOOGLES BENCHMARKS SIND EIGENE ZAHLEN, UND EIN NEUES GEMINI PRO FEHLT SEIT ANFANG 2026 GEMINI 3.8 FLASH: DRITTES FLASH-MODELL IN SECHS WOCHEN, EINFÜHRUNGSPREIS 0,75 / 3,75 DOLLAR BIS JAHRESENDE MUSE SPARK 1.3: 20 % WENIGER WERKZEUGAUFRUFE, 25 % WENIGER TOKENS, LAUT META ARTIFICIAL ANALYSIS: MUSE SPARK 1.3 BEI 62 PUNKTEN, GÜNSTIGSTES MODELL PRO GELÖSTER AUFGABE AB 59 PUNKTEN ABER: GOOGLES BENCHMARKS SIND EIGENE ZAHLEN, UND EIN NEUES GEMINI PRO FEHLT SEIT ANFANG 2026

Der Wettlauf findet
eine Klasse tiefer statt.

Die Schlagzeilen gehören den Flaggschiffen, das Geld wird mit den Arbeitspferden verdient. Am 2. September haben Google und Meta binnen Stunden zwei Modelle veröffentlicht, die genau in diese Klasse zielen: schnell, günstig, für Agenten und Code gebaut. Wer KI im Betrieb nutzt, zahlt fast immer für diese Klasse, nicht für die Spitze.

1

Das dritte Flash
in sechs Wochen.

Google nennt Gemini 3.8 Flash sein „intelligentestes Arbeitspferd", mit deutlichen Verbesserungen gegenüber 3.7 Flash bei Software-Entwicklung, Agentenaufgaben und mehrstufigem Schließen, bei gleicher Geschwindigkeit und gleichem Preis. Technisch: 1 Million Tokens Kontext, 64.000 Tokens Ausgabe, drei einstellbare Denkstufen. Der Einführungspreis gilt bis 31. Dezember 2026: 0,75 Dollar pro Million Eingabe-Tokens, 3,75 Dollar Ausgabe, ab 1. Januar 2027 das Doppelte (1,50 / 7,50 Dollar).

Dazu kommt Gemini 3.8 Flash Cyber, auf dieselbe Basis aufgesetzt, aber auf Schwachstellensuche und Patches getrimmt, laut Ars Technica vorerst nur für ausgewählte Tester und Behörden. Google berichtet von einer 2,6-fach höheren Patch-Genauigkeit beim Chrome-Sicherheitsteam und einer kritischen Lücke, die das Modell in zwei Stunden fand. Ars Technica ordnet den Takt ein: Es ist das dritte Flash-Modell in sechs Wochen, während ein neues Gemini Pro seit Anfang 2026 aussteht.

ABER: Eigene Benchmarks, fehlendes Pro

Die Vergleichszahlen stammen von Google selbst. Laut Ars sind die Sprünge gegenüber 3.7 Flash in den meisten Tests marginal, deutlicher nur beim Coding (Spitze auf DeepSWE). Bei der Computerbedienung (OSWorld-2.0) liegt das Modell weiterhin klar hinter Claude Opus. Und der Einführungspreis ist ein Einführungspreis: Wer heute kalkuliert, sollte mit 1,50 / 7,50 Dollar rechnen, auch wenn bis Januar vermutlich das nächste Modell kommt.

Gemini 3.8 Flash

Veröffentlicht2. September 2026
Kontext / Ausgabe1 Mio. / 64.000 Tokens
Preis bis 31.12.20260,75 $ / 3,75 $
Preis ab 1.1.20271,50 $ / 7,50 $
Flash-Releases seit Julidrei in sechs Wochen
Letztes neues Gemini ProAnfang 2026
Cyber-Variantenur Tester und Behörden
2

Weniger Tokens,
gleicher Preis.

Meta beschreibt Muse Spark 1.3 als Modell, das in Agenten- und Coding-Aufgaben rund 20 % weniger Werkzeugaufrufe und 25 % weniger Tokens braucht als Muse Spark 1.2, weniger geschwätzig, sauberer im Code, und das bei unklaren Aufträgen nachfragt und vor folgenreichen Aktionen bestätigt. Es läuft in Muse Code und der Meta Model API, die höchste Denkstufe folgt nach weiteren Sicherheitstests. Der Preis bleibt laut Artificial Analysis bei 1,25 Dollar Eingabe, 4,25 Dollar Ausgabe, zwischengespeicherte Eingaben 0,15 Dollar.

Interessanter als Metas eigene Angaben ist die unabhängige Messung: Artificial Analysis sieht Muse Spark 1.3 bei 61 Punkten (xhigh) bis 62 Punkten (max) im Intelligence Index, gleichauf mit GPT-5.6 Sol und Claude Opus 5 in vergleichbaren Stufen, hinter Claude Fable 5.1 (66). Entscheidend für Betriebe: Mit 0,55 Dollar pro gelöster Testaufgabe ist es das günstigste Modell unter allen, die 59 Punkte oder mehr erreichen (GPT-5.6 Sol: 0,95, Grok 4.6: 0,94).

ABER: Offene Gewichte bleiben ein Versprechen

Meta spricht in der Ankündigung von einer kommenden Veröffentlichung offener Gewichte, ohne Version und Datum. Bloomberg berichtet, dass für 1.3 noch nicht entschieden sei, ob die Gewichte freigegeben werden, geplant sei das für den Vorgänger 1.2. Wer auf ein lokal betreibbares Meta-Modell wartet, wartet also weiter. Und die Effizienzgewinne sind Metas Zahlen, die Indexwerte dagegen extern gemessen.

Muse Spark 1.3

Veröffentlicht2. September 2026
Vs. 1.2 (laut Meta)−20 % Toolcalls, −25 % Tokens
Preis pro Mio. Tokens1,25 $ / 4,25 $
Intelligence Index (AA)61 bis 62 Punkte
Kosten pro Testaufgabe0,55 $
Kontext / Eingaben1 Mio. Tokens, Text/Bild/Video
Offene Gewichteangekündigt, ohne Datum

Wer für jede Aufgabe das teuerste Modell nimmt, zahlt für Prestige.

Die Arbeitspferde erledigen inzwischen den größten Teil der Betriebsaufgaben. Das Spitzenmodell gehört dahin, wo ein Fehler wirklich teuer ist, nicht in die tägliche Routine.

Modellwahl gehört
in die Kalkulation.

Das eigentliche Signal dieses Tages ist nicht ein Benchmark, sondern der Takt: drei Google-Flash-Modelle in sechs Wochen, vier Muse-Spark-Versionen in fünf Monaten, Einführungspreise mit Ablaufdatum. Für einen kleinen Betrieb heißt das, dass die Frage „welches Modell" keine einmalige Entscheidung mehr ist, sondern eine laufende Position wie der Stromtarif. Ich habe bei AGREEMENT deshalb eine Kaskade eingerichtet: günstiges Modell zuerst, teures nur, wenn das Ergebnis nicht reicht. Diese Woche hat sich die untere Stufe wieder verbilligt.

Zwei Regeln reichen für den Anfang. Erstens: Jede Routineaufgabe, ob Angebotstext, Zusammenfassung oder Social-Post, bekommt das Arbeitspferd, und nur die Aufgaben mit echtem Fehlerrisiko das Spitzenmodell. Zweitens: Kein Workflow darf an einem Anbieter hängen. Wer Gemini, Muse Spark oder Claude hinter einer austauschbaren Schnittstelle betreibt, wechselt in einer Stunde, wenn der nächste Einführungspreis kommt. Wer fest verdrahtet hat, zahlt ab Januar das Doppelte und merkt es erst auf der Rechnung.

Merken für die Praxis

Gemini 3.8 Flash: 0,75 / 3,75 Dollar bis Jahresende, danach 1,50 / 7,50. Mit dem Normalpreis kalkulieren, nicht mit dem Einführungspreis.
Muse Spark 1.3: laut Artificial Analysis das günstigste Modell pro gelöster Aufgabe ab 59 Indexpunkten, 0,55 Dollar.
Selbstauskünfte von Google und Meta als solche lesen. Extern gemessen sind nur die Indexwerte, nicht die Effizienzversprechen.
Routine ans Arbeitspferd, Risiko ans Spitzenmodell, und kein Workflow fest an einen Anbieter binden.

Quellen: Google (Ankündigung 02.09.2026) und Gemini-API-Dokumentation, Ars Technica (Ryan Whitwam, 02.09.2026), Meta AI Research (02.09.2026), Artificial Analysis, Bloomberg (02.09.2026, zu den Modellgewichten). Stand: 03.09.2026.

Gratis-Online-Guide

Der KI-Werkzeugkasten 2026

Welches Modell für welche Aufgabe, welche Tools wirklich zählen und wie du richtig promptest — komplett lesbar, kein Download.

Jetzt gratis lesen →
Kein Spam · Double-Opt-In · Abmeldung jederzeit
✓ Eingetragen — bitte bestätige noch die Mail in deinem Postfach.
Zum KI-Werkzeugkasten →

Der richtige Tarif
für jede Aufgabe.

Ich richte KI-Workflows mit Modell-Kaskade ein: günstig zuerst, teuer nur bei Bedarf, und nie fest an einen Anbieter gebunden. Lass uns rechnen.

Kennenlernen →