Fünf Themen, jedes einzeln geprüft: Google zieht Gemini 3.7 Flash nur drei Wochen nach dem Vorgänger nach, OpenAI startet GPT-5.6 Sol "Ultrafast" auf Cerebras-Chips, dazu Microsofts MAI-Code-1.1-Flash, ein proaktiveres Claude Tag für Slack und Suno Studio 2.0 für die Musikproduktion.
Nur drei Wochen nach 3.6 Flash veröffentlicht Google mit 3.7 Flash das neue Workhorse-Modell für Coding und Agenten. Deutliche Benchmark-Sprünge (DeepSWE v1.1: 49,0 % → 65,3 %; FrontierCode 1.1: 34,4 % → 43,6 %), Einführungspreis 0,75 $ / 3,75 $ pro Mio. Token (Input/Output) — 50 % günstiger als der Vorgänger, steigt laut Google zum 01.01.2027 auf 1,50 $ / 7,50 $. Ab sofort Basis von Gemini Spark, Googles 24/7-Agentenprodukt für AI-Pro/Ultra-Abonnent:innen.
Kein direktes Marketing-Feature, aber relevant als Kontext für schnellere, günstigere LLM-Calls in Automatisierungs-Workflows.
Quellen: Google Blog · DeepMind Model Card · the-decoder.com
Neuer API-Tier, bis zu 14x schneller als Standard — unabhängig bestätigt läuft er auf Cerebras-Chips (Wafer-Scale Engine, On-Chip-SRAM) statt klassischer GPUs. Limitiertes Preview. Zielanwendungen: Echtzeit-Kundenservice, E-Commerce, Finanzanalyse.
Infrastruktur-Upgrade, relevant für High-Volume-Automatisierung mit Latenzanforderungen — die Cerebras-Partnerschaft ist real, kein Gerücht.
Quelle: OpenAI
Seit 11.8. in GitHub Copilot verfügbar: kleines Coding-Modell mit nativem Bild-/Vision-Verständnis, 73 % günstiger als der Vorgänger. Bleibt laut the-decoder.com im direkten Vergleich weiterhin hinter DeepSeek-V4-Flash zurück, sowohl bei Preis als auch bei Leistung.
Randrelevant, zeigt aber den Preis-/Leistungswettbewerb bei kleinen Coding-Modellen.
Quellen: GitHub Copilot Changelog · Microsoft AI · the-decoder.com
Update vom 13.8.: Claude Tag nutzt jetzt den vollen Kanal-Kontext, Memory und Standing Instructions statt einzelner Nachrichten, um proaktiv einzuspringen — laut Anthropic rund 30 % bessere Trefferquote dabei, wann ein Einspringen sinnvoll ist. Kostenlos verfügbar, kein Aufpreis.
Direkt relevant für Teams mit Slack-basierten Content-Workflows.
Quelle: Claude Blog
Im Fenster 12.–14.8.2026 gab es bei den drei großen Automatisierungs-Plattformen keine Ankündigungen, die eine eigene Meldung wert wären.
Launch am 13.8. für Premier-Abonnent:innen: MIDI-Import/-Bearbeitung per Piano Roll, ein Wavetable-Synth, ein Chat-Interface zur Erzeugung von Instrumenten und Vocals per Textbeschreibung (löst die alte Cover/Remix-Leiste ab, aktuell Beta), fortgeschrittene Stem-Separation und unlimitierter Multitrack-Export (32-Bit/48 kHz, ohne Einschränkungen).
Kein Video-/Bild-Tool, aber ein weiteres Beispiel für das Tempo der KI-Content-Automatisierung — interessant für Audio- und Sound-Branding.
Quellen: Suno Blog · Release Notes · the-decoder.de
Schnellere, günstigere Modelle (Gemini, Cerebras-Speed), proaktivere Automatisierung (Claude Tag) und immer direktere Content-Erzeugung (Suno) — die Reibung zwischen Idee und fertigem Ergebnis wird diese Woche gleich mehrfach kleiner.
Alle fünf Themen wurden vor Veröffentlichung unabhängig verifiziert. Stand: 14.08.2026.
Welches Modell für welche Aufgabe, welche Tools wirklich zählen und wie du richtig promptest — komplett lesbar, kein Download.
Jetzt gratis lesen →Ich filtere die KI-News, die für dein Business wirklich zählen — und übersetze sie in konkrete nächste Schritte. Lass uns reden.