Tipps, Tricks & Tools · 28. September 2026

Fast so gut.
Halber Preis.

Die Faustregel lautete bisher: Massenarbeit auf das kleine Modell, Urteilsfragen auf das große. Seit heute wackelt der zweite Teil dieser Regel. Das günstige Modell liegt bei Wissensarbeit zwei Punkte hinter dem teuren und bei Aufgaben auf der Kommandozeile sogar davor. Der Preis bleibt bei der Hälfte.

Lesedauer5 Minuten
KategorieTipps, Tricks & Tools
QuelleAnthropic, VentureBeat, 28. September 2026
Stand28. September 2026
✦ SONNET 5.5 IST DA: ÜBER 30 PROZENT SCHNELLER, BIS ZU 30 PROZENT GÜNSTIGER JE AUFGABE ✦ PREIS UNVERÄNDERT: 2 DOLLAR EINGABE, 10 DOLLAR AUSGABE JE MILLION TOKEN ✦ WISSENSARBEIT: 1844 PUNKTE GEGEN 1846 BEIM GROSSEN OPUS 5.5 ✦ ABER: HEIKLE SICHERHEITSFRAGEN GEHEN AUTOMATISCH AN DAS ÄLTERE MODELL ✦ SONNET 5.5 IST DA: ÜBER 30 PROZENT SCHNELLER, BIS ZU 30 PROZENT GÜNSTIGER JE AUFGABE ✦ PREIS UNVERÄNDERT: 2 DOLLAR EINGABE, 10 DOLLAR AUSGABE JE MILLION TOKEN ✦ WISSENSARBEIT: 1844 PUNKTE GEGEN 1846 BEIM GROSSEN OPUS 5.5 ✦ ABER: HEIKLE SICHERHEITSFRAGEN GEHEN AUTOMATISCH AN DAS ÄLTERE MODELL

Der Abstand
ist fast weg.

Anthropic hat heute Claude Sonnet 5.5 veröffentlicht, das zweite Modell der neuen Familie nach Opus 5.5 vom 22. September. Sonnet ist traditionell das Arbeitspferd: schnell, günstig, für Masse gedacht. Neu ist, wie klein der Abstand zum großen Bruder geworden ist.

1

1844 gegen 1846.
Und einmal davor.

In der Bewertung GDPval-AA, die Wissensarbeit misst, kommt Sonnet 5.5 auf 1844 Punkte. Das große Opus 5.5 erreicht 1846. Zwei Punkte Unterschied, bei doppeltem Preis. Der Vorgänger Sonnet 5 lag bei 1449, das ist der eigentliche Sprung.

Bei Terminal-Bench 4.0, einem Test für Arbeit auf der Kommandozeile, liegt Sonnet 5.5 mit 70,6 Prozent sogar vor Opus 5.5 mit 66,4 Prozent. Zum Vergleich: Sonnet 5 schaffte dort 10,3 Prozent. Bei Computeraufgaben in OSWorld sind es 80,1 gegenüber 81,8 Prozent für Opus.

Die Preise bleiben, wie sie waren: 2 Dollar je Million Token Eingabe, 10 Dollar bei der Ausgabe. Opus 5.5 kostet das Doppelte. Zwischengespeicherte Inhalte liegen bei 20 Cent je Million.

Dazu kommt der Teil, der in der Praxis mehr ausmacht als der Listenpreis. Nach Angaben des Herstellers ist Sonnet 5.5 über 30 Prozent schneller und kostet je Aufgabe bis zu 30 Prozent weniger. Der Grund ist nicht ein niedrigerer Tarif, sondern dass das Modell weniger Token und weniger Werkzeugaufrufe braucht, um zum Ziel zu kommen.

Aus der Praxis berichten Anwender: Ein Anbieter für Dokumentenverwaltung nennt 2,4-mal schnellere Verarbeitung bei 12 Prozent weniger Token, ein Helpdesk-Anbieter 20 Prozent schnellere Bearbeitung, ein Nachrichtendienst 14 Prozent weniger Ausgabe-Token. Bei einem Baukasten-Anbieter sank die Zahl der Werkzeugaufrufe um etwa ein Drittel. Das sind Angaben der jeweiligen Firmen, keine unabhängigen Messungen.

ABER: Heikle Sicherheitsfragen landen woanders

Anthropic behält das Muster bei, das schon bei Opus 5.5 galt: Anfragen aus dem Bereich Cybersicherheit mit erhöhtem Risiko werden automatisch an das ältere Sonnet 5 weitergereicht. Wenn Antworten in diesem Themenfeld also plötzlich schwächer wirken, liegt das nicht an dir. Für alle anderen Aufgaben spielt das keine Rolle.

Nachtrag: Anthropic nennt als Stärken des Modells ausdrücklich das Beheben von Fehlern in Programmcode sowie saubere Dokumente, Folien und Tabellen. Für Büroarbeit ist das der interessantere Teil als jeder Benchmark. Angekündigt ist außerdem Haiku 5.5 für die kommenden Wochen, also die kleinste und günstigste Stufe der Familie.

Sonnet 5.5 im Vergleich

Wissensarbeit GDPval-AA1844 zu 1846 bei Opus 5.5
Vorgänger Sonnet 51449
Terminal-Bench 4.070,6 % zu 66,4 % bei Opus
Computeraufgaben OSWorld80,1 % zu 81,8 %
Preis je Mio. Token2 ein, 10 aus
Opus 5.5 zum Vergleich4 ein, 20 aus
2

Die Faustregel
wird einfacher.

Bisher hieß unsere Empfehlung: Massenaufgaben auf das kleine Modell, Urteilsfragen auf das große. Diese Regel bleibt richtig, aber die Grenze verschiebt sich deutlich nach oben. Wenn zwischen den beiden Modellen bei Wissensarbeit zwei Punkte liegen, dann ist das teure Modell nur noch für die wirklich kniffligen Fälle nötig.

Praktisch heißt das: Stell deine laufenden Automatisierungen auf das neue Sonnet um, wenn du sie über die Schnittstelle betreibst. Also alles, was Mails sortiert, Texte erzeugt, Bewertungen auswertet, Daten aufbereitet oder Anfragen vorbereitet. Wer bisher aus Kostengründen ein schwächeres Modell genommen hat, bekommt jetzt spürbar bessere Ergebnisse zum gleichen Preis.

Und wie immer bei einem Modellwechsel, auch wenn es verlockend ist, einfach umzuschalten: Leg zwanzig echte Fälle nebeneinander. Nimm zwanzig Vorgänge aus der letzten Woche, lass sie vom alten und vom neuen Modell bearbeiten und vergleiche. Das kostet eine halbe Stunde und ist der einzige Weg, den Unterschied für deine Arbeit zu kennen statt für einen Test, der mit deiner Arbeit nichts zu tun hat.

Wer nur im Chat arbeitet und nicht über die Schnittstelle, merkt vor allem das Tempo. Das ist angenehm, ändert aber an den Kosten nichts, die stecken im Monatsabo.

ABER: Das sind Herstellerangaben

Tempo, Kostenersparnis und Benchmark-Werte kommen von Anthropic und von Firmen, die das Modell einsetzen. Unabhängige Vergleiche gibt es noch nicht, und Bewertungen wie GDPval messen bestimmte Aufgabentypen, nicht deinen Alltag. Die Richtung ist eindeutig, die genaue Zahl für deinen Fall kennst du erst nach dem eigenen Test.

Dein Vorgehen

laufende Automatisierungauf Sonnet 5.5 umstellen prüfen
Vergleichzwanzig echte Fälle nebeneinander
teures Modellnur noch für knifflige Urteilsfragen
im Chatvor allem spürbar schneller
Sicherheitsthemengehen an das ältere Modell

UPDATE 29.09.2026: Die erste unabhängige Messung relativiert die Ersparnis

Einen Tag nach dem Start liegt die erste unabhängige Messung vor, und sie setzt der Kostenrechnung oben etwas entgegen. Das Analysehaus Artificial Analysis bestätigt zwar den kleinen Abstand: 56 Punkte auf seinem Intelligenz-Index, zwei hinter Opus 5.5. Aber es misst zugleich den bislang höchsten Tokenverbrauch je Aufgabe, den es je aufgezeichnet hat: rund 60 Prozent mehr Ausgabe-Token als Opus 5.5 oder als der Vorgänger. Bei voll aufgedrehtem Denkaufwand kommt es damit auf rund 7,60 US-Dollar je Aufgabe und liegt etwa 50 Prozent über Sonnet 5.

Das ist kein Widerspruch zur Herstellerangabe, sondern eine Frage der Einstellung: Anthropic rechnet mit dem üblichen Betrieb, Artificial Analysis misst mit maximalem Denkaufwand. Für dich heißt das aber sehr konkret: Der Spartipp gilt nur, wenn der Denkaufwand nicht auf Maximum steht. Wer ihn hochdreht, zahlt mehr als vorher, nicht weniger. Das deckt sich mit einem Hinweis, der seit Tagen in Fachkreisen kursiert, wonach die mittlere Stufe in der Regel das beste Verhältnis liefert und die höchste kaum zusätzlichen Nutzen bringt. Dazu kommt laut derselben Auswertung eine bekannte Schwäche der kleineren Klasse: beim reinen Faktenwissen bleibt Sonnet hinter Opus. Prüfe das bei deinem eigenen Vergleich mit.

Quelle: Auswertung von Artificial Analysis zum Start von Claude Sonnet 5.5, aufgegriffen im TLDR-Newsletter vom 29.09.2026. Die Werte beziehen sich auf den Betrieb mit maximalem Denkaufwand.

Die halbe Stunde, die sich am meisten lohnt

Nimm die eine Automatisierung, die bei euch am häufigsten läuft, und schau in der Abrechnung nach, was sie im letzten Monat gekostet hat. Dann lass zwanzig echte Vorgänge vom neuen Modell bearbeiten und vergleiche die Ergebnisse mit den alten. Wenn die Qualität passt, rechne die Ersparnis hoch. Bei einer Automatisierung, die täglich läuft, sind 30 Prozent kein Rundungsfehler mehr, sondern eine Position, die du im Jahresabschluss siehst.

Was ich
daraus mitnehme.

Der eigentliche Fortschritt steckt nicht in den zwei Punkten Abstand, sondern in der Begründung für die Ersparnis. Das Modell wird nicht billiger verkauft, es arbeitet effizienter: weniger Umwege, weniger Werkzeugaufrufe, weniger Token für dasselbe Ergebnis.

Und für die Praxis heißt das etwas Unbequemes: Die Empfehlung von letzter Woche ist heute schon wieder eine Stufe zu teuer. Wer Automatisierungen betreibt, sollte sich einmal im Quartal einen Termin setzen, um die Modellwahl zu prüfen. Das ist langweilig, aber es ist das Gegenteil von Hinterherlaufen.

Merken für die Praxis

Sonnet 5.5 erreicht bei Wissensarbeit 1844 Punkte gegenüber 1846 beim doppelt so teuren Opus 5.5, bei Aufgaben auf der Kommandozeile liegt es mit 70,6 zu 66,4 Prozent sogar davor.
Die Preise bleiben unverändert bei 2 Dollar Eingabe und 10 Dollar Ausgabe je Million Token.
Die Ersparnis von bis zu 30 Prozent je Aufgabe entsteht durch weniger Token und weniger Werkzeugaufrufe, nicht durch einen niedrigeren Tarif.
Vor dem Umstellen zwanzig echte Fälle mit altem und neuem Modell vergleichen. Alle Angaben stammen bislang vom Hersteller und von Anwendern.

Quellen: Ankündigung von Anthropic vom 28.09.2026 über den Kanal @claudeai (mehr als 30 Prozent schneller, bis zu 30 Prozent geringere Kosten für die meiste Arbeit) sowie VentureBeat (Preise von 2 und 10 US-Dollar je Million Token sowie 0,20 und 2,50 US-Dollar für zwischengespeicherte Inhalte, Opus 5.5 zum Vergleich bei 4 und 20 US-Dollar; GDPval-AA 1844 gegenüber 1846 und 1449; Terminal-Bench 4.0 mit 70,6 gegenüber 66,4 und 10,3 Prozent; OSWorld 2.1 mit 80,1 gegenüber 81,8 Prozent; Kostensenkung durch weniger Token und weniger Werkzeugaufrufe; Anwenderangaben von Box, Zendesk, Slack und Base44; Verfügbarkeit über Anthropic, AWS, Google Cloud und Azure; automatische Weiterleitung risikoreicher Anfragen aus der Cybersicherheit an Sonnet 5). Sämtliche Leistungs- und Kostenangaben stammen vom Hersteller beziehungsweise von Anwendern, unabhängige Vergleiche liegen noch nicht vor. Stand: 28.09.2026.

Gratis-Online-Guide

Der KI-Werkzeugkasten 2026

Welches Modell für welche Aufgabe, welche Tools wirklich zählen und wie du richtig promptest — komplett lesbar, kein Download.

Jetzt gratis lesen →
Kein Spam · Double-Opt-In · Abmeldung jederzeit
✓ Eingetragen — bitte bestätige noch die Mail in deinem Postfach.
Zum KI-Werkzeugkasten →

Zahlt ihr noch
für das große Modell?

Wir schauen uns an, welche eurer Abläufe über die Schnittstelle laufen, welches Modell dort arbeitet und was ein Wechsel im Monat bringt. Mit zwanzig echten Fällen als Vergleich, nicht mit Benchmark-Tabellen.

Kennenlernen →