Stellen Sie sich ein Büro mit zwei erfahrenen Leuten vor. Die eine ist die Partnerin, die man in die Besprechung holt, wenn der Fall ungewöhnlich ist und viel auf dem Spiel steht. Der andere ist der Kollege, der den Stapel der Woche abarbeitet – vierzig E-Mails, drei Tabellen, eine Präsentation für Donnerstag – schnell und sauber.
Die meisten von uns brauchen die zweite Person viel öfter als die erste. Claude Sonnet 5.5 ist dieser Kollege.
Anthropic hat es am 28. September 2026 veröffentlicht, eine Woche nach Claude Opus 5.5, als zweites Modell der Claude-5.5-Familie. Es ist als alltägliche Ergänzung zu Opus gedacht. In Anthropics Worten: Opus ist für komplexe Arbeit gebaut, die sorgfältiges Urteilsvermögen verlangt, während Sonnet 5.5 bei klar umrissenen Alltagsaufgaben, beim Beheben von Fehlern und beim Erstellen ausgefeilter Dokumente, Folien und Tabellen am stärksten ist.
Wie nah ist es an Opus?
Näher, als man erwarten würde – zumindest in den unabhängigen Tests.
Artificial Analysis betreibt zwei Tests, die sich um fertige berufliche Arbeit drehen statt um Quizfragen. Bei GDPval-AA v2.1 liefern Modelle echte Arbeitsergebnisse, etwa ein Finanzmodell, ein juristisches Memo oder ein Briefing, und die Ergebnisse werden direkt gegeneinander verglichen, wie Schachpartien. Sonnet 5.5 erreichte 1844 Elo. Opus 5.5 kam auf 1846 – ein Abstand, der keine Rolle spielt. Beim neueren AA-Briefcase, der längere, mehrstufige Wissensarbeit prüft, erreichte es 1811 gegenüber 1822 für Opus.
Das breiteste unabhängige Maß ist der Intelligence Index von Artificial Analysis, ein Gesamtwert aus anspruchsvollen Tests. Auf der Stufe max erreichte Sonnet 5.5 56 Punkte, nur Opus 5.5 lag mit 58 davor.
Für ein Sonnet-Modell ist das ein gewaltiger Schritt. Sein Vorgänger Sonnet 5 kam bei GDPval-AA auf 1449. Praktisch heißt das: Büroarbeit, für die man bisher das Spitzenmodell brauchte, kann jetzt an das günstigere, schnellere Modell gehen.
Wo Opus weiterhin vorn liegt
An zwei Stellen ist der Abstand echt.
Fakten. Der Test AA-Omniscience von Artificial Analysis stellt Tausende Faktenfragen. Sonnet 5.5 beantwortete 54 % richtig, Opus 5.5 66 %. Ein kleineres Modell hat schlicht weniger Wissen gespeichert. Es gibt aber einen Lichtblick: Wenn Sonnet 5.5 eine Antwort nicht wusste, erfand es in 47 % der Fälle eine, Opus 5.5 in 59 %. Es weiß weniger, gibt das aber eher zu. Für ein entlegenes Datum, einen Namen oder eine Statistik sollten Sie es trotzdem bitten, im Web zu suchen oder eine Quelle zu nennen.
Urteilsvermögen. Hier ist Anthropic ungewöhnlich direkt. In mehreren Tests schneidet Sonnet 5.5 auf der Stufe max vergleichbar mit Opus 5.5 ab. Doch in Anthropics eigenen Tests und denen externer Tester bleibt Opus 5.5 bei komplexer, offener Arbeit klar stärker, wenn anhaltendes Urteilsvermögen gefragt ist. Hat eine Frage keinen offensichtlichen Rahmen – eine Strategieentscheidung, ein Vertrag mit ungewöhnlichen Klauseln –, ist das weiterhin ein Fall für Opus.
Was es gut kann
Anthropic hebt Dokumente, Zusammenfassungen, Tabellen und Folien hervor und bescheinigt dem Modell ein gutes Auge für Design: Es kann einer Folienvorlage so genau folgen, dass kaum Nacharbeit nötig ist. Beim Lesen von Diagrammen hat es sich enorm verbessert. In Anthropics Test Chartography, bei dem Modelle ohne Hilfsmittel Werte aus Diagrammen ablesen, erreichte es 61,6 % – Sonnet 5 kam auf 15,6 %.
Es ist außerdem schnell. Laut Anthropic kommt die Ausgabe über 30 % schneller als bei Sonnet 5, und frühe Tester haben das bemerkt: Zendesk berichtet, dass Support-Tickets 20 % schneller bearbeitet wurden, und Box maß die 2,4-fache Geschwindigkeit der Vorgängerversion.
Auch einen Computer kann es bedienen. Bei OSWorld 2.1, wo sich ein Modell per Klicken und Tippen durch echte Desktop-Programme arbeitet, meldet Anthropic 80,1 % mit Teilpunktewertung – nah an den 81,8 % von Opus 5.5.
Den Regler in der Mitte lassen
Sonnet 5.5 hat fünf Aufwandsstufen: low, medium, high, xhigh und max. Die Claude-Apps verwenden standardmäßig medium. Das hat Artificial Analysis auf jeder Stufe gemessen:
| Aufwand | Intelligence Index | Kosten pro Aufgabe |
|---|---|---|
| Low | 36 | 0,41 $ |
| Medium | 41 | 0,59 $ |
| High | 47 | 1,08 $ |
| Xhigh | 52 | 2,74 $ |
| Max | 56 | 7,60 $ |
Der letzte Schritt ist der teure. Auf max schrieb Sonnet 5.5 etwa 193.000 Ausgabe-Token pro Aufgabe – der höchste Wert, den Artificial Analysis je gemessen hat, und rund 60 % mehr als Opus 5.5 auf max. Für die meisten Menschen in der Claude-App bedeutet das schlicht längeres Warten. Für Entwickler, die pro Token bezahlen, heißt es: Ein voll aufgedrehtes Sonnet ist nicht mehr die günstige Option. Braucht eine Aufgabe so viel Nachdenken, verdient sie meist Opus.
Der ehrliche Haken
Keine Bilder. Claude liest Screenshots, Diagramme und eingescannte PDFs gut, erzeugt aber weder Bilder noch Audio oder Video. Wer eine App möchte, die auch zeichnet und spricht, ist mit ChatGPT oder Gemini breiter aufgestellt.
Preis pro Token ist nicht Preis pro Aufgabe. Die Token kosten so viel wie bei Sonnet 5: 2 US-Dollar pro Million Eingabe- und 10 US-Dollar pro Million Ausgabe-Token. Laut Anthropic kosten typische Aufgaben bis zu 30 % weniger, weil das Modell mit weniger Schritten auskommt. Das gilt bei normalen Einstellungen; auf max steigt die Rechnung, wie die Tabelle zeigt, schnell an.
Manche Anfragen sind abgesichert. Sonnet 5.5 ist das erste Sonnet-Modell mit den strengeren Cybersicherheits-Schutzmechanismen, die Anthropic bei seinen Spitzenmodellen einsetzt. Riskantere Sicherheitsanfragen fallen sichtbar auf Sonnet 5 zurück. Für fast alle spielt das nie eine Rolle.
Für wen es sich eignet
| Wenn Ihr Tag so aussieht … | Nehmen Sie | Warum |
|---|---|---|
| E-Mails, Zusammenfassungen, Tabellen, Präsentationen | Claude Sonnet 5.5 | Büroarbeit fast auf Opus-Niveau, schnell, im kostenlosen Tarif |
| Folgenreiche Urteile, entlegene Fakten, verzwickte Recherche | Claude Opus 5.5 | Mehr Wissen und klar stärkeres Urteilsvermögen |
| „Bediene diese Software auf meinem Computer und erledige die Aufgabe“ | GPT-6 Astra | Stärkerer, sparsamerer Agent für die Computerbedienung |
| Eine App für Chat, Bilder und Sprache | ChatGPT oder Gemini | Breiterer kreativer Werkzeugkasten |
Das Fazit für den Alltag
Claude Sonnet 5.5 wird Opus bei den schwierigsten Fragen nicht ersetzen, und Anthropic behauptet das auch nicht. Aber die schwierigsten Fragen machen nur einen kleinen Teil der meisten Wochen aus. Für alles andere ist es schnell, fähig, im kostenlosen Claude-Tarif verfügbar und so bepreist, dass man nicht darüber nachdenken muss. Lassen Sie es auf der Standardeinstellung, prüfen Sie entlegene Fakten – und holen Sie Opus dazu, wenn viel auf dem Spiel steht.