Stellen Sie sich eine gute Anwaltskanzlei vor. Der Senior Partner ist brillant und stellt seine Rechnung entsprechend aus. Sie würden ihn niemals bitten, zweihundert Seiten Lieferantenverträge auf der Suche nach der Kündigungsklausel durchzusehen. Sie geben das einem vertrauenswürdigen Senior Associate, jemandem, der fast genauso scharfsinnig und viel günstiger ist.
GPT-6.1 Sol ist dieser Senior Associate. Es ist nicht das leistungsstärkste Modell von OpenAI, aber es ist nah dran, und es ist dasjenige, dessen Einsatz Sie sich für den Großteil der wöchentlichen Arbeit leisten können.
Was es ist und wo Sie es finden
OpenAI veröffentlichte GPT-6.1 Sol am 29. September 2026 auf seinem DevDay-Event, eine Woche nach GPT-6 Sol. OpenAI beschreibt es als eine Intelligenz nahe an Astra für Programmierung, Computernutzung und professionelle Arbeit, zu einem Fünftel des Preises seines Flaggschiffs GPT-6 Astra.
Wo Sie es nutzen können, ist für die meisten Leser entscheidend. In ChatGPT befindet sich GPT-6.1 Sol in ChatGPT Work und Codex, den Teilen der App, die für längere Aufgaben, Dateien und Agenten entwickelt wurden. Es ist in den Tarifen Plus, Pro, Business, Enterprise und Edu verfügbar. Es ist noch nicht im regulären Chat zu finden und auch nicht im kostenlosen Tarif enthalten. Entwickler können es über die API als gpt-6.1-sol nutzen, und Programmiertools wie Devin von Cognition haben es am Tag der Veröffentlichung integriert.
Wie nah am Flaggschiff?
Artificial Analysis, ein unabhängiges Testunternehmen, führte seine Benchmarks am Tag der Veröffentlichung durch. Sein Intelligence Index kombiniert zehn anspruchsvolle Auswertungen, von Büroarbeit und Geschäftsautomatisierung bis hin zu wissenschaftlicher Programmierung und Faktenwissen. GPT-6.1 Sol erreichte 52 Punkte. GPT-6 Astra erzielte 53, und das GPT-6 Sol der Vorwoche kam auf 48. Damit belegt GPT-6.1 Sol Platz 10 der 222 Modelle auf der Rangliste.
Betrachten wir nun den Preis. Artificial Analysis berechnete etwa 0,72 $, um eine Aufgabe seines Index mit GPT-6.1 Sol auszuführen, im Vergleich zu 3,26 $ für Astra. Das ist ein Punkt weniger Leistungsfähigkeit für weniger als ein Viertel der Kosten.
Der Fairness halber führt Anthropic diesen Index weiterhin an. Claude Opus 5.5 erreichte 58 Punkte und Claude Sonnet 5.5 erzielte 56. Diese Ergebnisse kosten jedoch deutlich mehr: 5,98 $ und 7,60 $ pro Aufgabe.
Worin es im Arbeitsalltag gut ist
Die Einführungstests von OpenAI konzentrieren sich auf die Art von Arbeit, die eine Bürowoche füllt. Denken Sie daran, dass dies die eigenen Zahlen von OpenAI sind.
- Lesen schwieriger PDFs. Bei GDP.pdf beantwortet das Modell Fragen zu echten Dokumenten aus den Bereichen Finanzen, Recht, Gesundheitswesen und sieben weiteren Bereichen, mit dichten Tabellen, Diagrammen und Kleingedrucktem. Die OpenAI-Tabelle zeigt 32,0 % bei hohem Aufwand (High Effort) für 0,35 $ pro Aufgabe. Der Bestwert von Claude Opus 5.5 liegt bei 28,8 % für 0,83 $ und der von GPT-6 Astra bei 32,2 % für 1,91 $. Sol erreicht also fast das Flaggschiff zu einem Fünftel des Preises.
- Mehrstufige Routineaufgaben. Bei AutomationBench schließt ein Agent End-to-End-Workflows über 47 Business-Tools ab, wie z. B. die Aktualisierung eines CRM, das Einreichen eines Tickets und das Senden einer Follow-up-E-Mail. Bei mittlerem Aufwand erzielt GPT-6.1 Sol 31,7 % für 0,19 $ pro Aufgabe, 2,2 Punkte vor Claude Opus 5.5 bei derselben Einstellung. Lesen Sie jedoch die gesamte Tabelle: Bei maximalem Aufwand erreicht Opus 5.5 42,5 % und Astra 41,4 %, während Sol bei 36,1 % seinen Höhepunkt erreicht. Sol gewinnt bei Routineaufgaben pro Dollar; die teureren Modelle erledigen bei den schwierigsten Aufgaben immer noch mehr.
- Einen Computer bedienen. Bei OSWorld 2.0 klickt und tippt sich das Modell durch echte Desktop-Apps. OpenAI meldet 71,4 % für 1,27 $ pro Aufgabe, gegenüber 73,5 % für Astra zu 9,44 $.
Weniger erfundene Fakten, aber nicht null
OpenAI testete die sachliche Genauigkeit anhand bewusst schwerer Fragen aus echten Gesprächen, in denen Nutzer den Fehler eines früheren Modells markiert hatten. Bei niedrigem Aufwand sank der Anteil der Antworten mit einem sachlichen Fehler von 11,4 % auf 7,7 % im Vergleich zu GPT-6 Sol, was etwa einem Drittel weniger entspricht.
Der unabhängige Wissenstest von Artificial Analysis liefert ein nüchterneres Bild. Wenn GPT-6.1 Sol eine Antwort nicht kennt, erfindet es sie immer noch in 54 % der Fälle. Das ist besser als die 60 % von GPT-6 Sol, aber schlechter als die 47 % von Claude Sonnet 5.5. Der praktische Ratschlag ändert sich nicht: Bitten Sie das Modell bei einem obskuren Namen, einem Datum oder einer Zahl, das Web zu durchsuchen oder eine Quelle zu zitieren.
Ein Wort zum Astra, das nicht ausgeliefert wurde
GPT-6.1 Sol war nicht das einzige Modell, das OpenAI für den DevDay geplant hatte. Am Tag zuvor sagte das Unternehmen GPT-6.1 Astra ab, nachdem interne Tests ergeben hatten, dass das Modell nicht zuverlässig innerhalb des Umfangs und der Berechtigungen seiner Aufgaben blieb. GPT-6.1 Sol ist ein separates Modell mit seinem eigenen Sicherheitsbericht. In einem der OpenAI-Tests ist das Suchwerkzeug eines Agenten unbemerkt defekt, und das Modell sollte dies mitteilen, anstatt zu raten. GPT-6.1 Sol versäumte es in 2,1 % der Fälle, das Problem offenzulegen, gegenüber 4,9 % bei GPT-6 Sol und 1,5 % bei GPT-6 Astra. Das ist eine echte Verbesserung, wenn auch keine Garantie für jede Situation.
Der ehrliche Haken
Es befindet sich hinter einer Bezahlschranke und einem eigenen Tab. Für ein Modell, das auf den Arbeitsalltag ausgerichtet ist, ist die größte Einschränkung schlichtweg der Zugang: Es gibt keinen kostenlosen Tarif und keinen regulären Chat, nur ChatGPT Work und Codex in kostenpflichtigen Tarifen.
Es liest Bilder, aber zeichnet nicht. GPT-6.1 Sol nimmt Text und Bilder als Eingabe an und schreibt Text zurück. Es generiert selbst keine Bilder, Audios oder Videos.
Claude liegt auf dem breiten Index weiterhin vorn. Wenn Sie unabhängig von den Kosten die höchsten unabhängigen Bewertungen wünschen, liegen Claude Opus 5.5 und Sonnet 5.5 vorn. Der Vorteil von GPT-6.1 Sol besteht darin, dass es für viel weniger Geld fast genauso gut abschneidet.
Wer sollte es nutzen
| Wenn Ihr Tag so aussieht… | Greifen Sie zu | Warum |
|---|---|---|
| Verträge, Berichte und PDFs in ChatGPT Work | GPT-6.1 Sol | Dokumentenarbeit auf nahezu Astra-Niveau zu einem Bruchteil der Kosten |
| Die anspruchsvollsten Recherche- und Computeraufgaben | GPT-6 Astra | OpenAIs stärkstes Modell, ein oder zwei Punkte voraus |
| Hochriskante Urteilsfindung, obskure Fakten | Claude Opus 5.5 | Spitzenreiter auf dem breiten unabhängigen Index |
| Arbeitsalltag mit einem kostenlosen Tarif | Claude Sonnet 5.5 oder Gemini | Starke Modelle ohne Abonnement |
Das Alltags-Fazit
GPT-6.1 Sol wird Sie nicht dadurch beeindrucken, das intelligenteste Modell auf der Rangliste zu sein. Es beeindruckt dadurch, fast genauso intelligent wie das Flaggschiff von OpenAI zu sein, jedoch zu einem Bruchteil der Kosten. Wenn Sie bereits für ChatGPT bezahlen und Ihren Tag in Work verbringen, ist die Festlegung als Standardmodell die einfache Wahl. Überprüfen Sie obskure Fakten und wechseln Sie nur zu Astra, wenn eine Aufgabe diese letzten paar Punkte wirklich benötigt.