Wir stellen GPT‑6.1 Sol vor, ein Upgrade von GPT‑6 Sol, das bei agentischem Codieren, Computernutzung und professioneller Arbeit fast die Intelligenz von GPT‑6 Astra erreicht – zu einem Fünftel der Standardpreise für Ein- und Ausgabe-Token von Astra. Die Kosten für zwischengespeicherte Eingaben betragen nur 0,10 $ pro Million Token – 95 % weniger als der Standard-Eingabepreis und 50 % weniger als der Preis für zwischengespeicherte Eingaben von GPT‑6 Sol – und geben Entwicklern mehr Spielraum, um leistungsfähige Agenten zu erstellen und auszuführen, die Kontext über Anfragen hinweg wiederverwenden.
GPT‑6.1 Sol bietet eine neue Balance aus Leistungsfähigkeit und Kosten für wichtige alltägliche Arbeit. Es liefert erhebliche Verbesserungen gegenüber GPT‑6 Sol bei komplexen professionellen Aufgaben, vom Schreiben und Debuggen von Code über das Verstehen von Dokumenten bis hin zur Ausführung mehrstufiger Geschäftsworkflows. Bei mehreren dieser Bewertungen nähert es sich der Leistung von GPT‑6 Astra zu erheblich geringeren Kosten an.
Bei Deep SWE v1.1 erreicht GPT‑6.1 Sol GPT‑6 Astra zu etwa einem Fünftel der Kosten, während es die beste Punktzahl von GPT‑6 Sol um 6,4 Prozentpunkte übertrifft. Bei GDP.pdf erzielt es eine höhere Punktzahl als Opus 5.5 mit Fallbacks zu weniger als der Hälfte der Kosten pro Aufgabe. Bei Automation Bench erzielt es 2,2 Prozentpunkte über Opus 5.5 bei mittlerem Denkaufwand zu etwa einem Drittel der Kosten.
GPT‑6.1 Sol macht auch erhebliche Fortschritte bei Computernutzung und wissenschaftlicher Forschung. Beim Offline-Set von OSWorld 2.0 übertrifft es GPT‑6 Sol um sieben Prozentpunkte zu weniger als der Hälfte der Kosten. Bei Terminal-Bench Science 0.1 verdoppelt es die Punktzahl von GPT‑6 Sol mehr als zu weniger als der Hälfte der Kosten pro Aufgabe. Es verbessert auch die faktische Genauigkeit und reduziert Fehler von 11,4 % auf 7,7 % bei geringem Denkaufwand.