Kami memperkenalkan GPT‑6.1 Sol, peningkatan dari GPT‑6 Sol yang hampir menyamai kecerdasan GPT‑6 Astra dalam pengkodean agen, penggunaan komputer, dan pekerjaan profesional dengan seperlima harga token input dan output standar Astra. Biaya input cache hanya $0,10 per juta token—95% lebih murah dari harga input standar dan 50% lebih murah dari harga input cache GPT‑6 Sol—memberi pengembang lebih banyak ruang untuk membangun dan menjalankan agen yang mampu menggunakan ulang konteks antar permintaan.
GPT‑6.1 Sol menawarkan keseimbangan baru antara kemampuan dan biaya untuk pekerjaan sehari-hari yang penting. Ini memberikan peningkatan substansial dibandingkan GPT‑6 Sol dalam tugas profesional yang kompleks, dari menulis dan men-debug kode hingga memahami dokumen dan menjalankan alur kerja bisnis multi-langkah. Dalam beberapa evaluasi ini, ia mendekati kinerja GPT‑6 Astra dengan biaya yang jauh lebih rendah.
Pada Deep SWE v1.1, GPT‑6.1 Sol menyamai GPT‑6 Astra dengan sekitar seperlima biaya, sambil melampaui skor terbaik GPT‑6 Sol sebesar 6,4 poin persentase. Pada GDP.pdf, ia mencetak lebih tinggi dari Opus 5.5 dengan fallback dengan biaya kurang dari setengah per tugas. Pada Automation Bench, ia mencetak 2,2 poin persentase di atas Opus 5.5 dengan upaya penalaran sedang, dengan sekitar sepertiga biaya.
GPT‑6.1 Sol juga membuat kemajuan substansial dalam penggunaan komputer dan penelitian ilmiah. Pada set offline OSWorld 2.0, ia mengungguli GPT‑6 Sol sebesar tujuh poin persentase dengan biaya kurang dari setengah. Pada Terminal-Bench Science 0.1, ia lebih dari menggandakan skor GPT‑6 Sol dengan biaya kurang dari setengah per tugas. Ia juga meningkatkan akurasi faktual, mengurangi kesalahan dari 11,4% menjadi 7,7% dengan upaya penalaran rendah.