OpenAI menggambarkan GPT-5 sebagai model paling cerdas dan paling andal hingga saat ini, yang menggabungkan terobosan riset perusahaan ke dalam pengalaman ChatGPT yang terpadu dan siap digunakan sejak hari pertama, tanpa perlu memilih model. Perusahaan menyatakan bahwa model ini menandai lompatan besar bagi AI di lingkungan perusahaan, mengubah ChatGPT dari asisten menjadi pakar tepercaya setingkat PhD bagi setiap karyawan.
Menurut artikel tersebut, GPT-5 mencatat hasil terbaru di bidang matematika (99,6% pada AIME 2025 dengan alat bantu), pengodean dunia nyata (74,9% pada SWEBench), dan pemahaman multimodal (84,2% pada MMMU). Dilaporkan pula bahwa model ini 45% lebih kecil kemungkinannya mengandung kesalahan faktual dibandingkan GPT-4o, serta menghasilkan jawaban dengan 50-80% lebih sedikit token keluaran dibandingkan o3. Jawaban juga dapat memanfaatkan pengetahuan dan aplikasi milik perusahaan untuk hasil yang lebih berkualitas.
Penerapan awal dikutip sebagai bukti. Elena Alfaro, Kepala Adopsi AI Global di BBVA, mengatakan model ini membantu menyelesaikan tugas strategis yang biasanya memakan waktu dua hingga tiga minggu hanya dalam beberapa jam, serta menangani bahasa Spanyol dengan lebih akurat sambil bekerja dua kali lebih cepat. Seemantini Godbole, CIO Lowe's, menyebut model ini memberikan keseimbangan antara penalaran dan responsivitas untuk perencanaan, analisis, dan alur kerja multi-langkah. Gene Rapoport, Partner dan Co-Head Praktik AI Private Equity di Bain, mengatakan model ini membantu tim mencapai wawasan yang lebih tajam dengan lebih cepat.
OpenAI menekankan kesiapan untuk perusahaan, termasuk enkripsi saat disimpan dan saat ditransmisikan, SAML SSO, provisioning SCIM, kontrol akses berbasis peran, serta kepatuhan terhadap GDPR, CCPA, SOC 2 Type 2, dan CSA STAR. Perusahaan menyatakan bahwa data pelanggan secara default tidak digunakan untuk pelatihan dan lokasi penyimpanan data tersedia di tujuh wilayah global. Artikel ini merekomendasikan agar bisnis mengevaluasi GPT-5 dengan menjalankan tugas nyata, seperti menyusun teks hukum, membuat analisis pasar, atau men-debug kode, lalu membandingkan kualitas keluaran dan waktu yang dihemat dengan standar manusia.
Sumber: OpenAI Blog · Diringkas oleh HeadlinesBriefing