OpenAI beschreibt GPT-5 als bisher intelligentestes und zuverlässigstes Modell. Es vereint die Forschungsdurchbrüche des Unternehmens in einer einheitlichen ChatGPT-Erfahrung, die vom ersten Tag an einsatzbereit ist, ohne dass ein Modell ausgewählt werden muss. Das Unternehmen erklärt, das Modell markiere einen Sprung für KI in Unternehmen und verwandle ChatGPT von einem Assistenten in einen vertrauenswürdigen Experten auf PhD-Niveau für jeden Mitarbeitenden.
Laut dem Beitrag erzielt GPT-5 neue Spitzenergebnisse in Mathematik (99,6 % bei AIME 2025 mit Tools), praktischem Programmieren (74,9 % bei SWEBench) und multimodalem Verständnis (84,2 % bei MMMU). Außerdem soll es 45 % seltener einen sachlichen Fehler enthalten als GPT-4o und Antworten mit 50 bis 80 % weniger Ausgabe-Tokens als o3 erzeugen. Antworten können auf das eigene Wissen und die Anwendungen eines Unternehmens zurückgreifen, um qualitativ hochwertigere Ergebnisse zu liefern.
Frühe Einsätze dienen als Belege. Elena Alfaro, Leiterin der globalen KI-Adoption bei BBVA, sagte, das Modell habe eine strategische Aufgabe, für die sonst zwei bis drei Wochen nötig gewesen wären, in wenigen Stunden erledigen helfen. Außerdem habe es Spanisch genauer verarbeitet und doppelt so schnell gearbeitet. Seemantini Godbole, CIO bei Lowe's, erklärte, das Modell biete ein ausgewogenes Verhältnis von logischem Denken und Reaktionsgeschwindigkeit für Planung, Analyse und mehrstufige Arbeitsabläufe. Gene Rapoport, Partner und Mitleiter der KI-Praxis für Private Equity bei Bain, sagte, es helfe Teams, schneller zu präziseren Erkenntnissen zu gelangen.
OpenAI betont die Unternehmenstauglichkeit, darunter Verschlüsselung im Ruhezustand und bei der Übertragung, SAML SSO, SCIM-Provisionierung, rollenbasierte Zugriffskontrolle sowie die Einhaltung von DSGVO, CCPA, SOC 2 Typ 2 und CSA STAR. Kundendaten würden standardmäßig nicht zum Training verwendet, und die Datenhaltung sei in sieben globalen Regionen verfügbar. Der Beitrag empfiehlt Unternehmen, GPT-5 anhand realer Aufgaben zu bewerten, etwa beim Verfassen rechtlicher Texte, bei Marktanalysen oder beim Debugging von Code, und die Ausgabequalität sowie die eingesparte Zeit mit menschlichen Richtwerten zu vergleichen.
Quelle: OpenAI Blog · Zusammengefasst von HeadlinesBriefing