OpenAI表示,GPT-5是其迄今最智能、最可靠的模型,将其研究突破整合到统一的ChatGPT体验中,从第一天起即可使用,无需选择模型。该公司称,这一模型标志着企业AI的重大飞跃,使ChatGPT从助手演变为每位员工身边值得信赖的博士级专家。
根据该文章,GPT-5在多项任务上创下新的最先进成绩:数学(借助工具在AIME 2025上达到99.6%)、真实世界编程(SWEBench上达到74.9%)和多模态理解(MMMU上达到84.2%)。据报道,其出现事实性错误的可能性比GPT-4o低45%,生成答案所用的输出token比o3少50%至80%。回答还可以调用企业自身的知识和应用,以获得更高质量的结果。
早期部署案例为此提供了佐证。BBVA全球AI应用负责人Elena Alfaro表示,该模型帮助团队在几小时内完成了原本需要两到三周的战略性任务,并且在西班牙语处理上更加准确,速度快了一倍。Lowe's首席信息官Seemantini Godbole表示,该模型在规划、分析和多步骤工作流程方面兼顾了推理能力与响应速度。Bain私募股权AI业务的合伙人兼联席负责人Gene Rapoport表示,它帮助团队更快地获得更敏锐的洞察。
OpenAI强调了其企业级就绪能力,包括静态和传输中加密、SAML SSO、SCIM预配、基于角色的访问控制,以及GDPR、CCPA、SOC 2 Type 2和CSA STAR合规认证。该公司表示,默认情况下不会使用客户数据进行训练,并且可在全球七个地区提供数据驻留服务。文章建议企业通过运行真实任务来评估GPT-5,例如起草法律文本、撰写市场分析或调试代码,然后将输出质量和节省的时间与人工基准进行比较。
来源: OpenAI Blog · 由HeadlinesBriefing整理摘要