OpenAI GPT-5正式发布:多模态能力全面升级,推理能力提升3倍
OpenAI GPT-5正式发布:多模态能力全面升级,推理能力提升3倍
OpenAI于2025年8月7日正式发布GPT-5,采用统一系统架构(GPT-5-main + GPT-5-thinking + 实时路由器),在编码、多模态推理、指令遵循等方面大幅超越前代,向全体用户开放使用。
OpenAI 于 2025 年 8 月 7 日正式发布 GPT-5,这是继 2023 年 GPT-4 之后该公司最重要的一次模型升级。CEO Sam Altman 将其称为「通往 AGI 道路上的重要一步」,并表示与它交流如同与各领域的博士级专家对话。
统一系统架构
GPT-5 最大的突破在于采用了「统一系统」架构,由三个部分组成:
- GPT-5-main:快速高吞吐模型,处理简单查询和日常对话
- GPT-5-thinking:深度推理模型,支持链式思维(chain-of-thought)处理复杂问题
- 实时路由器:根据查询复杂度自动选择合适的模型
用户不再需要手动切换模型版本,路由器会智能判断何时需要「深度思考」。在 API 中,开发者可通过 reasoning_effort 参数控制思考时长,并可选择 gpt-5、gpt-5-mini、gpt-5-nano 三种规模。
多模态能力全面升级
GPT-5 在视觉、视频、空间及科学推理等多模态基准测试中表现优异。它能更准确地处理图片、图表和演示文稿等非文本输入,构建起更立体的信息交互体系。
编程能力质的飞跃
OpenAI 官方称 GPT-5 为「迄今为止最强大的编码模型」,尤其在复杂前端生成与大型代码库调试领域优势突出。早期测试显示,用户往往只需一次提示就能生成兼具美感的网站、应用和游戏。
GPT-5 Pro
面向最具挑战性任务的 GPT-5 Pro 凭借扩展推理能力,在 GPQA 测试中创下 88.4% 的无工具使用新纪录,替代原有的 o3-Pro,思考时间更长,提供研究级答案质量。
可用性
GPT-5 自发布日起向免费用户和付费用户逐步开放:Pro 订阅用户可无限访问并使用 GPT-5 Pro;Plus 用户可设为默认模型,使用限额高于免费用户。