OpenAI多智能体V2全量上线:741轮对话1秒打开,自动调度模型告别手动选择
OpenAI多智能体V2全量上线:741轮对话1秒打开,自动调度模型告别手动选择
8月16日,OpenAI正式宣布多智能体v2(Multi-Agent v2)全面上线,主Agent可自动将子任务委派给不同模型,每个子Agent独立设置推理强度。同步推出ChatGPT前端性能大升级,741轮231MB怪物对话加载时间从27.62秒降至1.66秒。
8月16日,OpenAI工程师Eric Provencher正式宣布多智能体v2(Multi-Agent v2)全面上线,同时ChatGPT迎来一次史诗级前端性能优化,双管齐下让用户告别等待与选择。
多智能体v2:智能分工自动调度
多智能体v2的核心升级在于智能分工机制。主Agent现在可以自动将不同子任务委派给最合适的模型,每个子Agent支持独立设置推理强度,用户无需再手动选择模型。OpenAI总裁Greg Brockman表示,这标志着"朝着告别手动选模型方向前进"。
目前ChatGPT/Codex可用模型矩阵包括:
- GPT-5.6 Sol:最强模型,负责复杂的Agentic编码任务
- GPT-5.6 Terra:日常编程主力,均衡性能与成本
- GPT-5.6 Luna:最快最便宜,适合高频简单任务
- Daybreak:网络安全专用模型
- GPT-5.5:复杂编程、研究、通用任务
复杂任务中仅约20%步骤需要最强模型Sol处理,其余80%可交给Terra或Luna等便宜模型,大幅降低推理成本的同时加速ChatGPT从聊天工具向工作流平台转变。此前三周Luna因v1/v2兼容性问题无法被主Agent调度,开发者在GitHub上开了至少两个issue呼吁"把Luna还给我们",此次全量上线彻底解决了这一问题。
ChatGPT前端性能狂飙
Codex负责人Andrew Ambrosino晒出的内部测试数据令人震惊——针对一个741轮、231MB的"怪物级"对话,优化前后对比:
| 指标 | 优化前 | 优化后 | 提升幅度 |
|---|---|---|---|
| 对话加载时间 | 27.62秒 | 1.66秒 | 快16倍 |
| 应用加载速度 | 基准 | - | 飙升94% |
| 堆内存增长 | 1030.7 MiB | 606 MiB | 减少87.8% |
| 整体内存占用 | - | - | 砍掉41.2% |
| 网络请求数 | 894次 | 16次 | 暴降98.2% |
| 会话条目加载 | 15529条 | 64条 | 缩减99.6% |
优化的核心思路是惰性加载:ChatGPT不再因打开对话就加载并渲染全部历史记录,而是将大部分内容存储起来,只加载用户当下真正需要的部分。对于经常跑数百次工具调用的重度Codex开发者来说,界面明显变轻快,设备内存占用也大幅下降。
这波底层组合拳标志着大模型正加速从"聊天工具"向"全自动工作流平台"进化——用户只需把复杂任务丢过去,剩下的自动拆解、模型调度和极速渲染全部交给系统。Agent的极致丝滑时代正在到来。