Anthropic发布第二份风险报告:Claude已编写生产代码库大部分代码,内部Model 2能力小幅提升
Anthropic发布第二份风险报告:Claude已编写生产代码库大部分代码,内部Model 2能力小幅提升
8月17日,Anthropic发布第二份负责任扩展风险报告,披露Claude目前已编写公司生产代码库中大部分被合并的代码,AI显著加速内部研发。同时披露未发布的内部Model 2,能力略强于Mythos 5但提升幅度有限。
核心信息
2026年8月17日,Anthropic依据其《负责任扩展政策》发布第二份风险报告,详细披露了公司AI系统的风险状况及应对准备情况。报告中最引人注目的信息是:Claude目前已编写了Anthropic自身生产代码库中大部分被合并的代码,AI正在显著加速公司内部的研究和工程工作。与此同时,Anthropic也坦诚其旧有的基于任务的评估体系开始出现饱和迹象,需要新的评估方法。
关键要点
- AI自研代码:Claude已编写Anthropic生产代码库中大部分被合并的代码,AI成为公司内部研发的核心生产力
- 内部Model 2披露:未发布的内部模型"Model 2"能力略强于Mythos 5,在多项内部任务上有明显改进,但提升幅度小于从Claude到Opus的跨越
- 评估体系饱和:传统基于任务的评估方法开始饱和,需要开发新的评估范式来衡量模型能力
- 风险透明化:Anthropic持续定期发布风险报告,展现对AI安全的负责任态度
- 人才动向:OpenAI早期GPU优化工程师Scott Gray在任职近10年后离职
这份报告标志着AI公司正在进入"AI造AI"的新阶段——大模型不仅服务外部客户,也深度参与自身产品的研发迭代。Anthropic在报告中保持了其一贯的谨慎风格,既展示技术进展,也坦诚面临的评估挑战,为整个行业树立了安全透明的标杆。