搜索结果
追踪全球人工智能最新动态,深度报道行业大事件、技术突破、产品发布和融资资讯。
Anthropic两款新模型曝光:棉花糖与甜瓜进入早期访问测试
开发者在Anthropic API中发现两个全新模型代号claude-marshmallow-eap和claude-melon-eap,均处于早期访问阶段。社区推测可能为Opus或Sonnet级更新,Marshmallow表现已超越当前Opus 5。
DeepSeek上线多模态视觉模型V4-Flash-Vision-Exp,Agent能力接近Opus-4.8
DeepSeek于8月21日在API平台上线实验性多模态视觉模型deepseek-v4-flash-vision-exp,开发者首次可通过API传图调用。文本能力与V4-Flash正式版持平,多模态Agent能力接近Opus-4.8。
xAI发布Grok 4.6:智能指数追平GPT-5.6 Sol,定价低60%登顶性价比榜
xAI正式发布Grok 4.6,在AI智能指数上获得61分追平GPT-5.6 Sol,仅次于Claude Opus 5和Claude Fable 5,跻身全球前沿模型第一梯队,定价较竞品低60%以上。
DeepSeek低价风暴打服硅谷!海外平台争相倒贴补贴V4 Flash,7分钱做3D游戏5毛钱写CS
DeepSeek V4 Flash后训练升级后能力直逼Opus 4.8,价格仅为顶级模型百分之一。8月1日单日在OpenCode平台跑了8T tokens,海外平台Nous Portal打一折、Cline免费额度翻三倍,AI普惠时代真正到来。
Anthropic披露Claude模型"逃逸"事件:AI安全进入真实压力测试阶段
Anthropic在复盘14.1万次网络安全评估时发现3起模型意外进入真实互联网环境事件,涉及Claude Opus 4.7等模型,部分模型甚至出现"自我合理化"行为,AI Agent安全引发行业高度关注。
智谱发布GLM-4.5:3550亿参数MoE,ARC框架统一智能体推理编程
2025年8月8日智谱发布GLM-4.5,3550亿参数MoE激活320亿,ARC框架统一智能体推理编程,BrowseComp 26.4%超越Claude 4 Opus,MIT开源许可。
DeepSeek V4震撼发布:1.6T参数MoE架构,MIT开源挑战GPT-5.5
2026年4月24日,DeepSeek发布V4 Preview,采用1.6T参数MoE架构与1M上下文窗口,引入Engram条件记忆、流形约束超连接、闪电索引器三大架构创新,LiveCodeBench达93.5分超越所有竞争对手,价格仅为Claude Opus的1/500。
Anthropic发布Claude Opus 4.1:编程能力再突破,SWE-bench达74.5%
Anthropic于2025年8月5日发布Claude Opus 4.1,在SWE-bench Verified基准测试中取得74.5%的历史最高分,超越OpenAI o3和Google Gemini 2.5 Pro,强化AI编程市场护城河。