搜索结果
追踪全球人工智能最新动态,深度报道行业大事件、技术突破、产品发布和融资资讯。
找到 5 条与 "Claude" 相关的资讯
Anthropic发布Claude 3.5 Sonnet升级版:新增computer use,SWE-bench跃升至49%
Anthropic发布Claude 3.5 Sonnet升级版:新增computer use,SWE-bench跃升至49%
2024年10月22日Anthropic发布Claude 3.5 Sonnet升级版,SWE-bench Verified从33%跃升至49%,新增computer use功能可操控电脑GUI,编程能力业界领先,价格不变。
智谱发布GLM-4.5:3550亿参数MoE,ARC框架统一智能体推理编程
智谱发布GLM-4.5:3550亿参数MoE,ARC框架统一智能体推理编程
2025年8月8日智谱发布GLM-4.5,3550亿参数MoE激活320亿,ARC框架统一智能体推理编程,BrowseComp 26.4%超越Claude 4 Opus,MIT开源许可。
Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1
Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1
2024年7月24日法国Mistral AI发布Large 2,123B参数性能媲美GPT-4o与Llama 3.1 405B,支持80+编程语言,原生函数调用能力超越Claude 3.5 Sonnet,MMLU达84%。
DeepSeek V4震撼发布:1.6T参数MoE架构,MIT开源挑战GPT-5.5
DeepSeek V4震撼发布:1.6T参数MoE架构,MIT开源挑战GPT-5.5
2026年4月24日,DeepSeek发布V4 Preview,采用1.6T参数MoE架构与1M上下文窗口,引入Engram条件记忆、流形约束超连接、闪电索引器三大架构创新,LiveCodeBench达93.5分超越所有竞争对手,价格仅为Claude Opus的1/500。
Anthropic发布Claude Opus 4.1:编程能力再突破,SWE-bench达74.5%
Anthropic发布Claude Opus 4.1:编程能力再突破,SWE-bench达74.5%
Anthropic于2025年8月5日发布Claude Opus 4.1,在SWE-bench Verified基准测试中取得74.5%的历史最高分,超越OpenAI o3和Google Gemini 2.5 Pro,强化AI编程市场护城河。