AI 新闻资讯

追踪全球人工智能最新动态,深度报道行业大事件、技术突破、产品发布和融资资讯。

百度发布文心4.5 Turbo:多模态混合训练,价格降80%超越GPT-4o 百度发布文心4.5 Turbo:多模态混合训练,价格降80%超越GPT-4o

百度发布文心4.5 Turbo:多模态混合训练,价格降80%超越GPT-4o

2025年4月25日百度发布文心4.5 Turbo,多模态混合训练,MMMU超越GPT-4o,价格降80%,输入0.8元/百万tokens仅DeepSeek-V3的40%,复合思维链结合工具调用。

2026-07-31 24 阅读
Anthropic发布Claude 3.5 Sonnet升级版:新增computer use,SWE-bench跃升至49% Anthropic发布Claude 3.5 Sonnet升级版:新增computer use,SWE-bench跃升至49%

Anthropic发布Claude 3.5 Sonnet升级版:新增computer use,SWE-bench跃升至49%

2024年10月22日Anthropic发布Claude 3.5 Sonnet升级版,SWE-bench Verified从33%跃升至49%,新增computer use功能可操控电脑GUI,编程能力业界领先,价格不变。

2026-07-31 7 阅读
谷歌发布Gemini 2.0 Flash:为智能体时代而生,原生多模态输出图像音频 谷歌发布Gemini 2.0 Flash:为智能体时代而生,原生多模态输出图像音频

谷歌发布Gemini 2.0 Flash:为智能体时代而生,原生多模态输出图像音频

2024年12月11日谷歌发布Gemini 2.0 Flash,原生多模态输出图像和音频,速度为1.5 Pro两倍,支持100万tokens上下文,原生工具使用,为智能体时代设计。

2026-07-31 8 阅读
OpenAI发布o3-mini:ARC-AGI达87.5%,首个支持函数调用的推理模型 OpenAI发布o3-mini:ARC-AGI达87.5%,首个支持函数调用的推理模型

OpenAI发布o3-mini:ARC-AGI达87.5%,首个支持函数调用的推理模型

2025年1月31日OpenAI发布o3-mini推理模型,ARC-AGI基准87.5%远超前代,AIME 2025达88.9%,首个支持函数调用和结构化输出的o系列模型,首次向免费用户开放。

2026-07-31 7 阅读
智谱发布GLM-4.5:3550亿参数MoE,ARC框架统一智能体推理编程 智谱发布GLM-4.5:3550亿参数MoE,ARC框架统一智能体推理编程

智谱发布GLM-4.5:3550亿参数MoE,ARC框架统一智能体推理编程

2025年8月8日智谱发布GLM-4.5,3550亿参数MoE激活320亿,ARC框架统一智能体推理编程,BrowseComp 26.4%超越Claude 4 Opus,MIT开源许可。

2026-07-31 6 阅读
月之暗面Kimi K2发布:1万亿参数MoE,SWE-bench 72.5%登顶开源编程王 月之暗面Kimi K2发布:1万亿参数MoE,SWE-bench 72.5%登顶开源编程王

月之暗面Kimi K2发布:1万亿参数MoE,SWE-bench 72.5%登顶开源编程王

2025年7月11日月之暗面发布Kimi K2,1T参数MoE架构激活32B,SWE-bench Verified达72.5%创开源SOTA,MuonClip优化器15.5T token训练零崩溃,Apache 2.0开源。

2026-07-31 6 阅读
阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源 阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源

阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源

2025年4月29日阿里开源Qwen3系列,旗舰235B-A22B以三分之一参数量性能超越DeepSeek-R1,AIME25达81.5分刷新开源纪录,原生支持MCP协议,部署成本仅为同类三分之一。

2026-07-31 6 阅读
Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1 Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1

Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1

2024年7月24日法国Mistral AI发布Large 2,123B参数性能媲美GPT-4o与Llama 3.1 405B,支持80+编程语言,原生函数调用能力超越Claude 3.5 Sonnet,MMLU达84%。

2026-07-31 5 阅读
Meta深夜开源Llama 4:首用MoE架构,千万token上下文刷新开源纪录 Meta深夜开源Llama 4:首用MoE架构,千万token上下文刷新开源纪录

Meta深夜开源Llama 4:首用MoE架构,千万token上下文刷新开源纪录

2025年4月6日Meta发布Llama 4系列,首次采用MoE架构,Scout提供1000万token上下文窗口创行业纪录,Maverick在LMArena以1417分超越DeepSeek登顶开源第一。

2026-07-31 7 阅读
OpenAI发布Sora 2:视频生成的GPT-3.5时刻,音画同步+物理真实感质飞跃 OpenAI发布Sora 2:视频生成的GPT-3.5时刻,音画同步+物理真实感质飞跃

OpenAI发布Sora 2:视频生成的GPT-3.5时刻,音画同步+物理真实感质飞跃

2025年9月30日OpenAI发布Sora 2,物理特性准确度、画面真实感及可操控性实现质的飞跃,支持音画同步对白与音效,配套TikTok式社交iOS应用48小时登顶App Store榜首。

2026-07-31 6 阅读
DeepSeek V4震撼发布:1.6T参数MoE架构,MIT开源挑战GPT-5.5 DeepSeek V4震撼发布:1.6T参数MoE架构,MIT开源挑战GPT-5.5

DeepSeek V4震撼发布:1.6T参数MoE架构,MIT开源挑战GPT-5.5

2026年4月24日,DeepSeek发布V4 Preview,采用1.6T参数MoE架构与1M上下文窗口,引入Engram条件记忆、流形约束超连接、闪电索引器三大架构创新,LiveCodeBench达93.5分超越所有竞争对手,价格仅为Claude Opus的1/500。

2026-07-31 7 阅读
马斯克xAI发布Grok 4:多智能体协作架构,HLE测试达44.4% 马斯克xAI发布Grok 4:多智能体协作架构,HLE测试达44.4%

马斯克xAI发布Grok 4:多智能体协作架构,HLE测试达44.4%

马斯克旗下xAI于2025年7月9日发布Grok 4系列,采用多智能体协作架构,在Humanity's Last Exam测试中以44.4%准确率刷新纪录,AIME 2025数学竞赛实现满分,号称「世界最强AI模型」。

2026-07-31 6 阅读