Pinecone Nexus正式发布:检索层在τ-Knowledge基准超越三大前沿模型
Pinecone Nexus正式发布:检索层在τ-Knowledge基准超越三大前沿模型
Pinecone宣布知识引擎Nexus正式GA,在τ-Knowledge企业知识任务基准测试中,使用Nexus作为检索层的Agent超越了基于OpenAI、Anthropic和Google前沿模型构建的Agent。这证明在Agent系统中,检索层而非模型本身才是决定性能的关键因素。
8月23日,Pinecone宣布其知识引擎Nexus正式进入通用可用(GA)阶段。Nexus可将企业专有数据和工作流转化为可治理、Agent就绪的知识,通过单次API调用即可暴露。更引人注目的是,在τ-Knowledge这一面向困难企业知识任务的开放基准测试中,使用Nexus作为知识检索层的Agent获得了最高分,超越了基于OpenAI、Anthropic和Google前沿模型构建的Agent。
这一结果的核心启示在于:相同的模型搭配不同的检索层,产生了不同的结果。Agent系统的性能瓶颈往往不在模型本身,而在检索层。过去两年,大多数团队将精力集中在优化模型上,将检索视为"管道工程",但Nexus的基准成绩证明检索层才是决定Agent知识任务表现的关键因素。
关键信息:
- 产品定位:Nexus定位为企业知识引擎,将专有数据转化为Agent可用的结构化知识
- 基准成绩:τ-Knowledge开放基准上超越OpenAI、Anthropic、Google前沿模型构建的Agent
- 部署方式:支持在客户自有云环境中部署,满足企业数据安全要求
- 核心洞察:Agent系统能力瓶颈往往在检索而非模型,优化检索比更换模型更经济有效
- 行业趋势:近期多项案例显示,系统瓶颈多在模型能力之外(如代码审查流程、数据规格等)
同期值得关注的是,Meta和DeepSeek在周末悄然向OpenRouter平台上线了新模型,Meta约10小时前上线、DeepSeek约17小时前上线,均未发布官方公告。此外,8月31日将迎来多个重要节点:Claude Sonnet 5输入价格从2美元涨至3美元/百万tokens,GPT-5.4和GPT-5.4 mini将从Codex迁移至ChatGPT登录用户,kimi-k2.5和moonshot-v1将停服。