模型算力广场
正飞GEO聚合国内外主流大模型与算力服务商,提供模型参数、评测评分、性能指标与对比分析,帮助开发者与企业一站式选型
热门大模型推荐
精选主流大模型与本地部署工具,助你快速选型
| 排名 | 模型名称 | 提供商 | 分类 | 评分 | 月访问量 | 热度 |
|---|---|---|---|---|---|---|
| 1 |
GPT-5.4 Pro
按量付费
|
美国 | 模型算力 | 4.7 | 3900.0M | 87 |
| 2 |
Gemini 3.1 Pro
按量付费
|
美国 | 模型算力 | 4.5 | 2800.0M | 80 |
| 3 |
GPT-5 Mini
按量付费
|
美国 | 模型算力 | 4.4 | 800.0M | 78 |
| 4 |
Claude Opus 4.6
按量付费
|
美国 | 模型算力 | 4.7 | 450.0M | 83 |
| 5 |
Claude Haiku 4.5
按量付费
|
美国 | 模型算力 | 4.5 | 300.0M | 79 |
| 6 |
DeepSeek V4 Pro
峰谷定价(已生效):高峰时段(9:00-12:00、14:00-18:00)V4-Pro输入缓存命中0.30元/缓存未命中9元/输出27元每百万tokens,空闲时段价格减半
|
中国 | 模型算力 | 4.4 | 250.0M | 83 |
| 7 |
DeepSeek V3.2
开源免费
|
中国 | 模型算力 | 4.2 | 200.0M | 80 |
| 8 |
Qwen3.5
按量付费
|
中国 | 模型算力 | 4.4 | 180.0M | 71 |
| 9 |
Grok 4.6
按量付费:输入$2/百万Tokens,输出$6/百万Tokens
|
美国 | 模型算力 | 4.5 | 120.0M | 79 |
| 10 |
Perplexity Sonar
按量付费
|
美国 | 模型算力 | 4.7 | 100.0M | 71 |
算力服务商与模型卡片
汇聚主流模型与算力服务,对比规格、价格与特色
NVIDIA 2026年8月11日发布的开源MoE模型,30B总参数/3B激活,1M上下文,专为长时运行智能体设计,吞吐量提升4倍,单卡可部署,权重完全开源。
DeepSeek于2026年8月21日上线的V4系列首款多模态视觉理解模型,284B参数(13B激活),实验性质版本,七项文本测试六项超越上代,两项视觉测试高出10分以上,小幅领先Claude Opus 4.8。
Meta 2026年8月10日发布的30B开源大模型,Apache 2.0许可,4-bit量化后可在单张消费级显卡运行,专为本地智能体任务优化。
Meta超级智能实验室(MSL)于2026年8月5日发布的多模态推理旗舰模型,100万token上下文窗口,专为智能体任务和代码工程优化,与Muse Code终端编程助手协同训练,Terminal-Bench 2.1得分82.9%。
Mistral 2026年8月发布的推理专用模型系列,Magistral Small 24B开源免费,主打数学物理逻辑推理
商汤科技于2026年8月21日开源的轻量级原生统一多模态大模型,仅8B-MoT规模实现原生4K视觉生成、超长指令遵循和图像编辑能力,面向全球开发者开源。
阿里万相3.0 All-in-One视频生成模型,8月24日正式发布
中科院大连化物所联合科大讯飞、阿里云发布,我国化工行业首个大模型最新版本,集成400+化工智能体
OpenAI 2026年8月推出的GPT-5.6系列轻量高效模型,主打高速度低成本,面向日常对话和高吞吐量场景,免费用户默认模型,文本聊天不限量,支持1.05M上下文。
Ornith AI开源大模型家族,397B/35B/9B三档齐发,MIT许可证,自我改进训练策略,397B版Terminal-Bench跑分超越Claude Opus 4.8,9B版可部署到手机。
DeepSeek 首个多模态视觉理解模型,8月21日上线,纯文本能力与 V4-Flash 持平,视觉 Agent 能力接近 Opus-4.8,图片按 Token 计费封顶 384 tokens。
IBM 开源推理大模型系列,3B/8B/30B 三档规格,原生思考模式,Apache 2.0 协议,专为企业级 Agent 设计
智谱AI新一代基座模型,8月19日API正式上线,7430亿参数MoE架构,Artificial Analysis得分60首次比肩闭源旗舰,编程与网络安全能力开源第一,权重将于8月28日开源。
阿里通义千问于2026年8月15日正式开源的270亿参数原生多模态Dense模型,综合能力超越Qwen3.7-Plus,支持编程、办公和视觉理解,Apache 2.0协议,量化后消费级显卡可部署。
Google DeepMind 2026年8月13日发布的编程与Agent主力模型,三周快速迭代,FrontierCode编程能力超越Claude Sonnet 5,价格减半性价比极高。
谷歌于2026年8月13日发布的轻量级高性能模型,定位为迄今最智能的工作型(workhorse)模型,主打编程与智能体场景,编程能力暴涨且API价格直接腰斩。
Google 推出的专注语音转文本模型,支持85+种语言自动识别、去口头禅与多人识别,流式转录延迟低于1秒,专为会议记录、播客转录设计。
阿里通义千问开源的极致性价比多模态MoE大模型,125B主模型每Token仅激活6B,原生支持262K上下文,办公与编码性能出色,8月起价格大幅下调。
fal 后训练的 MiniMax H3 视频生成模型,5 秒片段 3 秒生成,图生视频带音频性能第一
Google DeepMind的视频生成与编辑多模态模型,支持场景扩展、首末帧控制、360p快速草稿与1080p/4K超分,单次生成最长40秒,24fps横竖屏可控。
模型对比表
主流模型核心指标横向对比,一目了然
| 对比维度 |
|
|
|
|
|---|---|---|---|---|
| 提供商 / 地区 | 美国 | 美国 | 美国 | 美国 |
| 分类 | 模型算力 | 模型算力 | 模型算力 | 模型算力 |
| 评分 | 4.7 | 4.5 | 4.4 | 4.7 |
| 月访问量 | 3900.0M | 2800.0M | 800.0M | 450.0M |
| 浏览热度 | 87 | 80 | 78 | 83 |
| 价格方案 | 按量付费 | 按量付费 | 按量付费 | 按量付费 |
| 更新时间 | 2026-07-31 | 2026-07-31 | 2026-07-31 | 2026-07-31 |
性能基准测试
主流模型评分对比图表,数据基于真实用户评分