月访问量
12.5M
累计浏览
2
用户评分
4.4
收录时间
2026-07
产品介绍
产品介绍
Gemma 3 是 Google DeepMind 2025年3月发布的开源轻量大模型,提供 270M/1B/4B/12B/27B 五种规格。27B dense 架构,Chatbot Arena ELO 1338(全球第九、开源第一),INT4 量化后 14GB 显存单卡可运行。4B+ 支持多模态,128K 上下文,140+ 语言。
核心功能
- 多模态:4B+ 支持文本与图像联合输入(SigLIP 视觉编码器)
- 128K 上下文:处理 300 页文档
- 轻量多规格:270M 到 27B,覆盖边缘到服务器
- 局部/全局混合注意力:5:1 局部全局层比,兼顾效率
- 140+ 语言:预训练覆盖
- 函数调用:支持结构化输出与工具调用
API 调用示例
Google AI Studio API:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/models/gemma-3-27b-it:generateContent?key=$GEMMA_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents": [{"parts": [{"text": "用Python实现LRU缓存"}]}]}'
Ollama 本地运行:ollama run gemma3:27b
典型使用场景
- 本地私有化部署(单卡 RTX 4090)
- 边缘设备 AI(1B/4B)
- 多模态图文问答
- 研究与教育
- 长文档处理
平台支持
Google AI Studio、HuggingFace、Ollama、vLLM、llama.cpp、PyTorch/JAX。Gemma Terms of Use 开源协议。