Google Gemma 3

Google Gemma 3

Google DeepMind 开源轻量大模型,27B 单卡可运行,128K 上下文,140+ 语言,Chatbot Arena 开源第一。

月访问量
12.5M
累计浏览
2
用户评分
4.4
收录时间
2026-07

产品介绍

产品介绍

Gemma 3 是 Google DeepMind 2025年3月发布的开源轻量大模型,提供 270M/1B/4B/12B/27B 五种规格。27B dense 架构,Chatbot Arena ELO 1338(全球第九、开源第一),INT4 量化后 14GB 显存单卡可运行。4B+ 支持多模态,128K 上下文,140+ 语言。

核心功能

  • 多模态:4B+ 支持文本与图像联合输入(SigLIP 视觉编码器)
  • 128K 上下文:处理 300 页文档
  • 轻量多规格:270M 到 27B,覆盖边缘到服务器
  • 局部/全局混合注意力:5:1 局部全局层比,兼顾效率
  • 140+ 语言:预训练覆盖
  • 函数调用:支持结构化输出与工具调用

API 调用示例

Google AI Studio API:

curl -X POST "https://generativelanguage.googleapis.com/v1beta/models/gemma-3-27b-it:generateContent?key=$GEMMA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"contents": [{"parts": [{"text": "用Python实现LRU缓存"}]}]}'

Ollama 本地运行:ollama run gemma3:27b

典型使用场景

  • 本地私有化部署(单卡 RTX 4090)
  • 边缘设备 AI(1B/4B)
  • 多模态图文问答
  • 研究与教育
  • 长文档处理

平台支持

Google AI Studio、HuggingFace、Ollama、vLLM、llama.cpp、PyTorch/JAX。Gemma Terms of Use 开源协议。