Gemma 4Google多模态开源 开源模型
Google Gemma 4 4
Gemma系列 · Google · 2026-04发布
模型介绍
Google 2026 开源旗舰 Gemma 4,四种架构五档尺寸,31B 与 26B MoE 分别在 Arena 排名开源第 3/6,140+ 语言、最多 256K 上下文,Apache-2.0 可商用。
模型基础信息
模型系列Gemma系列
开发机构Google
发布时间2026-04
参数规模E2B / E4B / 12B / 26B-A4B / 31B
上下文窗口256K
模型类型多模态(文本+图像)
中文能力良好
使用方式网页体验 / API调用 / 本地部署
免费额度与收费政策
开源免费
免费规则详情
Apache-2.0 自由商用。
收费标准简介
本地零成本。
模型能力介绍
✅ 核心优势
- 开源 SOT
- 多尺寸
- 140+ 语�
- 256K 上下文
⚠️ 短板与局限
- 中文一般
- 31B 显存需求高
🎯 适用场景
- 本地部署
- gent
- 端侧
- 编码
模型使用教程
本章节整理 Google Gemma 4 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。
- 本地体验:
ollama run gemma-4或 Transformers / vLLM 加载。 - 云端:HF 托管模型可在线体验。
ollama run gemma-4 "用中文介绍一下Google Gemma 4"
HF_ENDPOINT=https://hf-mirror.com huggingface-cli download Google/Gemma 4 --local-dir ./gemma-4
或 ModelScope 国内直连下载。
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained('Google/Gemma 4')
tok = AutoTokenizer.from_pretrained('Google/Gemma 4')
code = tok.apply_chat_template([{'role':'user','content':'你好'}], tokenize=False)
print(model.generate(**tok(code, return_tensors='pt')))
Gemma 4 是 Google 开源多模态系列(E2B/E4B/12B/26B-A4B/31B),Apache-2.0。
- 端侧(E2B/E4B)Ollama:
ollama pull gemma4:e2b
- 交互使用:
ollama run gemma4:e2b
- 31B 用 vLLM:
pip install vllm && vllm serve google/gemma-4-31b-it --port 8000
- 26B-A4B MoE 专为低延迟设计,泛化好且速度快。
Tips:31B 量化 Q4 约 17.5GB、26B MoE 量化约 14GB;按显存选档。
💡 使用小技巧
ollama pull gemma4 体验。
❓ 常见问题 FAQ
Q1:Gemma 4 亮点?\nA1:开源最强多尺寸。
访问备注与注意事项
- 权重 hf-mirror 可下
Aitishiku.com