Gemma
Google 首代轻量开放模型,提供 2B 和 7B 规格。
FAMILY / GOOGLE DEEPMIND
Google 面向本地、边缘和可定制部署的开放模型家族。
01 / LINEAGE MAP
02 / GENERATIONS
Google 首代轻量开放模型,提供 2B 和 7B 规格。
以 9B、27B 规格提升推理与单加速器部署能力。
加入图像输入、128K 上下文和 140 多种语言支持。
以 MatFormer 和 Per-Layer Embeddings 把全模态理解压缩到移动设备。
Gemma 4 的高质量 Dense 旗舰,面向本地推理、编码和 Agent 工作流。
每步仅激活 3.8B 参数的 Gemma 4 MoE,强调本地速度与智能密度。
面向笔记本的统一无编码器多模态型号,补齐 E4B 与 26B 之间的档位。
基于 Gemma 4 的实验性文本扩散模型,以块级并行生成探索更低延迟。