Gemma 4 Technical Report 全文总结+指定章节中英对照翻译
一、文章核心内容总览
本文是Google DeepMind于2026年6月发布的Gemma 4技术报告,介绍Gemma系列第四代开源权重原生多模态大模型家族,面向移动端、PC、服务器全硬件场景,兼顾推理性能、多模态能力、长上下文与推理效率,模型采用宽松Apache 2.0开源协议,可商用、二次开发。
1. 模型产品线
覆盖稠密Dense与混合专家MoE双架构,共5个规格:
- E2B(2.3B有效参数,总5B)、E4B(4.5B有效参数,总8B):边缘端小模型,手机/嵌入式部署,原生支持图文音三模态;采用分层嵌入Per-Layer Embedding提升参数利用率。
- 12B稠密模型:行业首创无编码器统一多模态架构,抛弃独立ViT/USM音视频编码器,直接映射原始图像块、40ms音频片段进入LLM嵌入空间。
- 26B-A4B MoE混合专家:总参26B,推理仅激活3.8B参数,兼顾4B级推理速度与超大模型性能。
- 31B稠密旗舰:系列最强文本/多模态性能,开源稠密模型榜单第一,适配私有服务器、