谷歌发布开源模型Gemma 4:最小版手机可跑,剑指端侧智能体
谷歌的开源攻势加码了。4月初,谷歌发布全新开源模型家族Gemma 4,采用Apache 2.0协议完全开放,共四个尺寸:E2B(约23亿参数)、E4B(约45亿参数)、26B MoE(激活参数约40亿)和31B稠密模型,主打推理、代码和智能体工作流。
端侧AI:手机、笔记本都能跑
Gemma 4的一大亮点是端侧能力:最小的E2B版本可以直接在安卓手机、笔记本和小型服务器上本地运行,支持文本、图像、视频、音频的多模态输入,上下文窗口达12.8万至25.6万token。在多个开源模型榜单上,Gemma 4位居前列。
对开发者而言,这意味着可以在不依赖云端API的情况下,在本地设备上构建具备推理能力的智能体应用——数据不出设备,延迟更低,成本也更可控。
背景:开源与闭源的拉锯战
谷歌在开源策略上一直走“双轨制”:旗舰的Gemini系列保持闭源、通过云服务变现;轻量级的Gemma系列则完全开源、争夺开发者生态。Gemma 4的发布,正值Meta被传将在2026年第一季度推出代号“Avocado”的闭源模型、Anthropic与谷歌深度绑定之际,开源阵营需要一款能打的产品来稳住阵脚。
与此同时,中国的开源模型(DeepSeek、通义千问、Kimi等)正在全球快速扩张,Gemma 4也面临着来自东方的直接竞争。
影响展望
Gemma 4的真正意义在于端侧智能体:当足够强的模型能跑在手机上,AI助手就不再是云端的一个聊天框,而是随时在线的本地智能体。这将加速“AI手机”“AI PC”从营销概念变为真实体验。对谷歌来说,开源Gemma是在为Android和自家芯片铺设AI时代的护城河。