Google DeepMind·· 2026-06-09精选AI 评分83
Google DeepMind 推出 Gemma 4 12B:采用无编码器统一架构的多模态端侧模型
Introducing Gemma 4 12B: a unified, encoder-free multimodal model
AI 导读
Google DeepMind 正式推出多模态模型 Gemma 4 12B,采用无编码器的统一架构,使视觉与原生音频输入直接融入大语言模型主干进行处理。该模型在标准基准上的性能接近 26B MoE 模型,显存占用减半且仅需 16GB 内存即可在笔记本本地流畅运行。
推荐理由
该模型舍弃了独立多模态编码器并将音频与视觉直接投影至大语言模型主干,为在消费级硬件上低显存部署多模态智能体提供了轻量架构参考。
来源:Google DeepMind · deepmind.google