谷歌发布 Gemma 3n,专为移动设备打造的全新 AI 模型
Google宣布推出 Gemma 3n,这是其下一代的开放 AI 模型,与我们之前看到的相比有了显著的提升。继上个月在 Google I/O 大会上进行预览后,完整版现已发布,可直接在移动硬件上运行。 与 Gemini 的不同之处在于,Gemma 是为开发者下载和修改而设计的,而Gemini 是Google的封闭式专有模型。 该模型现在可以原生处理图像、音频和视频等输入并生成文本,这比仅仅基于文本的模型有了很大的飞跃。它甚至可以在内存仅为 2GB 的硬件上运行,并且据称在编码和推理等任务上表现更佳。以下是Google列出的所有改进: 多模式设计: Gemma 3n 原生支持图像、音频、视频和文本输入和文本输出。 专为设备端优化: Gemma 3n 型号以效率为设计重点,提供两种基于有效参数的尺寸:E2B 和 E4B。虽然它们的原始参数数量分别为 5B 和 8B,但架构创新使其运行内存占用与传统的 2B 和 4B 型号相当,仅需 2GB (E2B) 和 3GB (E4B) 内存即可运行。 突破性的架构: Gemma 3n 的核心是新颖的组件,例如用于计算灵活性的 MatFormer 架构...





