AI 模型与平台
Google 的 Gemma 开源模型突破 10 亿下载,变体超过 10 万

Google DeepMind 的 Gemma 系列开源模型累计下载量已突破十亿,公司于 2026 年 8 月 20 日宣布,此前两年间,外部开发者基于模型的开放权重发布了超过 100,000 种变体。该数据在 Google 官方公告 中由 Google DeepMind 副总裁 Clement Farabet 与产品总监 Olivier Lacombe 透露,这是自 2024 年初该系列推出以来,Google 首次公布 Gemma 采用的累计总量。
下载次数并不能完整衡量开源模型的实际使用情况——权重会被拉取、镜像并重新上传到各个中心,单次下载并不能说明模型的运行频率。Google 与里程碑一起公布的数字更能说明生态系统的形态:开发者发布了超过 100,000 种不同的 Gemma 变体,包括针对特定语言、任务和硬件目标的微调和衍生模型。变体数量的多少,体现了模型是被人尝试使用还是被人进一步构建的区别。
本文围绕这些变体的运行地点进行结构化,且其地域分布异常。NASA、卫星初创公司 Satlyt 以及轨道计算公司 Starcloud 的团队正在太空中运行 Gemma 模型:用于机载图像分析、决定哪些数据值得占用稀缺的下行带宽以及在卫星之间路由通信。NASA 的案例是三者中记录最详尽的。该机构的喷气推进实验室在 2026 年初将压缩为 4 位的 Gemma 3 4B 版本部署在 Loft Orbital 卫星上,正如 IEEE Spectrum 于 2026 年 7 月 23 日报道 的那样,这是首次在轨道上演示视觉‑语言模型对卫星自身传感器图像进行分析。该系统名为 NAVI‑Orbital,在 7,960 张图像的地面基准测试中实现了 88% 的准确率,并在 Nvidia Jetson Orin AGX 模块上对法国图卢兹和阿根廷海岸进行实时捕获,该硬件受限程度足以让 40 亿参数模型的 8 GB 内存占用成为关键规格。
在地面上,公告中提到的最大单一部署位于印度,国家健康局将 Gemma 4 与 Google 开源的医疗数据工具包集成到 Aarogya Setu 2.0 中,这是一款 Android 下载量超过一亿的应用,用于将医疗报告转换为患者可在不同医疗机构之间共享的标准化数字格式。在科研方面,耶鲁大学和 Google 的研究人员在 Gemma 基础上构建了 C2S‑Scale,一种用于解释单细胞数据的模型;Google 表示该模型产生的癌症治疗通路随后在活细胞中得到验证。与此同时,公司针对特定领域的 MedGemma 模型已被用于临床应用开发,范围从全印度医学科学研究所的门诊分诊到乌干达农村前线医护工作者的工具。第四个项目 DolphinGemma 由乔治亚理工学院和 Wild Dolphin Project 合作构建,利用 Gemma 变体预测海豚发声序列(这是一项长期研究工作,而非已上市产品)。
兼具里程碑意义的产品目录发布
除了这些数字,Google 还借此文章在 GitHub 上推出了 Awesome Gemma 仓库,这是一个经过策划的社区项目、微调、教程和工具目录,Google 将其定位为所谓 Gemmaverse 的官方索引。公司还指出,最近在 Kaggle 举办的 Gemma 挑战吸引了超过 1,600 项目提交,获奖者将在未来几周公布。
解读这一里程碑的框架很重要。Google 并不出售 Gemma;该系列是公司对标 Meta Llama 的产品,旨在成为开源权重开发的默认基底,下载量则是两家实验室共同发布的计分板。
十亿下载的数字未能体现这些下载量中有多少转化为持续使用,Google 也未按模型代际或平台提供细分数据。更具持久性的信号体现在公司挑选展示的部署案例:相同的权重运行在功耗仅几百瓦的辐射硬化卫星计算机上、国家健康应用中以及细胞生物学研究流水线中。这个范围——从 40 亿参数的边缘模型到研究规模的系统——正是 Google 用来论证即使其前沿 Gemini 系统保持封闭,开源权重仍然在其模型系列中具有战略核心地位的依据。随着 Gemma 4 成为当前代际并且社区目录已上线,接下来可观察的标志将是 Kaggle 挑战的结果以及 Google 在未来几个月对 Gemma 4 的具体采纳数据。












