Google 于 8 月 20 日宣布,其开源 Gemma 模型家族已突破10 亿次下载,同时还有超过 10 万个由社区发布的 Gemma 变体,以及近期在 Kaggle 上发起的 Gemma Challenge 收到超过 1,600份投稿。该帖还在 GitHub 上推出了一个名为 "Awesome Gemma" 的仓库,作为 Google 所称的 Gemmaverse 的精选目录。
这篇帖子真正声称了什么
Google 明确表示,下载量并不是重点:“比下载次数更重要得多的是社区正在用它们构建什么。” 帖子给出的例子很具体。NASA 的团队已将 Gemma 用于在轨图像分析、带宽优化和星间路由。印度国家卫生管理局则将 Gemma 4 和 Google 的开源 Medical Data Toolkit 集成到 Aarogya Setu 2.0 中,用于把医疗报告转换为标准化数字格式。
常见解读错在何处
10 亿和 10 万这两个数字并不是彼此独立的。每一个社区变体本身都是同一平台上的可下载制品,其下载次数也会计入同一个总量。一个能产生 10 万次重新上传的生态系统,也就等于在机械性地抬高下载计数——这或许也是 Google 把生态系统的说法放在数字之前的原因。另一个方面,广泛流传的“仅 Gemma 4 就贡献了 3 亿次下载”这一说法并未出现在 Google 的帖子中;这是聚合网站在事后补写出来的。而标题为“赋能 1 亿印度公民”的部分,则基于 Aarogya Setu 2.0 拥有超过 1 亿次 Android 安装——那是这款应用的安装基数,而不是使用 Gemma 的人数。
为什么这个计数仍然重要
下载总量是开权重模型家族唯一公开的热度指标。它没有营收数据,没有座位数,没有 API 计量器。这使得这个数字既是行业通用标尺,也是最松散的标尺,也正因如此,人人都想比较的 Gemma 与 Llama 或 Qwen,无法仅凭公开数字清晰对照。
