Gemma 4 QAT models: Optimizing compression for mobile and laptop efficiency
blog.google原文 ↗
Google 发布 Gemma 4 的 quantization-aware training 模型,目标是提高移动端和笔记本上的压缩推理效率。QAT 的意义在于训练阶段就适配低精度,而不是部署时再做后量化补救。它反映开源/开放权重小模型竞争正在转向端侧可用性。
–浏览
评论 · Comments