​本周四,谷歌正式推出Gemma 3系列的最新成员——Gemma 3 270M模型。这款仅241MB的轻量级语言模型拥有2.7亿参数,凭借其出色的指令跟踪和文本结构化能力,为设备端AI应用和研究场景提供了新的可能性。

​模型亮点​

  1. ​高效架构设计​

    • 参数分布:1.7亿嵌入参数+1亿Transformer模块参数

    • 支持256k token的超大词汇量,可精准处理专业术语和罕见词汇

    • 采用量化感知训练(QAT),支持INT4精度运行

  1. ​极致能效表现​

    • 在Pixel 9 Pro手机SoC测试中,INT4量化版本25次对话仅耗电0.75%

    • 相比同系列其他型号,成为最节能的Gemma模型

  2. ​专业化应用优势​

    • 开箱即用的指令跟随能力

    • 支持快速微调(最快可在5分钟内完成)

    • 可在设备端离线运行,保障数据隐私

​典型应用场景​

  • 结构化文本处理(如实体提取、合规检查)

  • 低延迟需求场景(查询路由、实时分析)

  • 敏感数据处理(医疗、金融等隐私要求高的领域)

  • 多专业模型并行部署(各司其职的模块化方案)

​生态支持​

谷歌同步提供了:

  • 完整微调指南(Hugging Face适配)

  • 预训练模型与指令调优版本

  • 主流推理工具支持(llama.cpp/Keras/MLX等)

  • Vertex AI云服务平台试用入口

据官方数据显示,Gemma系列累计下载量已突破2亿次。开发者可通过Colab快速体验微调流程,或在移动端部署这款目前最节能的Gemma模型。

Logo

北京人形旗下天工造物具身智能开源社区,聚焦具身天工与慧思开物两大平台

更多推荐