行业资讯

谷歌推出离线翻译硬件Gemma Translator

Heooo 08月07日15时01分 13 阅读

「谷歌Creative Lab团队发布离线翻译设备Gemma Translator,基于树莓派5和Gemma4E2B模型,总参数量51亿、激活参数量23亿,专为边缘设备设计。设备集成本地语音识别、翻译与合成,全程不依赖网络,实现跨语种面对面交流,展示了端侧AI产品化的清晰路径。」

谷歌又一次把AI能力从云端拉回到了本地设备上。8月6日,谷歌Creative Lab团队正式发布了一款名为Gemma Translator的离线翻译设备,其核心是自家Gemma4E2B模型,总参数量达到51亿,激活参数量为23亿。这个设计目标非常明确——专为手机、浏览器、树莓派这类资源受限的边缘设备而生,让大模型不再只依赖云端算力。

从硬件构成来看,Gemma Translator的底子是一块树莓派Raspberry Pi 5单板计算机。用户对着麦克风讲话后,设备会把语音实时转写成目标语言,再通过扬声器播报译文,同时还能在连接的显示器上同步展示翻译前后的文本内容。整套处理流程全部在本地完成,翻译推理由谷歌为边缘设备开发者准备的LiteRT-LM执行框架负责,语音转写和语音合成则使用Moonshine的AI本地处理方案。这意味着即便彻底断网,用户也依然能够与说不同语言的人面对面沟通。

把大模型塞进一块巴掌大的开发板里运行离线翻译,这件事的意义不在于参数规模有多大,而在于谷歌展示了一条清晰的产品化路径。此前,端侧模型大多停留在跑分实验室里的技术演示阶段,而Gemma Translator证明,这些模型可以被封装成真正独立可用的成品,插电即用,永不依赖网络。对于经常出境旅行、参与国际交流或在网络不稳定的环境中工作的人群来说,这类设备无疑提供了更可靠、更私密的翻译解决方案。

从技术角度观察,Gemma4E2B模型的参数配置也颇有意思。51亿总参数配合23亿激活参数,体现了稀疏激活或类似机制的效率优化思路,让有限的硬件资源得以承载更大的模型能力。而LiteRT-LM框架的引入,则进一步降低了开发者在边缘设备上部署大模型的门槛。谷歌的这一步棋,或许将推动更多离线AI应用走向现实。

# 离线翻译 # 树莓派 # 边缘AI

来源:Heooo AI工具导航