你是否厌倦了依赖网络、担心隐私泄露的在线翻译工具?Gemma Translator 是一款真正“离线可用”的开源语音翻译系统——它能把你的树莓派变成一台不联网也能实时听懂并翻译多国语言的智能终端。无需云端API、不上传任何语音数据,所有语音识别、大模型推理、文本转语音全部在本地完成,专为隐私敏感场景和弱网/无网环境(如野外考察、工业现场、教育实验)而生。
核心功能
- 完全离线运行:基于 Google 开源轻量级大模型 Gemma-4 和 LiteRT-LM 推理引擎,在树莓派5(8GB内存)上实现端到端语音翻译,全程不依赖互联网
- 即说即译的语音交互:内置麦克风音频采集模块,支持实时语音输入→语音识别→语义理解→目标语言生成→语音合成输出的完整链路
- 小屏友好终端界面:采用复古命令行风格UI,专为 480×320 等小型硬件屏幕(如树莓派官方7英寸触摸屏、便携LCD模块)深度优化,操作直观、响应迅速
- 一键启动全栈服务:只需运行一个部署脚本(
deploy-pi.sh),自动拉起 Python API服务、LiteRT-LM模型服务与React前端,告别繁琐配置 - 高质量本地TTS:集成 Moonshine 开源语音合成模型,发音自然、延迟低,支持中英等主流语言,告别机械电子音
- 开源可审计、可定制:全部代码公开,模型权重本地加载,开发者可轻松替换语言对、调整UI、接入新硬件或扩展翻译能力
适合哪些人用
这款工具特别适合:嵌入式AI爱好者与树莓派玩家、中小学信息科技教师(用于AI科普教学演示)、跨境一线工作人员(如边检、外贸展台、海外工程队)、隐私优先型用户(拒绝语音数据上云)、以及希望在离线环境中验证大模型落地可行性的开发者。它不是“玩具”,而是一套经 Google 实验团队打磨、具备真实可用性的边缘AI翻译原型系统。
快速上手
在树莓派5(推荐Raspberry Pi OS 64位 + 8GB内存)上,仅需三步即可运行:
- 克隆项目:
git clone https://github.com/google-gemma/gemma-translator.git - 执行一键部署:
cd gemma-translator && ./deploy-pi.sh(脚本会自动安装Python 3.10+、Node.js 20 LTS、依赖库及模型文件) - 浏览器访问
http://localhost:3000,点击麦克风图标开始语音对话——首次运行会自动下载约1.2GB的本地模型,后续启动秒开
注:需外接USB麦克风或树莓派官方麦克风阵列;Windows 用户暂不支持,建议使用 Linux 或 macOS 进行开发调试。
项目信息
编程语言:JavaScript(前端) + Python(后端服务)|Star 数:579|开源协议:Apache-2.0|GitHub 项目地址
这是一款把前沿AI技术真正“塞进口袋”的诚意之作——不画饼、不依赖云、不牺牲隐私,让每个人都能亲手部署属于自己的离线AI翻译官。




