原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.aibase.com/zh/news/31094
立即前往原文

谷歌发布多语言AI战略,让全球每种语言都能被听见与理解

谷歌发布全球语言人工智能领域的新成果,称其技术和产品已支持超过300种语言,覆盖约86%的世界人口。其战略重点是发展原生音频智能,让Gemini等模型直接处理和理解音频,而不是仅依赖“语音转文字”的传统流程,从而保留语调、情感、节奏和上下文。谷歌介绍了支持70种语言的实时口语翻译、适用于嘈杂环境和专业术语的语音转写,以及Gboard中的语音重写功能。为覆盖低资源语言,谷歌推进“1000种语言计划”,利用跨语言迁移学习和本地数据采集,并提到WAXAL、Project Vaani和Language Explorer。公司还推出了支持55种语言、可在设备端离线运行的轻量级开源翻译模型TranslateGemma,以及面向功能手机的语音助手、手语转写和毛利语地名本地化发音技术。相关内容同时包含既有研究、已宣布产品和未来计划。
行业资讯 应用 行业新闻 科技巨头 AI模型 研究 开源 2026-09-16 15:30:44 531 阅读 阅读约 1 分钟 来源:AIbase
本文来源:AIbase,仅供学习参考,版权归原作者所有。