​谷歌发布多语言 AI 新战略,让全球每种语言都能被听见与理解

近日,谷歌发布了关于全球语言智能的 最新 技术成果,宣布其各项 AI 技术与产品已能够支持超过300种语言、覆盖全球71亿人口及86% 的人口比例。谷歌表示,真正的语言大模型不仅要完成简单的文本翻译,更要深入理解人类在真实世界中充满语气、情感与文化细微差别的交流方式。 在技术架构上,传统的语音识别通常采用将音频转为文本、处理文本再转回音频的多步刚性管线,这会剥离掉人类对话中至关重要的语调、节奏、情感与上下文。为了还原真实的交流质感,谷歌推动了向原生音频智能的跃迁,让诸如 Gemini 等模型能够直接处理和理解音频本身。

圈主 管理员

热门评论
:
该帖子评论已关闭
图片审查中...
编辑答案: 我的回答: 最多上传一张图片和一个附件
x
x