当地时间8月26日,谷歌推出最新语音转文本模型Gemini 3.5 Transcribe,该模型不仅提升识别准确率,更具备理解说话人意图的能力,能自动识别自我修正、删除口头禅,并将非结构化口语转化为格式化文本。谷歌称其为迄今“最精准”的模型,已引入Android版Gboard及Mac版Gemini应用,并通过Gemini API向开发者开放预览。此次发布与Gemini 3.5 Live及Gemini 3.5 Live Experimental同日推出,共同构成谷歌新的Gemini Audio系列。分析人士认为,随着语音入口加速渗透谷歌产品,语音交互有望逐步替代键盘输入,成为用户与AI系统的主要连接方式。