當地時間8月26日,谷歌推出最新語音轉文本模型Gemini 3.5 Transcribe,該模型不僅提升識別準確率,更具備理解説話人意圖的能力,能自動識別自我修正、刪除口頭禪,並將非結構化口語轉化為格式化文本。谷歌稱其為迄今“最精準”的模型,已引入Android版Gboard及Mac版Gemini應用,並通過Gemini API向開發者開放預覽。此次發佈與Gemini 3.5 Live及Gemini 3.5 Live Experimental同日推出,共同構成谷歌新的Gemini Audio系列。分析人士認為,隨着語音入口加速滲透谷歌產品,語音交互有望逐步替代鍵盤輸入,成為用户與AI系統的主要連接方式。