谷歌發佈Gemini 3.5 Transcribe語音轉文本模型,號稱“最精準”並能理解説話人意圖
當地時間8月26日,谷歌推出最新語音轉文本模型Gemini 3.5 Transcribe,該模型不僅提升識別準確率,更具備理解説話人意圖的能力,能自動識別自我修正、刪除口頭禪,並將非結構化口語轉化為格式化文本。谷歌稱其為迄今“最精準”的模型,已引入Android版Gboard及Mac版Gemini應用,並通過Gemini API向開發者開放預覽。此次發佈與Gemini 3.5 Live及Gemini 3.5 Live Experimental同日推出,共同構成谷歌新的Gemini Audio系列。分析人士認為,隨着語音入口加速滲透谷歌產品,語音交互有望逐步替代鍵盤輸入,成為用户與AI系統的主要連接方式。
暫無AI深度解讀,點擊上方「AI解讀」按鈕,即刻生成一份全新解讀
免責聲明:本內容僅代表作者個人觀點,不構成任何投資理財建議。
24小時熱榜
-
1
韓國實體AI熱潮:機器人咖啡師與K-pop舞者引領潮流
-
2
CoinDesk分析:加密市場“10·10”事件一年後,比特幣和以太坊流動性已重建,但山寨幣仍面臨風險
-
3
小蟻幣(NEO)解析:從“中國以太坊”到智能經濟平台
-
4
恩玖幣(NGOT)解析:定位、總量與市場現狀
-
5
USDT泰達幣:錢包地址查詢與官方錢包使用指南
-
6
以太坊(ETH)購買指南:如何選擇可靠平台
-
7
AltLayer (ALT) 項目解析與現狀
-
8
調查揭示朝鮮黑客15億美元Bybit盜竊案洗錢網絡,美國財政部制裁涉案平台
-
9
代幣化大宗商品市場擴張,借貸和能源領域成新增長點
-
10
回顧比特股的未來:DEX先驅與穩定幣創新的交織路徑
今日行情
推薦閱讀








