谷歌發佈Gemini 3.5 Transcribe語音轉文本模型,號稱“最精準”並能理解説話人意圖
當地時間8月26日,谷歌推出最新語音轉文本模型Gemini 3.5 Transcribe,該模型不僅提升識別準確率,更具備理解説話人意圖的能力,能自動識別自我修正、刪除口頭禪,並將非結構化口語轉化為格式化文本。谷歌稱其為迄今“最精準”的模型,已引入Android版Gboard及Mac版Gemini應用,並通過Gemini API向開發者開放預覽。此次發佈與Gemini 3.5 Live及Gemini 3.5 Live Experimental同日推出,共同構成谷歌新的Gemini Audio系列。分析人士認為,隨着語音入口加速滲透谷歌產品,語音交互有望逐步替代鍵盤輸入,成為用户與AI系統的主要連接方式。
來源:华尔街见闻 · 原文連結
免責聲明:本內容僅代表作者個人觀點,不構成任何投資理財建議。如有發現違規內容點擊舉報
24小時熱榜
-
1
BCUG幣解析:Blockchain Cuties Universe治理代幣現狀與市場流動性
-
2
CHP幣交易指南:CoinPoker代幣的用途與獲取途徑解析
-
3
AGGL幣價值分析:市場活躍度極低,投資前景存疑
-
4
中國大陸虛擬貨幣監管現狀與交易風險解析
-
5
OGN交易深度解析:新手入門必知的十大要點
-
6
虛擬幣幣交易平台與軟件:主流選擇與功能解析
-
7
FEED幣是什麼?慈善導向代幣FEED項目解析與市場現狀
-
8
比特幣價格持續上漲:三大核心驅動因素解析
-
9
日本計劃探索基於區塊鏈的24/7政府債券和股票結算系統,目標2027年初敲定開發計劃
-
10
BOLT幣多義解析:去中心化媒體生態與迷因幣的交易指南
今日行情
推薦閱讀











