谷歌发布Gemini 3.5 Transcribe语音转文本模型,号称“最精准”并能理解说话人意图
当地时间8月26日,谷歌推出最新语音转文本模型Gemini 3.5 Transcribe,该模型不仅提升识别准确率,更具备理解说话人意图的能力,能自动识别自我修正、删除口头禅,并将非结构化口语转化为格式化文本。谷歌称其为迄今“最精准”的模型,已引入Android版Gboard及Mac版Gemini应用,并通过Gemini API向开发者开放预览。此次发布与Gemini 3.5 Live及Gemini 3.5 Live Experimental同日推出,共同构成谷歌新的Gemini Audio系列。分析人士认为,随着语音入口加速渗透谷歌产品,语音交互有望逐步替代键盘输入,成为用户与AI系统的主要连接方式。
来源:华尔街见闻 · 原文链接
免责声明:本内容仅代表作者个人观点,不构成任何投资理财建议。如有发现违规内容点击举报
24小时热榜
-
1
BCUG币解析:Blockchain Cuties Universe治理代币现状与市场流动性
-
2
CHP币交易指南:CoinPoker代币的用途与获取途径解析
-
3
AGGL币价值分析:市场活跃度极低,投资前景存疑
-
4
中国大陆虚拟货币监管现状与交易风险解析
-
5
OGN交易深度解析:新手入门必知的十大要点
-
6
虚拟币币交易平台与软件:主流选择与功能解析
-
7
FEED币是什么?慈善导向代币FEED项目解析与市场现状
-
8
比特币价格持续上涨:三大核心驱动因素解析
-
9
日本计划探索基于区块链的24/7政府债券和股票结算系统,目标2027年初敲定开发计划
-
10
BOLT币多义解析:去中心化媒体生态与迷因币的交易指南
今日行情
推荐阅读











