谷歌发布Gemini 3.5 Transcribe语音转文本模型,号称“最精准”并能理解说话人意图
当地时间8月26日,谷歌推出最新语音转文本模型Gemini 3.5 Transcribe,该模型不仅提升识别准确率,更具备理解说话人意图的能力,能自动识别自我修正、删除口头禅,并将非结构化口语转化为格式化文本。谷歌称其为迄今“最精准”的模型,已引入Android版Gboard及Mac版Gemini应用,并通过Gemini API向开发者开放预览。此次发布与Gemini 3.5 Live及Gemini 3.5 Live Experimental同日推出,共同构成谷歌新的Gemini Audio系列。分析人士认为,随着语音入口加速渗透谷歌产品,语音交互有望逐步替代键盘输入,成为用户与AI系统的主要连接方式。
暂无AI深度解读,点击上方「AI解读」按钮,即刻生成一份全新解读
免责声明:本内容仅代表作者个人观点,不构成任何投资理财建议。
24小时热榜
-
1
韩国实体AI热潮:机器人咖啡师与K-pop舞者引领潮流
-
2
CoinDesk分析:加密市场“10·10”事件一年后,比特币和以太坊流动性已重建,但山寨币仍面临风险
-
3
小蚁币(NEO)解析:从“中国以太坊”到智能经济平台
-
4
恩玖币(NGOT)解析:定位、总量与市场现状
-
5
USDT泰达币:钱包地址查询与官方钱包使用指南
-
6
以太坊(ETH)购买指南:如何选择可靠平台
-
7
AltLayer (ALT) 项目解析与现状
-
8
调查揭示朝鲜黑客15亿美元Bybit盗窃案洗钱网络,美国财政部制裁涉案平台
-
9
代币化大宗商品市场扩张,借贷和能源领域成新增长点
-
10
回顾比特股的未来:DEX先驱与稳定币创新的交织路径
今日行情
推荐阅读








