智谱AI发布新模型GLM-5.3-Flash,称其推理服务由超10万张国产芯片承载,效率媲美英伟达GPU,SemiAnalysis:英伟达护城河再受考验
智谱AI于8月26日正式确认,此前匿名测试的模型Ox Alpha(中文社区称“牛来”)即为最新发布的GLM-5.3-Flash。该模型在免费测试期间5天内累计流量超50万亿token,刷新平台纪录。智谱AI披露,其推理服务全部由超过10万张国产芯片集群承载,硬件效率及单token成本已达到与主流英伟达GPU相当的水平。半导体研究机构SemiAnalysis对此评论称,继OpenAI自研推理芯片Jalapeño之后,英伟达的CUDA护城河再度受到考验。GLM-5.3-Flash的定价为每百万token输入0.8元、输出2.8元,约为Anthropic的Claude Opus 4.8的1/40,旨在应对中国AI模型市场近期出现的涨价潮。
来源:华尔街见闻 · 原文链接
免责声明:本内容仅代表作者个人观点,不构成任何投资理财建议。如有发现违规内容点击举报
24小时热榜
-
1
日本计划探索基于区块链的24/7政府债券和股票结算系统,目标2027年初敲定开发计划
-
2
FEED币是什么?慈善导向代币FEED项目解析与市场现状
-
3
BOLT币多义解析:去中心化媒体生态与迷因币的交易指南
-
4
AidCoin (AID) 项目解析:慈善区块链的愿景与现状
-
5
Bybit上线MSTUUSDT传统金融永续合约,最高杠杆25倍
-
6
ONG是什么币?本体网络燃料代币ONG简介与交易平台
-
7
Bybit推出INFQUSDT传统金融永续合约,最高杠杆25倍
-
8
伊朗里亚尔兑美元汇率跌至200万里亚尔兑1美元的历史新低,导致生活必需品价格上涨逾70%
-
9
ENJ恩金币:深度解析其区块链游戏生态与投资前景
-
10
Cryptex Finance(CTX币)交易平台与项目解析
今日行情
推荐阅读








