智谱AI发布新模型GLM-5.3-Flash,称其推理服务由超10万张国产芯片承载,效率媲美英伟达GPU,SemiAnalysis:英伟达护城河再受考验
智谱AI于8月26日正式确认,此前匿名测试的模型Ox Alpha(中文社区称“牛来”)即为最新发布的GLM-5.3-Flash。该模型在免费测试期间5天内累计流量超50万亿token,刷新平台纪录。智谱AI披露,其推理服务全部由超过10万张国产芯片集群承载,硬件效率及单token成本已达到与主流英伟达GPU相当的水平。半导体研究机构SemiAnalysis对此评论称,继OpenAI自研推理芯片Jalapeño之后,英伟达的CUDA护城河再度受到考验。GLM-5.3-Flash的定价为每百万token输入0.8元、输出2.8元,约为Anthropic的Claude Opus 4.8的1/40,旨在应对中国AI模型市场近期出现的涨价潮。
暂无AI深度解读,点击上方「AI解读」按钮,即刻生成一份全新解读
免责声明:本内容仅代表作者个人观点,不构成任何投资理财建议。
24小时热榜
-
1
韩国实体AI热潮:机器人咖啡师与K-pop舞者引领潮流
-
2
高盛策略师:预计AI资本开支增速将在2027年放缓,届时盈利增速将从30%减速
-
3
USDT泰达币:钱包地址查询与官方钱包使用指南
-
4
2GIVE币现状解析:市场活跃度极低,投资前景受质疑
-
5
AltLayer (ALT) 项目解析与现状
-
6
恩玖币(NGOT)解析:定位、总量与市场现状
-
7
GXC币已转型为REI Network:交易现状与REI代币买卖指南
-
8
伦敦铜期货周五收报14622美元/吨,接近历史高点;瑞银重申看涨,摩根大通警告智利铜矿罢工恐致减产
-
9
CIRQ币解析:Cirquity代币与量子计算框架的辨析
-
10
TFUEL怎么样?TFUEL未来发展前景如何?
今日行情
推荐阅读









