Svmuu訊 智譜面向部分企業客户推出 GLM-5.1 高速版 API,其模型輸出速度達到 400 tokens/s,刷新全球大模型官方介面端到端速度紀錄。
據瞭解,該高速版在保留原有旗艦模型能力基礎上,由智譜與 TileRT 團隊聯合研發的高性能推理引擎驅動。該引擎透過重構 GPU 運行排程機制,將模型靜態編排為常駐 GPU 的 persistent Engine Kernel,以降低傳統推理中的核心啟動與顯存讀寫延遲。
在多卡場景下,TileRT 進一步將 8 卡 NVL 拓撲中的 GPU 節點特化為不同功能 Worker,以提升注意力層計算與跨卡通訊效率。
目前,該高速版服務已向智譜 MaaS 平台部分企業客户開放。未來將繼續優化 FP8 推理及超長上下文能力,面向 AI 程式設計、即時互動與即時語音等低延遲場景提供支援。
24小時熱榜
-
1
Uniswap去中心化交易所何時上線?其起源與核心機制解析
-
2
SPURDO代幣發行量與流通量解析:多版本數據並存
-
3
HTX(原火幣)平台概覽與正規比特幣交易及錢包軟件推薦
-
4
全球主流加密貨幣行情軟件與交易平台盤點
-
5
WAIFER幣項目解析:市場表現與投資考量
-
6
回顧2021年:影響比特幣價格波動的五大關鍵因素
-
7
美聯儲維持利率不變,10年美債收益率跳水,黃金拉昇超1.2%,納指轉漲
-
8
CTR幣是什麼?Citrea (CTR) 代幣解析與交易平台指南
-
9
嘉能可預計上半年交易利潤達33億美元,伊朗戰爭加劇油市波動提供助力
-
10
伊朗拒絕了阿曼關於共同監管霍爾木茲海峽的提議,並警告稱,如果其航運路線計劃未獲採納,將關閉該海峽
今日行情
推薦閱讀









