Svmuu訊 OpenAI 工程團隊近期向部分同事透露,公司已找到一種新的系統優化方法,可將 AI 模型“推理(inference)”成本降低一半以上推理成本指模型在實際運行與響應用户請求時所消耗的計算資源成本。此次優化主要來自對現有服務器資源利用效率的提升,而非依賴新增算力芯片投入,這一進展反映出 AI 公司在持續爭奪算力資源的同時,也在通過軟件與系統層優化提升現有基礎設施的使用效率,以緩解快速增長的模型運行成本壓力。(The Information)