英伟达Groq 3 LPX已全面投产,并扩展Vera Rubin NVL72系统,旨在为代理式AI系统提供快速token生成。在Gemma 4 31B基准测试中,Groq 3 LPX在10万token长上下文用例中实现每秒3400个输出token,比最接近的替代平台快4倍。Nebius是首个采用Groq 3 LPX的AI云,SpaceXAI将采用英伟达Vera CPU,CoreWeave也已部署Spectrum-X Multiplane。