Skip to content
SiliconANGLE · AI· Jonathan Anthony·· 3 hr agoAI score39

CoreWeave 以全栈优化瞄准 AI 推理瓶颈

CoreWeave targets AI inference bottlenecks with full-stack optimization

AI brief

CoreWeave 推出 CoreWeave Forge 平台,整合服务、可观测性、后训练与评估,并发布基于 Nvidia Dynamo 框架的预览能力 CoreWeave RL Rollouts。测试显示该能力将模型重载延迟较基线提升 15x;Forge 免费起步,付费层级提供更多能力,面向个人开发者开放。CoreWeave 还从 vLLM 引擎、量化模型到自研投机解码器逐层调优推理栈。

Source: SiliconANGLE · AI · siliconangle.com