跳到正文
原文
Together AI·· 2026-02-12精选AI 评分62

Together AI 推出 Dedicated Container Inference,定制模型推理速度最高提升 2.6 倍

Introducing Dedicated Container Inference: Delivering 2.6x faster inference for custom AI models

AI 导读

Together AI 发布 Dedicated Container Inference,支持用户以 Docker 容器方式部署自定义生成式媒体模型,并由平台负责自动扩缩容、队列、流量隔离与监控。客户实测视频生成等任务推理速度提升 1.4–2.6 倍;在 Together GPU Cloud 训练的模型可直接部署,无需传输产物。

推荐理由

原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

来源:Together AI · together.ai