AI从实验转向生产时,容量投资比按量消费更经济
先了解这件事
2026-09-29,Futum 与 HPE 先后指出:当 AI 任务稳定且关键时,纯按 token 计费难以预测,建议企业评估自有容量。Futum 报告显示智能体 AI 单任务 token 消耗可达简单推理的 10–100 倍,预计全球推理支出由 2025 年 1200 亿美元增至 2030 年 8850 亿美元;66% 的 AI 计算已由预留和自有基础设施承担,仅 19% 为按需公有云。报告建议按任务而非 token 计量,并在利用率超约 60% 时转向预留裸金属,同时承认需具备相应工程能力。HPE 强调利用率跨过临界点后,自有容量单位成本更低、可预测性更强。2026-09-30,Greenpixie 在 arXiv 提出一种评估开放权重与闭源模型每 Token 能耗的方法论,区分 prefill 与 decode,并用贝叶斯线性回归建模能耗与模型规模、请求流量及硬件部署的关系。
AI 根据报道生成 · 2 小时前更新
事件进展
- 9月30日 12:00 · 1 篇报道Greenpixie提出AI token能耗与碳排放估算方法arXiv · Computers and Society:Greenpixie 的 AI Token 能耗方法论:评估开放权重与闭源模型每 Token 的能源、水和 CO₂ 排放影响
- 9月29日 18:43 · 1 篇报道AI从实验转向生产时,容量投资比按量消费更经济MIT Technology Review · AI:HPE:如何让 AI 从消耗型支出转变为可优化的资产
- 9月29日 04:46 · 1 篇报道Agentic AI推高token消耗,企业需制定定价与基础设施策略SiliconANGLE · AI:Agentic AI 打破 token 计费meter,企业需要制定后续计划
报道时间线
沿着报道,了解事件的不同侧面。
- arXiv · Computers and SocietyGreenpixie 的 AI Token 能耗方法论:评估开放权重与闭源模型每 Token 的能源、水和 CO₂ 排放影响
Greenpixie 提出一种估算云端大语言模型每 Token 能耗的方法论,区分输入(prefill)与输出(decode)Token 的能耗,并用贝叶斯线性回归建模能耗与模型规模、请求流量及硬件部署配置的关系。
- MIT Technology Review · AIHPE:如何让 AI 从消耗型支出转变为可优化的资产
summary_zh: HPE 指出,当 AI 需求稳定且业务关键时,纯按 token 计费会变得难以预测,企业应评估是否改用自有容量。当利用率跨过临界点,自有容量的单位成本更低、可预测性更强。
- SiliconANGLE · AIAgentic AI 打破 token 计费meter,企业需要制定后续计划
Futum 报告指出智能体 AI 每任务 token 消耗可达简单推理的 10–100 倍,预计 2025 年推理支出 1200 亿美元增至 2030 年 8850 亿美元。调查显示 66% 的 AI 计算由预留和自有基础设施承担,仅 19% 为按需公有云。报告建议按任务而非 token 计量成本,并在利用率超过约 60% 时转向预留裸金属,同时承认这需要企业具备工程能力。
本事件热度走势
当前热度 17·可比范围峰值 17(9月30日 17:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。