HeadlinesBriefing favicon HeadlinesBriefing.com

AI 成本大幅下降:模型费用每年降几个数量级

Hacker News •
×

使用机器学习智能的成本每年下降几个数量级,且没有放缓迹象。预计大语言模型将成为无处不在的基础设施,在 3 到 6 年内可在商品级硬件上本地运行。证据包括专有模型如 GPT‑6 Astra 和开放权重模型如 GLM‑5.3‑flash,以及本地模型如 Muse GlimmerQwen3 Coder。GPU 能效遵循对数曲线,大约每两年翻一番——类似于历史上的 Moore's Law 增益。模型定价按 Token 计费,但任务级成本正急剧下降;2026 年的帕累托前沿显示模型从廉价、智能较低的选项跨越到昂贵、高性能的选项。推理引擎正在快速改进,每年带来 10% 到 50% 的增益。随着 Token 成本变得可忽略不计,质量和获取正成为 AI 采用的新限制因素。