HeadlinesBriefing favicon HeadlinesBriefing.com

Затраты на ИИ падают: модели стоят на порядки дешевле каждый год

Hacker News •
×

Стоимость использования интеллекта машинного обучения снижается на несколько порядков величины каждый год, без признаков замедления. Ожидается, что LLM станут повсеместной инфраструктурой, работающей локально на стандартном оборудовании в течение 3‑6 лет. Доказательства включают проприетарные модели вроде GPT‑6 Astra и модели с открытыми весами вроде GLM‑5.3‑flash, а также локальные модели вроде Muse Glimmer и Qwen3 Coder. Энергоэффективность GPU следует логарифмической кривой, удваиваясь примерно каждые два года — сравнимо с историческими приростами закона Мура. Ценообразование моделей по токенам, но стоимость на уровне задачи падает резко; парето-граница в 2026 году показывает модели от дешевых, менее умных вариантов до дорогих, высокопроизводительных. Движки вывода быстро улучшаются, давая 10‑50% прироста в год. По мере того как стоимость токенов становится пренебрежимо малой, качество и доступ становятся новыми ограничивающими факторами для внедрения ИИ.