HeadlinesBriefing favicon HeadlinesBriefing.com

Китай лидирует в загрузках AI весов

Hacker News •
×

Меня недавно пригласили представить членам Конгресса США о состоянии открытых моделей весов в конкуренции США-Китай. Открытые языковые модели предоставляют публично доступные веса для проверки или последующего использования, в отличие от закрытых моделей, получаемых через API, такие как GPT-4 или Claude Opus 4.5. Открытые модели с весами, такие как Llama от Meta, Qwen от Alibaba, Gemma от Google и модели Deep Seek, регулируются лицензиями и часто включают код инференса. С апреля 2025 года китайские компании ИИ лидируют в открытых моделях весов. Настоящие открытые модели кода включают веса, лицензии, код инференса, код обучения и обучающие данные, с яркими примерами из американских некоммерческих организаций, таких как Olmo от Allen Institute, Marin от Open Athena и Pythia от Eleuther AI. Открытые и закрытые модели существуют на спектре; релизы Nvidia Nemotron включают обучающие данные, но не все данные, тогда как закрытые модели различаются по прозрачности API. Китайские модели, такие как GLM-5.2 и Kimi K3, достигли коммерческой жизнеспособности и агентных возможностей, сравнимых с возможностями Claude Code от Anthropic. США первоначально лидировали через Llama от Meta, но открытые модели китайских весов превзошли американских аналогов в ключевых областях 18 месяцев назад. Загрузки Hugging Face показывают, что Китай лидирует с июля 2025 года, движимый Alibaba Qwen, с преимуществом в 1,6 миллиарда загрузок из общей суммы 3,2 миллиарда—вдвое больше, чем у США. На индексе искусственного интеллекта от Artificial Analysis (AAII) топ-модели Китая по 14 сентября 2026 года — это GLM-5.3 от Z.ai (45), GLM-5.3-Flash (42) и Kimi K3 от Moonshot AI (44). Ведущие американские модели — Inkling и Inkling Small от Thinking Machines (по 26 каждая) и Nemotron 3 Ultra от Nvidia (23) — отстают от китайских аналогов, выпускаются реже и обновляются позже, чем китайские аналоги.