HeadlinesBriefing favicon HeadlinesBriefing.com

La Chine mène les téléchargements de poids IA

Hacker News •
×

J'ai récemment été invité à présenter aux membres du Congrès américain sur l'état des modèles de poids ouverts dans la concurrence États-Unis-Chine. Les modèles de langage ouverts offrent des poids publiquement disponibles pour l'inspection ou l'utilisation en aval, contrairement aux modèles fermés accessibles via des API comme GPT-4 ou Claude Opus 4.5. Les modèles de poids ouverts, tels que Llama de Meta, Qwen d'Alibaba, Gemma de Google et les modèles de Deep Seek, sont régis par des licences et incluent souvent du code d'inférence.

Depuis avril 2025, les entreprises chinoises d'IA dirigent les modèles de poids ouverts. Les modèles open source authentiques incluent les poids, les licences, le code d'inférence, le code d'entraînement et les données d'entraînement, avec des exemples notables d'organisations sans but lucratif américaines comme Olmo de l'Allen Institute, Marin d'Open Athena et Pythia d'Eleuther AI. Les modèles ouverts et fermés existent sur un spectre ; les publications de Nvidia Nemotron incluent des données d'entraînement mais pas toutes les données, tandis que les modèles fermés varient dans la transparence de l'API.

Les modèles chinois tels que GLM-5.2 et Kimi K3 ont atteint la viabilité commerciale et des capacités d'agent comparables à celles d'Anthropic Claude Code. Les États-Unis ont d'abord mené via Llama de Meta, mais les modèles chinois de poids ouverts ont surpassé leurs homologues américains dans les domaines clés il y a 18 mois. Les téléchargements Hugging Face montrent que la Chine mène depuis juillet 2025, entraînée par Alibaba Qwen, avec un avantage de 1,6 milliard de téléchargements sur un total de 3,2 milliards—deux fois celui des États-Unis.

Sur l'Artificial Analysis Intelligence Index (AAII), les modèles chinois principaux au 14 septembre 2026 sont GLM-5.3 de Z.ai (45), GLM-5.3-Flash (42) et Kimi K3 de Moonshot AI (44). Les modèles américains leaders—Inkling et Inkling Small de Thinking Machines (chacun 26) et Nemotron 3 Ultra de Nvidia (23)—retardent leurs homologues chinois, publiés moins fréquemment et mis à jour plus tard.