HeadlinesBriefing favicon HeadlinesBriefing.com

China Jaya dalam Unduhan Berat AI

Hacker News •
×

Saya baru saja diajak memberikan briefing kepada anggota Kongres Amerika Serikat tentang kondisi model berat terbuka dalam kompetisi AS-China. Model bahasa terbuka menyediakan bobot yang tersedia publik untuk inspeksi atau penggunaan downstream, berbeda dengan model tertutup yang diakses melalui API seperti GPT-4 atau Claude Opus 4.5. Model berat terbuka seperti Llama Meta, Qwen Alibaba, Gemma Google, dan model Deep Seek, dikendalikan oleh lisensi dan sering kali mencakup kode inferensi.

Sejak April 2025, perusahaan AI China telah memimpin dalam model berat terbuka. Model sumber terbuka yang benar mencakup bobot, lisensi, kode inferensi, kode pelatihan, dan data pelatihan, dengan contoh contoh kemunculan dari organisasi non-profit AS seperti Olmo dari Allen Institute, Marin dari Open Athena, dan Pythia dari Eleuther AI. Model terbuka dan tertutup ada dalam spektrum; rilis Nvidia Nemotron mencakup data pelatihan tetapi tidak semua data, sementara model tertutup bervariasi dalam transparansi API.

Model China seperti GLM-5.2 dan Kimi K3 telah mencapai kelayakan komersial dan kemampuan agen yang seband dengan Claude Code dari Anthropic. Amerika Serikat memimpin awal melalui Llama Meta, tetapi model berat terbuka China melewati rekan AS dalam area kunci 18 bulan yang lalu. Unduhan Hugging Face menunjukkan China memimpin sejak Juli 2025, didorong oleh Alibaba Qwen, dengan keunggulan 1,6 miliar unduhan dari total 3,2 miliar—lebih dari dua kali AS.

Pada Artificial Analysis Intelligence Index (AAII), model China teratas pada 14 September 2026 adalah GLM-5.3 Z.ai (45), GLM-5.3-Flash (42), dan Kimi K3 Moonshot AI (44). Model AS yang terkemuka—Inkling dan Inkling Small dari Thinking Machines (masing-masing 26) dan Nemotron 3 Ultra dari Nvidia (23)—tertinggal dari rekan China, dirilis lebih jarang dan diperbarui lebih lambat daripada rekan China.