HeadlinesBriefing favicon HeadlinesBriefing.com

L'Occident adopte les avancées chinoises en IA

Hacker News •
×

Si vous lisez les gros titres de l'actualité ces jours-ci, on vous pardonnerait de penser que les laboratoires occidentaux se font dominer en masse par les laboratoires chinois. Il ne se passe pas une semaine sans qu'Anthropic ne publie un autre article sur la façon dont les Chinois distillent leurs modèles, devenant un danger pour l'humanité elle-même. Il est avantageux pour eux de dire cela car cela prépare le terrain pour que ces modèles soient restreints légalement et réglementairement plus tard. Mais les jours de distillation aveugle sont révolus. Le nouveau jeu en ville est d'adopter les avancées des laboratoires chinois.

La dernière avancée copiée sans vergogne sans reconnaissance est la percée dans les optimisations du cache KV que Deep Seek a généreusement partagée. Elle a réduit l'empreinte du cache KV pour certains cas d'utilisation d'un facteur d'environ 437x par rapport à Deep Seek-V1. Le dernier Deep Seek-V4.1-Flash va encore plus loin avec CSA2, la réutilisation du cache entre couches, une architecture encodeur-décodeur causale et la mise en cache FP4, réduisant le cache KV global à 890 octets par token.

Tout cela doit signifier que les entreprises occidentales d'IA sont désormais extrêmement positives en termes de marge d'inférence. Les contraintes d'accès aux GPU avancés ont forcé les laboratoires chinois à faire de l'optimisation des performances un objectif numéro un. Maintenant, Anthropic et Open AI ont tous deux publié des modèles utilisant ces optimisations. Les coûts de lecture du cache ont chuté fortement : Opus 5.5 a réduit le prix de lecture du cache de 60% par rapport à Opus 5, tandis que GPT-6.1 Sol l'a réduit de 80% par rapport au prix de fin juillet de GPT-5.6 Sol.