HeadlinesBriefing favicon HeadlinesBriefing.com

Запад перенимает китайские достижения в ИИ

Hacker News •
×

Если вы читаете заголовки новостей в эти дни, вас можно простить за то, что вы думаете, что западные лаборатории массово проигрывают китайским лабораториям. Не проходит и недели, чтобы Anthropic не опубликовал очередную статью о том, как китайцы дистиллируют их модели, становясь угрозой для самого человечества. Им выгодно так говорить, потому что это создает основу для того, чтобы эти модели были ограничены юридически и нормативно позже. Но дни бессмысленной дистилляции прошли. Новая игра в городе — перенимать достижения китайских лабораторий.

Последнее, что было бесстыдно скопировано без признания, — это прорыв в оптимизации KV-кэша, которым Deep Seek щедро поделился. Он уменьшил занимаемую площадь KV-кэша для определенных случаев использования примерно в 437 раз по сравнению с Deep Seek-V1. Последний Deep Seek-V4.1-Flash продвигает это еще дальше с CSA2, повторным использованием кэша между слоями, причинной архитектурой кодировщик-декодировщик и кэшированием FP4, сокращая глобальный KV-кэш до 890 байт на токен.

Все это должно означать, что западные компании ИИ теперь чрезвычайно положительны по марже вывода. Ограничения на доступ к продвинутым GPU вынудили китайские лаборатории сделать оптимизацию производительности целью номер один. Теперь и Anthropic, и Open AI выпустили модели, использующие эти оптимизации. Затраты на чтение кэша резко упали: Opus 5.5 снизил цены на чтение кэша на 60% по сравнению с Opus 5, в то время как GPT-6.1 Sol снизил их на 80% по сравнению с ценами конца июля GPT-5.6 Sol.