HeadlinesBriefing favicon HeadlinesBriefing.com

Westen übernimmt chinesische KI-Fortschritte

Hacker News •
×

Wenn Sie heutzutage die Schlagzeilen lesen, kann man Ihnen verzeihen, wenn Sie denken, dass die westlichen Labore von den chinesischen Laboren massenhaft überrannt werden. Es vergeht keine Woche, in der Anthropic nicht einen weiteren Artikel darüber veröffentlicht, wie die Chinesen ihre Modelle destillieren und zu einer Gefahr für die Menschheit selbst werden. Es ist vorteilhaft für sie, das zu sagen, weil es die Grundlage dafür schafft, dass diese Modelle später rechtlich und regulatorisch eingeschränkt werden. Aber die Tage des gedankenlosen Destillierens sind vorbei. Das neue Spiel in der Stadt ist die Übernahme der Fortschritte chinesischer Labore.

Der neueste, schamlos ohne Anerkennung kopierte Durchbruch ist die Optimierung des KV-Cache, die Deep Seek großzügig geteilt hat. Sie reduzierte den KV-Cache-Fußabdruck für bestimmte Anwendungsfälle um einen Faktor von etwa 437x im Vergleich zu Deep Seek-V1. Das neueste Deep Seek-V4.1-Flash treibt dies mit CSA2, Cross-Layer-Cache-Wiederverwendung, einer kausalen Encoder-Decoder-Architektur und FP4-Caching noch weiter und reduziert den globalen KV-Cache auf 890 Bytes pro Token.

All dies muss bedeuten, dass die westlichen KI-Unternehmen jetzt extrem inferenzmargenpositiv sind. Die Beschränkungen beim Zugang zu fortschrittlichen GPUs zwangen chinesische Labore, die Leistungsoptimierung zum Ziel Nummer eins zu machen. Jetzt haben sowohl Anthropic als auch Open AI Modelle veröffentlicht, die diese Optimierungen nutzen. Die Cache-Lesekosten sind drastisch gesunken: Opus 5.5 senkte die Cache-Lesepreise um 60% gegenüber Opus 5, während GPT-6.1 Sol sie um 80% gegenüber den Preisen von Ende Juli von GPT-5.6 Sol senkte.