HeadlinesBriefing favicon HeadlinesBriefing.com

Occidente adopta avances chinos de IA

Hacker News •
×

Si lees los titulares de noticias estos días, se te perdonaría pensar que los laboratorios occidentales están siendo superados en masa por los laboratorios chinos. No pasa una semana sin que Anthropic publique otro artículo sobre cómo los chinos están destilando sus modelos, convirtiéndose en un peligro para la humanidad misma. Les beneficia decir eso porque sienta las bases para que estos modelos sean restringidos legal y regulatoria mente más adelante. Pero los días de la destilación sin sentido han terminado. El nuevo juego en la ciudad es adoptar los avances de los laboratorios chinos.

El último copiado descaradamente sin reconocimiento es el avance en las optimizaciones de caché KV que Deep Seek ha compartido generosamente. Redujo la huella de caché KV para ciertos casos de uso en un factor de aproximadamente 437x en comparación con Deep Seek-V1. El último Deep Seek-V4.1-Flash lo lleva aún más lejos con CSA2, reutilización de caché entre capas, una arquitectura codificador-decodificador causal y almacenamiento en caché FP4, reduciendo el caché KV global a 890 bytes por token.

Todo esto debe significar que las empresas occidentales de IA ahora son extremadamente positivas en el margen de inferencia. Las restricciones en el acceso a GPU avanzadas obligaron a los laboratorios chinos a hacer de la optimización del rendimiento un objetivo número uno. Ahora tanto Anthropic como Open AI lanzaron modelos que utilizan estas optimizaciones. Los costos de lectura de caché cayeron bruscamente: Opus 5.5 redujo el precio de lectura de caché en un 60% en comparación con Opus 5, mientras que GPT-6.1 Sol lo redujo en un 80% en comparación con el precio de finales de julio de GPT-5.6 Sol.