HeadlinesBriefing favicon HeadlinesBriefing.com

Ocidente adota avanços chineses em IA

Hacker News •
×

Se você lê as manchetes de notícias hoje em dia, seria perdoado por pensar que os laboratórios ocidentais estão sendo dominados em massa pelos laboratórios chineses. Não passa uma semana sem que a Anthropic publique outro artigo sobre como os chineses estão destilando seus modelos, tornando-se um perigo para a própria humanidade. É benéfico para eles dizerem isso porque estabelece as bases para que esses modelos sejam restringidos legal e regulatoriamente mais tarde. Mas os dias de destilação sem sentido acabaram. O novo jogo na cidade é adotar os avanços dos laboratórios chineses.

O mais recente copiado descaradamente sem reconhecimento é o avanço nas otimizações de cache KV que a Deep Seek compartilhou generosamente. Ele reduziu a pegada do cache KV para certos casos de uso por um fator de aproximadamente 437x em comparação com o Deep Seek-V1. O mais recente Deep Seek-V4.1-Flash leva isso ainda mais longe com CSA2, reutilização de cache entre camadas, uma arquitetura codificador-decodificador causal e cache FP4, reduzindo o cache KV global para 890 bytes por token.

Tudo isso deve significar que as empresas ocidentais de IA agora são extremamente positivas em margem de inferência. As restrições ao acesso a GPUs avançadas forçaram os laboratórios chineses a tornar a otimização de desempenho uma meta número um. Agora, tanto a Anthropic quanto a Open AI lançaram modelos usando essas otimizações. Os custos de leitura de cache caíram drasticamente: o Opus 5.5 reduziu o preço de leitura de cache em 60% em comparação com o Opus 5, enquanto o GPT-6.1 Sol o reduziu em 80% em comparação com o preço do final de julho do GPT-5.6 Sol.