Un acelerador de IA de código abierto, desarrollado por IA. open TPU trae las lecciones de auto-arch-tournament a los aceleradores de IA. Hace dos preguntas: ¿hasta dónde pueden llegar los agentes de IA en el diseño de hardware, y pueden construir el chip que ejecute su propia inferencia?
open TPU también es un proyecto de aprendizaje. Todo el acelerador vive en un pequeño monorepo que se puede leer de principio a fin: el diseño de hardware (System Verilog), el conjunto de instrucciones, un simulador bit-exacto, un lenguaje de kernel y su compilador, y el software host que impulsa una tarjeta PCIe real.
El diseño ejecuta diez modelos modernos con sus pesos reales en una tarjeta Inspur YPCB-00338 (Xilinx Kintex-7 xc7k480t, dos canales DDR3), y la tarjeta produce los mismos tokens que el simulador, bit por bit. Medido en la tarjeta: los primeros tres modelos el 2026-09-29 con la imagen de producción deploy_champ_e698dcd7. Build B decodifica LFM2-2.6B, Smol LM3 y Phi-4-mini 8-9% más rápido que e698dcd7, al 91-94% del pico de DRAM.
Fuente: Hacker News · Resumido por HeadlinesBriefing