Un accélérateur IA open source, développé par IA. open TPU apporte les leçons de auto-arch-tournament aux accélérateurs IA. Il pose deux questions : jusqu'où les agents IA peuvent-ils aller dans la conception matérielle, et peuvent-ils construire la puce qui exécute leur propre inférence ?
open TPU est aussi un projet d'apprentissage. Tout l'accélérateur vit dans un petit monorepo que vous pouvez lire de bout en bout : la conception matérielle (System Verilog), le jeu d'instructions, un simulateur bit-exact, un langage de noyau et son compilateur, et le logiciel hôte qui pilote une vraie carte PCIe.
La conception exécute dix modèles modernes avec leurs poids réels sur une carte Inspur YPCB-00338 (Xilinx Kintex-7 xc7k480t, deux canaux DDR3), et la carte produit les mêmes jetons que le simulateur, bit pour bit. Mesuré sur la carte : les trois premiers modèles le 2026-09-29 avec l'image de production deploy_champ_e698dcd7. Build B décode LFM2-2.6B, Smol LM3 et Phi-4-mini 8 à 9 % plus rapidement que e698dcd7, à 91-94 % du pic DRAM.
Source: Hacker News · Résumé par HeadlinesBriefing