HeadlinesBriefing favicon HeadlinesBriefing.com

Akselerator AI NVIDIA Rubin CPX dengan Memori HBM4

TechPowerUp News •
×

NVIDIA menghidupkan kembali proyek akselerator AI Rubin CPX, sekarang dengan memori HBM4 menggantikan GDDR7 yang sebelumnya direncanakan. Analis rantai pasokan terkenal Ming Chi Kuo melaporkan redesign, mencatat bahwa Rubin CPX sebelumnya dihentikan setelah NVIDIA mengumumkan rencananya untuk akselerator khusus yang berasal dari keluarga GPU Rubin untuk beban AI agentic skala besar. Rubin CPX yang redesign memiliki 168 GB memori HBM4, peningkatan dari rencana asli 128 GB GDDR7.

SKU GPU ini dipasang di rak terpisah dengan konfigurasi mulai dari 64 hingga 256 GPU CPX mandiri per rak. GPU ini dikhususkan untuk beban prefill, menggerakkan rak yang mengelola konteks masukan untuk LLM dan pemrosesan cache KV. NVIDIA memisahkan prefill dari decode, dengan GPU CPX menangani prefill dan GPU Rubin biasa mengelola decode.

Satu rak tray dengan delapan GPU CPX dapat menangani 1,34 TB prefill konteks panjang dan cache KV terkait. Karena desain sebelumnya tidak membutuhkan integrasi HBM4, NVIDIA merancang ulang paket, kemungkinan menggunakan Co Wo S-S atau Co Wo S-L dari TSMC untuk kemasan. Chip ini menghasilkan 30 Peta FLOPS kinerja komputasi NVFP4 pada die monolitik.

Ia mencakup empat NVENC dan empat NVDEC encoder video terintegrasi langsung di chip. Untuk LLM yang sekarang berisi triliunan parameter, memiliki rak khusus untuk prefill sementara yang lain menangani decode memungkinkan pengiriman token yang jauh lebih cepat. NVIDIA juga merekomendasikan untuk mempertahankan rasio 1:1 antara GPU CPX dan GPU biasa di rak decode.