HeadlinesBriefing favicon HeadlinesBriefing.com

AMDマトリックスコアの正確なモデル

Hacker News •
×

最近のGPU上の行列乗算器はIEEE 754に準拠しておらず、ベンダーやアーキテクチャ間でアキュムレータ幅、丸め、正規化、非正規数、特殊入力に違いがあります。これにより、ソフトウェアによるデバイス間の再現性が妨げられます。

実装の詳細は文書化されておらず、不一致の解釈が複雑になっています。研究者は、MI100MI210/250MI300A/300X GPUを使用して、3つのAMD GPUアーキテクチャ(CDNA 1CDNA 2CDNA 3)にわたる数値挙動を特徴付けています。

テストベクトルは、サポートされているすべての入力形式の数値的特徴を対象とし、導出が提供されています。各アーキテクチャ用にMATLABベースのソフトウェアモデルが開発され、1000万のランダム化されたテストセットを使用してハードウェアに対するビットレベルの再現性が検証されています。以前に開発された反復改良技術により、モデルの精度が保証されます。

概念実証として、モデルは2つの数値アプリケーションで使用され、AMDマトリックスコアとNVIDIAテンソルコア間のアプリケーションレベルの精度差を定量化します。

主要エンティティ:企業:AMD、NVIDIA | 人物:Faizan Ahmad Khattak

FAQ:なぜ小さな行列乗算器の結果はAMD GPU間で再現できないのですか?

最近のGPU上の行列乗算器はIEEE 754に準拠しておらず、アキュムレータ幅、丸め、非正規数の処理などの機能がベンダーやアーキテクチャ間で異なるため、ソフトウェア制御の再現性が不可能になります。