HeadlinesBriefing favicon HeadlinesBriefing.com

2026年推論ハードウェア革命:AIの学習から推論へ

Hacker News •
×

TensordyneのNapierチップは、AI推論を加速するように設計されています。2020年頃から、AIは主により大きく、より良いモデルを学習することに集中してきました。大規模言語モデル(LLM)は、数百万パラメータからトリリオンまで膨らんでいました。これは有効であることが証明されています。Open AIのGPT-3の最大バージョンは2020年に公開され、ある人気のある知識と推論のベンチマークで質問の43.9%のみに正しく回答しました。仅仅4年後、GPT-4oは同じ試験で88.7%のスコアを達成し、実質的に人間の専門家と同等の成績を収めました。先進的なAIラボは、依然としてより大きなモデルを学習続けてますが、その学習はAI会話の背景に少し後退してきました。2026年には、推論——学習済みモデルを使用してコード、エッセイ、または自分自身をエルフとしての画像を生成する——が前面に登場しています。

「学習は昨日のニュースのようだ」と、Moor Insights & Strategyの首席データセンターアナリストのマット・キムボールは言います。「すべてのCIOが話したいのは推論だけだ」。NvidiaのCEOであるジェンスン・フアンは、会社のGTC 2026会議でこの変化を「推論の折れ点」と称賛しました。

このシフトを引き起こした原因の一部は非常に簡単です。LLMが有用になりつつあるので、人々はそれを使用しています。さらに、現在市場にある多くのモデルは推論モデルです。ユーザーのクエリに応えて、これらは推論を1回ではなく複数回実行し、「連鎖思考」と呼ばれるプロセスで自分自身を再プロンプトします。推論モデルは長い出力を生成し、高い推論努力を要するモデルは、努力が低いかなしのモデルの20倍ものテキストを生成できます。

結果として生じる推論需要の爆発は、テック巨匠たちの間で予期せぬ連合を生み出しました。Open AIとAmazonは、Cerebrasが設計したディナー皿サイズのチップを展開しました(Amazonは自社のTrainiumチップを持っています)。Nvidiaは、200億米ドルの契約で、AI推論スタートアップのGroqから主要な人材と知的財産を買収しました。そしてAnthropicは、LLM競合Space XAIから月額10億ドル以上を支払い、余剰コンピューティングをレンタルしています。

主要エンティティ:企業:Tensordyne, Open AI, Nvidia, Amazon Web Services, Cerebras, Moor Insights & Strategy, Space XAI, Anthropic, Groq | 人物:マット・キムボール, ジェンスン・フアン