HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5:より速く安いAIモデル

Hacker News •
×

Mercury 2.5はInceptionの最新AIモデルであり、Mercury 2と比較して大幅な品質向上を提供しながら、同じ低遅延・低コストのプロファイルを維持しています。現在、市場で最大の拡散言語モデルであり、知能が40%向上し、NVIDIA GPU上で毎秒1,107トークンの速度を実現しています。このモデルは260Kのコンテキストウィンドウをサポートし、入力トークン100万個あたり$0.20、出力トークン100万個あたり$0.75で価格設定されており、80%のローンチ割引が適用されます。

実際の展開では劇的な改善が見られます。音声AI企業のOpen Callは、応答遅延を数分からわずか1秒(P99)に短縮し、Augment Codeはコーディングエージェントの遅延を82%、コストを90%削減しました。これらの結果は、Mercury 2.5が複雑な多段階タスクを効率的に処理できることを強調しています。

モデルに加えて、InceptionはMercury VoiceとMercury Routerをプレビューしています。Mercury Voiceは、170ms未満の最初のトークンまでの時間を最適化し、音声エージェントに最適です。Mercury Routerは、品質、速度、コストに基づいてプロンプトを最適なモデルにインテリジェントにルーティングし、あらゆるワークロードで最適なパフォーマンスを保証します。

Mercury 2.5は現在、Inception API、Baseten、Open Routerを通じて利用可能です。企業向けには、Inceptionは専用デプロイ、自動スケーリング、コンプライアンス管理を提供します。速度、知能、手頃な価格の組み合わせにより、Mercury 2.5は次世代のAIアプリケーションを支える準備ができています。

主要エンティティ:企業:Inception、Open Call、Augment Code、NVIDIA | 人物:Oliver Silverstein