HeadlinesBriefing favicon HeadlinesBriefing.com

Claude Sonnet 5.5:高速・低コストAI

Hacker News •
×

Claude Sonnet 5.5を紹介します。これはClaude 5.5ファミリーの2番目のモデルです。Claude Sonnet 5からの明確なアップグレードであり、30%+ 高速に動作し、ほとんどの作業で最大 30% 低コストです。Sonnet 5.5は、Claude Opus 5.5のより高速で低コストな補完モデルです。Opus 5.5が慎重な判断を必要とする複雑な作業向けに構築されているのに対し、Sonnet 5.5は明確に定義された日常的なタスク、バグ修正、洗練されたドキュメント、スライド、スプレッドシートの作成に最も優れています。また、デザインに対する鋭い目も備えています。Claude Haiku 5.5は数週間以内にファミリーに加わります。

Sonnet 5.5はパフォーマンスにおいてSonnet 5を上回り、エージェンティックコーディング評価であるTerminal-Bench 4.0で 70.6% をスコアリングしました(Sonnet 5は 10.3%)。GDPval-AAではOpus 5.5より2ポイント低いスコアです。長期的な作業と画像理解に強く、スクリーンショットのみでPokémon Redを倒した初のSonnetモデルです。以前のモデルよりも明確に記述でき、初期テスターはSonnet 5よりもコラボレーションのための優れたパートナーであると述べています。

Sonnet 5.5の価格はSonnet 5と同じで、入力トークン100万あたり2ドル、出力トークン100万あたり10ドル、キャッシュ読み取りトークン100万あたり0.20ドルですが、通常ははるかに少ないトークンで済みます。タスクあたりのコストは最大30%低く、出力生成は30%+高速です。自動化された行動監査では、Sonnet 5.5はアライメントにおいてSonnet 5を改善するか、同等です。サイバーセーフガードとフォールバックを備えてリリースされた初のSonnetモデルであり、生物学セーフガードは変更されていません。

いくつかのベンチマークでは、Sonnet 5.5は低または中程度の努力で、タスクあたりのコストが約10分の1でSonnet 5の最高スコアを上回ります。低い努力設定でOpus 5.5を最もよく補完し、タスクあたりのコストが低くなります。高い設定では、同様のコストで同等のパフォーマンスを発揮できます。