Anthropic、小型モデル「Claude Haiku 5.5」を発表 価格は旧版より平均約75%安く

Anthropic、小型モデル「Claude Haiku 5.5」を発表 価格は旧版より平均約75%安く
出典:Introducing Claude Haiku 5.5

米Anthropicは、小型モデル「Claude Haiku 5.5」を発表しました。同社は、これまでに公開した小型モデルの中で最も安価で高速、かつ高性能だと位置付けています。大量処理やコストを重視する用途を想定した設計で、要約やコンパクション(会話履歴の圧縮)、データベースへの問い合わせ、分類といった素早く繰り返す作業を安定してこなせるとしています。

用途としては、コーディング作業で「Opus 5.5」や「Sonnet 5.5」と組み合わせ、サブエージェントとして使う方法も挙げました。Haiku 5.5は同社で最速のモデルでもあるため、ライブのカスタマーサポートやブラウザー操作など、応答速度が求められる場面にも向くと説明しています。

価格面では、前世代の「Haiku 4.5」より大幅に安くなりました。同社によると、実行にかかるコストは平均で約75%減っています。

今回の発表にあわせ、モデル群全体のコストパフォーマンス向上策も打ち出しました。Sonnet 5.5のキャッシュ読み取り料金を半額にし、ほとんどのエージェント型作業で実行コストが約20%下がるといいます。さらに、ClaudeのMaxプランとTeamプランの契約者に対し、毎月のAPIクレジットを新たに提供します。Claude Platform上で新しいエージェントやアプリケーションを開発する利用者を支援する狙いです。

性能は複数のベンチマークで示されました。比較対象はHaiku 4.5、OpenAIの「GPT-6 Luna」、Sonnet 5.5です。知的業務を測るGDPval-AA v2.1では、Haiku 5.5が1620、Haiku 4.5が735、GPT-6 Lunaが1437、Sonnet 5.5が1840でした。

出典:Introducing Claude Haiku 5.5

実際のパソコン操作を測るOSWorld 2.1(オフラインのサブセット)では、Haiku 5.5が72.4%で、Haiku 4.5の15.7%やGPT-6 Lunaの48.9%を上回っています。Sonnet 5.5は83.9%です。

出典:Introducing Claude Haiku 5.5

専門家レベルの知識と推論を問うHumanity’s Last Examは、ツールなしで45.9%、ツールありで57.4%でした。Haiku 4.5はそれぞれ10.2%と18.7%です。

Screenshot

エージェント型コーディングのTerminal-Bench 4.0はHaiku 5.5が39.2%、GPT-6 Lunaが16.4%、Sonnet 5.5が70.6%でした。FrontierCode 1.1(Main)ではHaiku 5.5が46.4%、GPT-6 Lunaが42.4%です。図表の読み取りなどを測るChartographyは、ツールなしで46.4%でした。評価方法の詳細は、Haiku 5.5のシステムカードで公開されています。

Haiku 5.5は、Haikuクラスで初めて調整可能な「エフォート設定」を備えました。他のモデルと同じく、コストと知能のどちらを優先するか利用者が選べます。

同社によると、早期テストに参加した顧客からは、上記の性能とコスト改善に沿った結果が報告されたといいます。Asanaは、AIエージェント製品「AI Teammates」の評価で、現在使用中のモデルと比べてタスク完了までの遅延が30%超減り、エージェントの1ターンあたりの推論が最大2.5倍速くなったと述べました。同社のスタッフソフトウェアエンジニアであるアーロン・ヴィン氏は、体感でも明らかに応答が軽快になったとしています。


出典:Introducing Claude Haiku 5.5

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!
目次