Anthropicの「Claude Haiku 5.5」は、素早い処理が求められる反復的なワークロードや速度重視のタスク向けに設計されたモデルです。前世代と比べて、脆弱性の発見やエクスプロイトの作成が上手になりました。同社は、Haiku 4.5よりも厳格なサイバーセキュリティ上の保護措置を適用しています。ただし、攻撃能力がはるかに高い上位モデルと比べると、制限は緩やかです。
サイバーセキュリティ能力と保護措置
Anthropicは、サイバーセキュリティ上の保護措置をオフにした状態で、このモデルの攻撃能力を測定しました。Chromeの V8エンジンの既知の脆弱性を使ったテストでは、Haiku 5.5は410回の試行のうち4回で任意のコード実行に成功しました。
多段階のサイバー作戦を対象とした別の評価では、リリース前のバージョンが課題の3.3%を完了しました。これに対し、Sonnet 5.5は46.1%、Opus 5.5は67.6%でした。
これらの結果は、一般提供の保護措置が適用された状態でユーザーが実行できる内容を、必ずしも反映しているわけではありません。

Claude Haiku 5.5はExploitGymでClaude Sonnet 5を上回りましたが、Claude 5.5ファミリーの
他のモデルとは大きな差があります(出典:Anthropic)
Anthropicは発表の中で、Haiku 5.5のサイバーセキュリティ保護措置はHaiku 4.5より制限が厳しい一方、最近の他のモデルに適用されている措置よりはやや緩やかだと説明しています。Sonnet 5.5の保護措置に比べると、より幅広い防御タスクを許可しています。それでも、ペネトレーションテストや、攻撃者が使う可能性の高い手法はブロックします。要件を満たすセキュリティ専門家は、同社のCyber Verification Programを通じて、制限の緩和を申請できます。
安全性評価の結果
同社は、Haiku 5.5が有害なリクエストにどう対処するかを検証しました。あわせて、センシティブな話題に関する無害な質問や、擬似ユーザーがモデルを少しずつ有害な結果へ誘導する会話も試しました。評価の対象は、武器、過激派の活動、追跡・監視、児童の安全、メンタルヘルス、選挙の公正性です。
ほぼ最終版のClaude.ai本番用システムプロンプトを適用した状態で、Haiku 5.5は有害なリクエストに対して99.71%の割合で無害な応答を返しました。無害なリクエストを誤って拒否した割合は0.82%で、Haiku 4.5の3.05%から低下しています。
より長い会話では、影響工作や、広告による追跡・監視に関するテストで成績が向上しました。一方、システムプロンプトなしでAPI経由でテストしたところ、武器に関するシナリオでは成績が低下しました。
これらの評価には、リアルタイムのプローブや監視など、本番環境の追加的な保護措置は含まれていません。Anthropicは、自傷行為や摂食障害を含むセンシティブな会話に弱点が残っていると指摘しています。API開発者には、独自の保護措置を追加するよう勧めています。
悪用とプロンプトインジェクションへの耐性
コードの作成やコンピュータの操作を行う場面で、悪意あるリクエストにどう応答するかも評価されました。
Claude Codeのテストでは、悪意あるリクエストの84.3%を拒否しました。Haiku 4.5は66.6%でした。対象となったのは、マルウェアの作成、DDoS攻撃の支援、本人の同意なしに使う監視ソフトの構築などです。一方で、ペネトレーションテストの結果分析など、許可されるべきセキュリティタスクへの支援も増えました。
監視、無許可のデータ収集、その他の有害な行為を対象としたコンピュータ操作のテストでは、Haiku 5.5はリクエストの約82.6%を拒否しました。前モデルは58.9%でした。この評価では、拒否率はSonnet 5.5やOpus 5.5も上回っています。
AnthropicはHaiku 5.5について、これまでのHaikuモデルの中でプロンプトインジェクションへの耐性が最も高いとしています。プロンプトインジェクションは、AIが読み込むメールやWebページなどに悪意ある指示を隠し、ユーザーの意図に反する動作をさせる攻撃です。
コーディング環境とコンピュータ操作環境で適応型の攻撃者を想定したテストでは、同社のフロンティアモデルとほぼ同水準の耐性を示しました。ただし、別のGray Swanベンチマークでは、Sonnet 5.5やOpus 5.5より耐性が低くなりました。残る脆弱性の大半は、グラフィカルなコンピュータ操作に集中していました。
これらのテストの大半は、本番環境の追加的な保護措置を除外しています。適応型攻撃の評価では、プロンプトインジェクション用プローブを有効にした場合と無効にした場合の両方の結果が報告されています。
価格と提供状況
Haiku 5.5の料金はHaiku 4.5より安く、短いリクエストほど節約効果が大きくなります。10万トークンまでのプロンプトでは、入力・出力ともにトークン単価が90%下がります。Anthropicによると、Haiku 4.5へのリクエストの大半がこの範囲に収まっていました。
調整可能な「effort」設定で、コストと知能のどちらを重視するかを選べます。Opus 5.5やSonnet 5.5のコーディング用サブエージェントとしても使えます。
「Claude Haiku 5.5には大変感銘を受けました。特に速度が際立っています。AIエージェント製品『AI Teammates』の評価スイートで試しました。バグのトリアージ、プロジェクトの設定、大規模なポートフォリオを検索してリスクの高い作業や期限超過の作業を洗い出すといったユースケースです。現在使っているモデルと比べると、タスク完了までの遅延が30%以上減り、エージェントの1ターンあたりの推論は最大2.5倍高速になりました。体感でもはっきり軽快です」と、Asanaのスタッフソフトウェアエンジニア、Aaron Vinh氏は述べています。
このモデルは、Amazon Web Services、Google Cloud、Microsoft Azureを含むすべてのプラットフォームで利用できます。開発者はClaude Platformで、モデル識別子claude-haiku-5-5を指定してアクセスできます。
AnthropicはSonnet 5.5のキャッシュ読み取り料金を半額に引き下げ、処理済みの入力を再利用する際のコストを減らします。同社によると、この変更により、AIエージェントが実行するタスクの大半で、コストが約20%下がるといいます。
同社は、ローンチ週にMaxプランとTeamプランの契約者向けに、月額のAPIクレジットを提供する予定です。Claude Platform上でアプリ、ツール、エージェントを開発する際に活用してもらう狙いです。Max 5xの契約者には月100ドル、Max 20xの契約者には月200ドルが付与されます。Teamの契約者には、ユーザー全体で共有する形で最大500ドルが付与されます。
AnthropicはPythonおよびTypeScriptのソフトウェア開発キット(SDK)にも、コンピュータ操作とブラウザ操作のベータ版サポートを追加しています。
翻訳元: https://www.helpnetsecurity.com/2026/10/08/anthropic-claude-haiku-5-5/