速報です。Anthropicは2026年10月7日付で、Claudeの新しい小型モデル「Claude Haiku 5.5」を発表しました。Anthropic自身は「これまでで最も安く、最も速く、最も賢い小型モデル」と説明しています。APIで指定するモデルIDは「claude-haiku-5-5」です。
この記事の事実の部分は、2026年10月8日にAnthropicの公式ページ(発表文、Haikuの製品ページ、開発者向けのモデル一覧と移行ガイド)の本文で確かめた内容だけで書いています。性能の数字はAnthropicが公表した試験の結果です。当社はまだ自社の仕事でHaiku 5.5を試していないため、使った感想は書きません。後半の、中小企業の仕事での使いどころは当社の考えです。
Haiku 5.5は、量が多い仕事を速く安くこなすモデル
公式の発表によると、Haiku 5.5は量が多く、費用を抑えたい仕事のために作られています。要約、会話の履歴を短くまとめる作業、データベースへの問い合わせ、分類のような、短くて繰り返しの多い仕事を確実にこなすとされています。上位のOpus 5.5やSonnet 5.5の下で、コーディングの一部を受け持つ補助役(サブエージェント)としての使い方も挙げられています。
速さについて、Anthropicは「これまでで最も速いモデル」としています。そのため、待ち時間がそのまま使い心地に響く、リアルタイムのお客様対応やブラウザ操作に向くとされています。ただし注記があり、比べているのは各モデルの標準の速さで、Opusの高速モード(Fast Mode)よりは遅いと書かれています。
提供はすでに始まっています。claude.aiでは、Free、Pro、Max、Team、Enterpriseの各プランでHaiku 5.5を選べます(Web、iOS、Android)。Claude Codeでも使え、開発者向けにはAnthropicのClaude Platformのほか、Amazon Web Services、Google Cloud、Microsoft Foundryで使えます。

Haiku 4.5から変わったこと(1)料金は10万トークン以下で10分の1
いちばん大きな変化は料金です。Haiku 5.5は、1回のやり取りの長さ(プロンプトが10万トークン以下か、それを超えるか)で料金が2段階に分かれます。10万トークン以下なら、入力も出力もHaiku 4.5のちょうど10分の1です。10万トークンを超えると、Haiku 4.5より50%安い値になります。100万トークンあたりの料金は次のとおりです。
| 項目(100万トークンあたり) | Haiku 5.5(10万トークン以下) | Haiku 5.5(10万トークン超) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| 入力 | 0.10ドル | 0.50ドル | 1.00ドル | 2.00ドル |
| 出力 | 0.50ドル | 2.50ドル | 5.00ドル | 10.00ドル |
| キャッシュ書き込み | 0.125ドル | 0.625ドル | 1.25ドル | 2.50ドル |
| キャッシュ読み込み | 0.01ドル | 0.05ドル | 0.10ドル | 0.10ドル |
注意点が一つあります。Haiku 5.5は新しい数え方(トークナイザー)を使っていて、移行ガイドによると、同じ入力の文章でもHaiku 4.5より約30%多いトークンとして数えられます。発表文では、Haiku 4.5ではやり取りの約9割が10万トークン以下だったことと、1つの仕事に使うトークンが少し多くなることを合わせて計算し、平均では約75%安く動かせるとしています。
当社で単純な計算をしてみます。1件あたり入力2,000トークン、出力300トークンの仕事を1万件こなす場合、Haiku 4.5では35ドルです。Haiku 5.5では、トークンが30%増える分を入れても約4.6ドルになります。考える分のトークンやキャッシュは入れていない計算なので、実際の額は使い方で変わります。
Haiku 4.5から変わったこと(2)性能と、考える深さの調整
性能も大きく上がりました。発表文の表から、主な試験の結果を抜き出すと次のとおりです(Sonnet 5.5は参考として載っている値です)。
| 試験(分野) | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| GDPval-AA v2.1(事務・知的作業) | 1620 | 735 | 1840 |
| OSWorld 2.1(パソコン操作) | 72.4% | 15.7% | 83.9% |
| Humanity's Last Exam(ツールなし) | 45.9% | 10.2% | 56.9% |
| Terminal-Bench 4.0(エージェント型のコーディング) | 39.2% | 0.0% | 70.6% |
| Chartography(図表の読み取り) | 46.4% | 6.4% | 61.6% |
パソコンを操作する試験(OSWorld 2.1、オフラインの部分集合)は15.7%から72.4%へ、エージェント型のコーディングの試験(Terminal-Bench 4.0)は0.0%から39.2%へ上がっています。発表文では、OpenAIのGPT-6 Lunaとも比べていて、GPT-6 Lunaの数字が載っている6つの試験すべてでHaiku 5.5が上回っています。
もう一つの変化は、Haikuで初めて「effort」(どれだけ考えるか)を調整できるようになったことです。他のClaudeのモデルと同じように、費用を優先するか、賢さを優先するかを仕事ごとに選べます。モデル一覧によると、Haiku 5.5の初期値はmediumです。
APIでHaiku 4.5を使っている会社は、移行の作業が要ります。移行ガイドには、temperatureなどの値を送ると誤りになること、答えの書き出しを先に渡す使い方(prefill)ができなくなったこと、考える量の指定の仕方が変わったことなどが挙がっています。Haiku 4.5で契約していたPriority Tierは、Haiku 5.5では使えないとも書かれています。
Opus・Sonnet・Fableとの使い分け
Anthropicの開発者向けのモデル一覧は、今のモデルを次のように位置づけています。4つとも、一度に読める量は100万トークン、一度に出せる量は12万8,000トークンで同じです。違うのは、得意な仕事と料金と速さです。
| モデル | 公式の位置づけ | 料金(入力/出力・100万トークン) | 速さ |
|---|---|---|---|
| Fable 5.1 | 難しい推論と、長時間かけて進めるエージェントの仕事 | 10ドル/50ドル | 遅め |
| Opus 5.5 | 長く続くコーディングと知的作業。迷ったらまずこれ | 4ドル/20ドル | 中くらい |
| Sonnet 5.5 | 速さと賢さの組み合わせが最もよい | 2ドル/10ドル | 速い |
| Haiku 5.5 | 分類・抜き出し・振り分けのような、量が多く速さが要る仕事 | 0.10ドル/0.50ドルから | 最速 |
モデル一覧は、迷ったらまずOpus 5.5から始め、難しい推論や長時間のエージェントの仕事、Opus 5.5で考える量を上げても足りない時にFable 5.1を使うよう勧めています。Haikuの製品ページは、複雑なコーディングや知的作業ではOpus 5.5が日常の主力で、Sonnet 5.5は範囲がはっきりした仕事に合うとしています。

Haiku 5.5については、Anthropic自身が限界を書いています。Terminal-Bench 4.0のような複雑なエージェント型のコーディングでは、Sonnet 5.5とOpus 5.5のほうが引き続き良い選択だとしています。表でもSonnet 5.5の70.6%に対して、Haiku 5.5は39.2%です。一方で、これまで費用が見合わなかった、範囲の狭い仕事(会話の圧縮、要約、サブエージェントの仕事)にはHaiku 5.5が最も合うとしています。
まとめると、計画を立てて全体を進めるのはFableやOpus、範囲がはっきりした仕事はSonnet、決まった手順で量をこなす仕事はHaikuという分け方です。Haikuの製品ページにも、FableやOpusのような賢いモデルが仕事を計画し、細かい作業をHaikuに渡す使い方が書かれています。
中小企業の仕事で考える、Haiku 5.5の使いどころ
ここからは当社の考えです。Haiku 5.5が合うのは、1件ずつは簡単でも件数が多く、人がやると時間を取られる仕事です。たとえば、届いた問い合わせメールを内容ごとに振り分ける、日報や議事録を短くまとめる、フォームで受け付けた内容を分類して担当に回す、よくある質問への一次回答を返す、といった仕事です。
逆に、提案書を一から組み立てる、仕組みの設計を決める、複数の手順にまたがるシステムの改修をする、といった仕事は上位のモデルに任せるほうが安全です。料金が10分の1でも、やり直しが増えれば人の手間がかかります。仕事を細かく分け、それぞれに合うモデルを当てるのが、費用と品質の両方を守る近道だと考えています。
AIエージェントを作るときも同じです。全部の手順を一番賢いモデルで動かすと費用がかさみます。判断の要る所は上位のモデル、量の多い定型の所はHaiku 5.5、と分けると、同じ予算で回せる件数が増えます。どの仕事をAIに任せ、どこを人が持つかの線の引き方は、AIエージェントに任せてよい仕事と、人が持つべき仕事に書きました。
同時に発表されたこと
- Sonnet 5.5のキャッシュ読み込みが半額に:100万トークンあたり0.20ドルから0.10ドルへ。エージェントの仕事の多くで約20%安くなるとしています
- MaxとTeamの契約者に、毎月のAPIクレジット:Max 5xは月100ドル、Max 20xは月200ドル、Teamは利用者全体で最大500ドル。今週中に配り始め、どのモデルにも使えるとしています
- PythonとTypeScriptのSDKが、パソコン操作とブラウザ操作に対応(ベータ):速さと料金の面で、Haiku 5.5が特に向くとしています
安全面では、意図どおりに振る舞うかを見る評価のほぼすべてで、Haiku 4.5から大きく改善したとしています。サイバーセキュリティの制限はHaiku 4.5より厳しく、他の最近のモデルよりはやや緩めで、防御のための作業は広く通す一方、侵入テストのような攻撃に使われやすい手法は止めます。
9月に発表された上位モデルのOpus 5.5については、【2026年9月24日】海外AI最新動向まとめ(Claude Opus 5.5の発表)で触れています。



