Claude Haiku 5.5発表——入力100万トークン0.10ドルから、Haiku 4.5より平均約75%安い小型AI

コラム

Anthropic(アンソロピック)が、AI「Claude」シリーズの小型モデル「Claude Haiku 5.5」を発表しました。公式Xでの発表は日本時間10月8日午前3時ごろです。同社は「これまでで最も安く、最も速く、最も高性能な小型モデル」と位置づけ、料金は入力100万トークンあたり0.10ドルから。前の世代のHaiku 4.5と比べると、平均で約75%安く動かせるとしています。この記事では、料金の仕組み、性能、使いどころを、ITに詳しくない方にもわかるように整理します。

同じ「5.5世代」の上位モデルについては、Claude Sonnet 5.5の解説記事とClaude Opus 5.5の解説記事で紹介しています。各社AIの料金を横並びで見たい方はLLM API料金比較もあわせてどうぞ。

公式Xで公開された紹介動画

Claudeの公式Xアカウント(@claudeai)は、短い紹介動画とともにHaiku 5.5を発表しました。投稿では「平均でHaiku 4.5より約75%安く動かせる」と、コストの低さを真っ先にアピールしています。

Claude Haiku 5.5はどんなAIか

Claudeには、大きい順に「Opus」「Sonnet」「Haiku」という3つのサイズがあります(さらに上位のFableなどもあります)。会社にたとえるなら、Opusは難しい判断を任せるベテラン、Sonnetは日常業務の主力社員、Haikuは「早くて安く、たくさんの定型作業をこなす頼れるスタッフ」です。今回のHaiku 5.5は、その「スタッフ枠」が世代交代したものです。

公式発表によると、Haiku 5.5が得意とするのは、要約、会話の圧縮(長いやり取りを短くまとめ直す作業)、データベースの検索、分類といった「短くて繰り返しの多い仕事」です。さらに、同社のモデルの中で最も速いため、リアルタイムの顧客サポートや、AIがブラウザを操作する作業にも向いているとしています。もうひとつの使い方が「サブエージェント」です。上位のOpus 5.5やSonnet 5.5が全体の計画を立て、細かい作業をHaiku 5.5に振り分ける。現場監督と作業スタッフのような分担で、コーディングの仕事で相性が良いと説明されています。

なお「最速」については注記があり、各モデルを標準の速度で比べた場合の話で、Opusを高速モード(Fast Mode)で動かしたときよりは遅いとされています。

料金:入力100万トークン0.10ドルから、ただし「10万トークン」が境目

AIの料金は「トークン」という単位で計算されます。トークンは、AIが文章を読み書きするときの細かな文字のかたまりで、タクシーの距離メーターのようなものだと考えるとわかりやすいでしょう。読ませた量(入力)と書かせた量(出力)の両方にメーターが回ります。

Haiku 5.5の特徴は、1回に読ませる量(プロンプト)が10万トークン以下か、それを超えるかで単価が変わる点です。公式ドキュメントと発表ページの料金は次のとおりです(いずれも100万トークンあたり)。

項目Haiku 5.5(10万トークン以下)Haiku 5.5(10万トークン超)Haiku 4.5Sonnet 5.5
入力0.10ドル0.50ドル1.00ドル2.00ドル
出力0.50ドル2.50ドル5.00ドル10.00ドル
キャッシュ書き込み(5分)0.125ドル0.625ドル1.25ドル2.50ドル
キャッシュ書き込み(1時間)0.20ドル1ドル2ドル4ドル
キャッシュ読み込み0.01ドル0.05ドル0.10ドル0.10ドル
バッチ(入力/出力)0.05ドル/0.25ドル0.25ドル/1.25ドル0.50ドル/2.50ドル1ドル/5ドル

※Sonnet 5.5のキャッシュ読み込みは今回の値下げ後の価格です。バッチは「急がない仕事をまとめて預ける」方式で、入力・出力とも50%引きになります。

「キャッシュ」は、何度も使う資料をAIの手元に作り置きしておく仕組みです。毎回同じマニュアルを読み直させる代わりに、作り置きを参照させるので、読み込み料金が大幅に下がります。Haiku 5.5では10万トークン以下なら100万トークンあたり0.01ドルです。

Anthropicによれば、Haiku 4.5に届いていた依頼の約90%は10万トークン以下でした。この範囲ではHaiku 4.5より90%安く、10万トークン超でも50%安い設定です。ただしHaiku 5.5は文字の数え方(トークナイザー)が新しくなり、同じ文章でもHaiku 4.5より約30%多いトークン数として数えられます。こうした点まで含めて計算した結果が「平均で約75%安い」という数字です。

性能:Haiku 4.5から大きく前進、ただし難しい仕事は上位モデル

発表ページには、Haiku 4.5、OpenAIのGPT-6 Luna、参考として上位のSonnet 5.5と並べたベンチマーク(性能テスト)の結果が掲載されています。主なものを抜き出すと次のとおりです。

テスト(測るもの)Haiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5(参考)
GDPval-AA v2.1(44職種の実務)162073514371840
OSWorld 2.1(パソコン操作、オフライン版)72.4%15.7%48.9%83.9%
Humanity’s Last Exam(専門知識、ツールなし)45.9%10.2%—56.9%
Terminal-Bench 4.0(エージェント型コーディング)39.2%0.0%16.4%70.6%
Chartography(図表の読み取り、ツールなし)46.4%6.4%29.1%61.6%

出典:Anthropic「Introducing Claude Haiku 5.5」。GDPval-AAはスコア、そのほかは正答率などの割合です。

数字を見ると、Haiku 4.5からの伸びは非常に大きく、多くの項目でGPT-6 Lunaも上回っています。一方で、どの項目でもSonnet 5.5には届いていません。Anthropic自身も、複雑なコーディング作業ではSonnet 5.5やOpus 5.5のほうが適しており、Haiku 5.5は範囲のはっきりした仕事、たとえば要約や会話の圧縮、サブエージェントとしての作業に向いていると明言しています。

もうひとつの新しさは、Haikuとして初めて「effort(努力の度合い)」を調整できるようになったことです。仕事の丁寧さを決めるダイヤルのようなもので、コストを優先するか、賢さを優先するかを仕事ごとに選べます。標準の設定は「medium(中くらい)」です。

仕様と使える場所

一度に扱える情報量(コンテキストウィンドウ)は100万トークン、1回の回答で書ける量は最大12万8,000トークンです。Haiku 4.5は20万トークンと6万4,000トークンだったので、仕事机の広さが5倍、書ける報告書の長さが2倍になったイメージです。画像を読み取って文章で答えることもでき、知識は2026年6月までの情報が中心です。

提供先は、AnthropicのAPI(Claude Platform)に加え、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWSです。開発者向けの公式アカウント(@ClaudeDevs)は、Claude Codeでも使えるようになったと案内しています。また、Claudeのアプリ(claude.ai)向けのシステムプロンプトも公開されていますが、発表時点でどの料金プランで選べるかは公式発表に明記されていません。提供は少なくとも2027年10月7日までは続く予定とされています。

同時に発表された値下げとAPIクレジット

Haiku 5.5と同時に、ほかのモデルや料金プランにも見直しが入りました。まず、Sonnet 5.5のキャッシュ読み込み料金が100万トークンあたり0.20ドルから0.10ドルへ半額になりました。AIエージェントの仕事ではキャッシュ読み込みが使用量の大きな割合を占めるため、多くのエージェント作業でSonnet 5.5のコストが約20%下がるとしています。

次に、有料プランのMaxとTeamの利用者に、毎月のAPIクレジット(APIで使える無料枠)が付くことになりました。Max 5xは月100ドル、Max 20xは月200ドル、Teamは組織全体で最大500ドルです。どのモデルにも使え、今週中に順次提供されます。自社用の小さなツールやAIエージェントを試作したい人にとっては、Haiku 5.5の安さと組み合わせて試しやすくなる変更です。

先行テストした企業の声

発表ページには、事前に試した企業のコメントが紹介されています。HubSpotは、CRM(顧客管理)の作業で小型モデルを評価する社内テストで、Haiku 5.5がこれまでで最高の92.8%(3回平均)を記録したと述べています。週に約800万回AIを呼び出しているというAlphaSenseは、文書への質問応答400件でHaiku 4.5の0.76に対し0.84と、統計的に意味のある改善があったと報告しました。

Boxは、初期テストでHaiku 4.5より11ポイント高いスコアを、約半分の待ち時間で出したとしています。Asanaは、AIエージェント製品のテストで、現在使っているモデルと比べて作業完了までの待ち時間が30%以上短くなったと述べています。いずれも各社の環境での結果ですが、「大量に使う定型作業」で効果が出ているという点は共通しています。

仕事での使いどころと注意点

公式に挙げられている得意分野を、身近な業務に置き換えると次のようになります。

  • 問い合わせメールの分類や、担当部署への振り分け
  • 会議メモや日報、長いメールのやり取りの要約
  • 請求書や申込書から必要な項目だけを抜き出す作業
  • チャットでの一次対応など、すぐに返事が必要な顧客サポート
  • 上位モデルが立てた計画にもとづく、調べものや下準備などの細かな作業

注意したい点もあります。ひとつは、10万トークンを超える長い資料を読ませると単価が5倍に上がることです。分厚い資料を丸ごと渡すより、必要な部分に絞って渡すほうが安く済みます。もうひとつは、同じ文章でも数えられるトークンが約30%増えるため、Haiku 4.5時代の見積もりをそのまま使わず、実際の使い方で計り直すことです。また、公式の安全性評価(システムカード)では、自動の行動チェックで、比較したどのモデルよりも「問題のない依頼まで断ってしまう」場面が多かったとも報告されています。いきなり全面的に切り替えるのではなく、まず一部の業務で試すのが安心です。

まとめ

Claude Haiku 5.5は、「早くて安い定型作業の担当」を大きく強化したモデルです。10万トークン以下の依頼なら入力100万トークン0.10ドルからと、Haiku 4.5の10分の1の単価で、性能も多くのテストで大きく伸びました。一方で、難しい判断や複雑なコーディングは引き続きSonnetやOpusの出番です。難しい仕事は上位モデル、量の多い仕事はHaiku、という分担を意識すると、AIのコストを抑えながら活用の幅を広げられます。まずは問い合わせの振り分けや要約など、件数の多い作業から試してみてはいかがでしょうか。

参考リンク

この記事を書いた人
この記事を書いた人

毎日20時間以上AIの実践・研究に没頭するITエンジニア。20年以上にわたり、オンラインゲームや生活関連など幅広いジャンルのオウンドメディアで執筆・編集長を歴任。現在は上場企業グループの代表取締役を務め、複数の事業者団体で理事を兼務する経営者でもある。テクノロジーの最前線に身を置きつつ、地域の商店街や神社の運営にも深く携わるなど、地域活性化にも尽力。圧倒的な現場経験とITの専門知識、経営者の視点から、信頼性の高い有益な情報を発信している。
Olive株式会社 代表取締役

tanakaをフォローする
コラム
シェアする
tanakaをフォローする

コメント

タイトルとURLをコピーしました