LLM API料金比較——OpenAI・Claude・Gemini・Grok・DeepSeek・Qwenの公式単価を整理

コラム

OpenAIなど大手の生成AIサービスで障害が起きると、業務が止まるリスクがはっきり見えます。だからこそ「1社だけに頼らない」複数ベンダー併用が、実務の安全策として現実味を帯びています。

併用を考えるとき、最初にぶつかるのが料金の見方です。同じモデルでも、APIの従量課金・Webアプリの月額・Cursorのような開発環境の月額+利用枠では、請求の仕組みがまったく違います。

本稿は2026年9月28日時点の各社公式料金ページをもとに、Anthropic・OpenAI・xAI(Grok)・Google Gemini、さらに中国のDeepSeekとAlibaba Qwen(DashScope)のAPI単価を整理します。数字は変わる前提で、導入前に必ず公式を再確認してください。

API料金の読み方

API料金は、だいたい「トークン」単位です。トークンは文章を測るための利用量の単位で、英語ならだいたい1単語弱、日本語では文字や語句のかたまりに近いイメージです。公式は多くの場合、100万トークン(1M tokens / MTok)あたり何ドルと示します。

よく出る項目は次のとおりです。

  • 入力(Input):あなたが送った指示や資料の量
  • 出力(Output):モデルが返した文章の量。長く丁寧に書くほど増えやすい
  • キャッシュ(Cached input):同じ資料の再利用。入力より安く書かれていることが多い
  • Batch:まとめて非同期処理。多くの会社で約半額
  • Fast / Priority:優先処理。標準より高め

一方、ChatGPTやClaude、GeminiアプリのようなWeb月額は、トークン明細ではなく「月いくらで、この枠まで使える」という定額に近いイメージです。Cursorはさらに、月額プランの中に利用プールがあり、枠を超えると各社APIのリスト価格で従量課金になる、という二段構えです。

本稿のドル表記は公式のままです。円換算は為替で毎日変わるため、必要なら各自のレートで試算してください(本稿では公式円建て以外の円換算は示しません)。

OpenAI(APIとChatGPT Webの違い)

OpenAIは、開発向けのAPI従量課金と、会話アプリChatGPTの月額が別会計です。APIキーで社内ツールを組む請求と、ブラウザでChatGPTを使う請求は混ざりません。

APIの主力フラッグシップ(短コンテキスト・標準)は次のとおりです(OpenAI API Pricing、2026-09-28時点の公式)。単位はすべて$ / 100万トークンです。

モデル入力キャッシュ入力出力補足
gpt-6-astra$10.00$1.00$50.00短コンテキスト標準
gpt-6-sol$2.00$0.20$10.00短コンテキスト標準
gpt-6-luna$0.10$0.01$0.50短コンテキスト標準

同じページでは、長いコンテキストは単価が上がる表、Batchは概ね半額、Fast modeは標準の約2倍、といった区分も並んでいます。地域データレジデンシーなどは別途10%上乗せの注記があります。価格は改定されるので、見積もり直前に公式を見てください。

ChatGPT Web側は定額プランです。個人向けPlusは公式ヘルプで$20/月(What is ChatGPT Plus?、2026-09-28時点)。上位のProは$100と$200の案内があり、2026年9月10日時点でPro $200の新規・アップグレードは一時停止、既存の$200と$100は継続、という案内があります。

法人向けBusinessは公式ビジネス料金ページで、Standard席が年払い換算$20/月(月払い$25)、Premium席が年払い換算$100/月(月払い$125)。Enterpriseは問い合わせ(OpenAI Business Pricing、2026-09-28時点)。

ポイントは、ChatGPTの月額を払っていても、APIの従量請求は別だということです。社内システム連携はAPI、日常の下書きはChatGPT、という分け方がよくあります。

Anthropic Claude(APIとClaude Web)

Claude APIは公式ドキュメントでモデルごとのMTok単価が表になっています(Anthropic Pricing、2026-09-28時点)。

モデル入力キャッシュ読取出力補足
Claude Fable 5.1$10$0.25$50長時間エージェント向け
Claude Opus 5.5$4$0.20$20日常の高負荷向け
Claude Opus 5$5$0.50$25前世代Opus
Claude Sonnet 5$2$0.20$10標準価格として継続
Claude Haiku 4.5$1$0.10$5高速・低コスト

Batchは入力・出力とも約50%引き。Fast modeはOpus 5.5で入力$8/出力$40など、標準より高い枠があります。US限定推論は1.1倍の注記があります。

Webのclaude.aiは定額です(claude.com/pricing、2026-09-28時点)。Free、Pro(年払いで月換算$17・一括$200、月払い$20)、Max(月額$100から、Pro比5倍/20倍の利用枠)。Team/Enterpriseは組織向けで、Enterpriseは公式FAQで席あたり$20/月+API単価の利用料(年払い)と説明されています。

ここでも、Claudeの月額チャットとAPIコンソールの従量は別です。上限を超えたあとにAPIレートのクレジットで続行できる、という案内もあります。

xAI Grok(APIとWeb)

xAIのテキストAPIは公式デベロッパー料金に一覧があります(xAI Pricing、2026-09-28時点)。プロンプトが20万トークンを超えると長いコンテキスト単価に切り替わるモデルが多いです。

モデル条件入力キャッシュ入力出力
grok-4.7<200k$2.00$0.50$6.00
grok-4.7≥200k$4.00$1.00$12.00
grok-4.6<200k$2.00$0.50$6.00
grok-4.5<200k$2.00$0.30$6.00
grok-4.3<200k$1.25$0.20$2.50
grok-build-0.1<200k$1.00$0.20$2.00

Priority Processingは標準の2倍。一部モデルはBatchで20%引き。USリージョンエンドポイントは1.1倍。Grok 4.7 FastはCursorとGrok Build向けで、公開APIにはなく、200k未満で入力$4/出力$12などと公式に書かれています。

WebのGrokは無料枠とSuperGrokなどの上位枠がありますが、本稿執筆時点で公式ページから確定の月額ドルを十分に抽出できなかったため、Webの具体的な月額数字は省略し、最新はgrok.comやXの案内で確認してください。API単価(上記)とは別物です。

Google Gemini(APIとWeb/AI Pro)

Gemini Developer APIはモデルごとにFree/Paid、さらにStandard・Batch・Flex・Priorityの表があります(Gemini API Pricing、2026-09-28時点)。Flash系には2026年12月31日までの導入価格が付いているものがあります。

モデル区分入力出力補足
Gemini 3.8 FlashPaid Standard$0.75$3.75〜2026-12-31の導入価格。以降は$1.50/$7.50
Gemini 3.7 FlashPaid Standard$0.75$3.75同上の導入価格帯
Gemini 3.1 Pro PreviewPaid Standard$2.00$12.00プロンプト≤200k。超えると$4/$18
Gemini 3.5 Flash-LitePaid Standard$0.30$2.50高頻度・低コスト向け

Batch/Flexは多くの表で標準の半額付近。Priorityは標準より高めです。Google AI Studioの利用は無料帯の説明もありますが、本番の有料APIとは別枠で考えてください。

Web/アプリの定額はGeminiのサブスクリプションページで確認できます(Gemini subscriptions、2026-09-28時点・表示は地域で異なる可能性あり)。例として米国表示では、Free $0、Google AI Plus $4.99/月、Google AI Pro $19.99/月、Google AI Ultraは$99.99/月(Pro比5倍枠)と$199.99/月(Pro比20倍枠)。ストレージやYouTube特典が付くプランもあります。

ここでも、Geminiアプリの月額とGemini APIの従量は別です。アプリで便利に使う契約と、自社サービスに組み込むAPI契約を混同しないことが大切です。

Cursorで使う場合

Cursorはコード編集のためのAI開発環境で、ChatGPTのWeb課金や各社の生API課金そのものではありません(Cursor Models & Pricing/Cursor Pricing help、2026-09-28時点)。

個人プランの目安は次のとおりです。

プラン月額内容の要点
Hobby無料利用に制限あり
Pro$20Cursor Models と Other Models の両プール
Pro+$60同上・枠が大きい
Ultra$200同上・さらに大きい
Teams Standard$40/ユーザーチーム向け
Teams Premium$120/ユーザーStandardの約5倍のAgent枠

利用枠は大きく2つのプールに分かれます。

  • Cursor Models:Grok 4.7/4.6/4.5、Composer 2.5 など。プランに含まれる枠から消費
  • Other Models:OpenAI・Anthropic・Googleなどの第三者モデル。各社APIのリスト価格で消費

枠を超えると、オンデマンドで同じAPIレートの従量課金に進めます(設定で止められます)。Teams/Enterpriseでは、第三者モデルに加えてCursor Token Rate $0.25 / 100万トークンが乗る、と公式に書かれています(GrokやComposerなどCursor側モデルは免除)。

つまりCursorの請求は、「月額サブスク」+「含まれた利用」+(超過時)「各社API単価」+(チームなら)「Cursor Token Rate」の積み上げです。ChatGPT Plusの$20とは別物で、同じ$20でも中身が違います。

中国の主要2社(DeepSeek/Qwen)API

DeepSeekは公式のModels & Pricingで、peak/off-peakの二段料金です(DeepSeek Pricing、2026-09-28時点)。単位は$ / 100万トークン。ピークはUTCの平日一部時間帯(中国の祝日・週末はオフピーク扱い)です。

モデル区分入力(キャッシュミス)入力(キャッシュヒット)出力
deepseek-flashオフピーク$0.15$0.003$0.60
deepseek-flashピーク$0.30$0.006$1.20
deepseek-v4-proオフピーク$0.66$0.022$1.98
deepseek-v4-proピーク$1.32$0.044$3.96

Alibaba Cloud Model Studio(DashScope)のQwenは、リージョンごとに表が分かれます(Model Studio pricing、最終更新表示 2026-09-24/取得 2026-09-28)。国際(Singapore)の代表例は次のとおりです。

モデル入力出力補足
qwen3.8-max(International)$2$60〜1Mトークン
qwen3.7-plus(International)$0.4$1.6≤256k。256k超は$1.2/$4.8
qwen3.8-flash(International)$0.15$0.470〜1Mトークン

中国(北京)など別リージョンでは単価が異なります(例:qwen3.8-maxが入力$1.65/出力約$4.95)。Batch半額やキャッシュ割引の注記もあるため、契約リージョンの表を直接見てください。

横断比較の目安

最新主力だけを、API標準レート(短い/通常コンテキスト)で並べます。単位は$ / 100万トークン。確認日は2026-09-28(Qwen表のページ更新表示は2026-09-24)。

ベンダーモデル入力出力
OpenAIgpt-6-astra$10$50
OpenAIgpt-6-sol$2$10
OpenAIgpt-6-luna$0.10$0.50
AnthropicClaude Fable 5.1$10$50
AnthropicClaude Opus 5.5$4$20
AnthropicClaude Sonnet 5$2$10
xAIgrok-4.7(<200k)$2$6
GoogleGemini 3.8 Flash(導入価格)$0.75$3.75
GoogleGemini 3.1 Pro(≤200k)$2$12
DeepSeekv4-pro(オフピーク)$0.66$1.98
DeepSeekflash(オフピーク)$0.15$0.60
Qwenqwen3.8-max(International)$2$6
Qwenqwen3.8-flash(International)$0.15$0.47

安さだけで選ぶと、品質・速度・日本語・データ所在地・障害時の代替経路を見落としがちです。横断表は「相場感の入口」として使い、本番前に公式の最新表と自社の利用シナリオで試算してください。

選び方のポイント

  • 障害耐性:主力1社+別系統の予備(例:OpenAIとAnthropic、またはGemini)を決めておく
  • 用途:下書きや社内チャットはWeb月額、自社システム接続はAPI、コーディングはCursor、という役割分担
  • 月額 vs 従量:毎日短く使うなら月額が見通しやすい。件数や長さが月ごとに大きく揺れるならAPI従量の方が無駄が出にくいことも
  • キャッシュとBatch:同じマニュアルを何度も読ませる仕事、夜間にまとめて処理できる仕事は、公式の割引枠を先に確認
  • チーム課金:Cursor TeamsのToken Rateや、ChatGPT Business/Claude Teamの席課金は個人プランと別ロジック

まとめ

複数ベンダー併用は、障害対策としてもコスト最適化としても現実的です。ただし「安いモデル」より先に、API・Web・Cursorのどれで払うかを揃えないと比較が崩れます。

本稿の数字は2026年9月28日時点の公式ページに基づくスナップショットです。モデル名も単価も頻繁に変わるため、契約や見積もりの直前に各社の料金ページを開き直してください。

参考リンク

この記事を書いた人
この記事を書いた人

毎日20時間以上AIの実践・研究に没頭するITエンジニア。20年以上にわたり、オンラインゲームや生活関連など幅広いジャンルのオウンドメディアで執筆・編集長を歴任。現在は上場企業グループの代表取締役を務め、複数の事業者団体で理事を兼務する経営者でもある。テクノロジーの最前線に身を置きつつ、地域の商店街や神社の運営にも深く携わるなど、地域活性化にも尽力。圧倒的な現場経験とITの専門知識、経営者の視点から、信頼性の高い有益な情報を発信している。
Olive株式会社 代表取締役

tanakaをフォローする
コラム
シェアする
tanakaをフォローする

コメント

タイトルとURLをコピーしました