主要LLMのAPI料金を比較できる月額コストシミュレーター【2026年8月版】
目次8項目
LLMを使ったサービスを考えるとき、モデルの単価だけを見ても実際の月額費用はなかなか想像できません。そこで、月間リクエスト数と1回あたりの入出力トークン数を動かし、主要モデルの概算費用をその場で比較できるシミュレーターを作りました。
料金は2026年8月1日に各社の公式ページで確認した標準API料金です。実際の請求額を保証するものではありません。
LLM API月額コストシミュレーター
3本のスライダーを動かすと、条件に応じた月額費用とモデルの並び順がリアルタイムで変わります。まずは想定する利用回数を設定し、チャット履歴やシステムプロンプトを含む入力トークン数、reasoning・thinkingを含む請求対象の出力トークン数を調整してください。提供会社の選択欄では、6社のモデルを個別に絞り込めます。
LLM API月額コストシミュレーター
全提供会社の24モデルを、月間100,000回、1回あたり入力2,000トークン、請求対象の出力500トークンで比較しています。
料金確認日:2026年7月29日。Claude Sonnet 5の$2/$10は2026年8月31日までの導入価格で、9月1日から$3/$15です。出力はreasoning・thinkingを含む請求対象値を入力してください。キャッシュ、バッチ、ツール利用料、税金は含みません。
計算方法
月額費用は、各社が公開している100万トークンあたりの入力単価と出力単価から計算しています。
月額 = 月間リクエスト数 ×(入力トークン数 × 入力単価 ÷ 1,000,000 + 請求対象の出力トークン数 × 出力単価 ÷ 1,000,000)
たとえば月10万回、1回あたり入力2,000トークン・請求対象の出力500トークンなら、入力と出力の両方を10万回分積み上げます。出力単価は入力単価より高いモデルが多いため、回答の長さや推論量を調整すると費用が大きく変わる場合があります。
比較しているモデルと標準単価
以下はシミュレーターに登録している単価です。いずれもテキストの標準処理を対象とし、価格は100万トークンあたりの米ドルです。
| 提供会社 | モデル | 入力 | 出力 |
|---|---|---|---|
| OpenAI | GPT-4o mini | $0.15 | $0.60 |
| OpenAI | GPT-5 mini | $0.25 | $2.00 |
| OpenAI | GPT-5 | $1.25 | $10.00 |
| OpenAI | GPT-5.6 Luna | $0.20 | $1.20 |
| OpenAI | GPT-5.6 Terra | $2.00 | $12.00 |
| OpenAI | GPT-5.6 Sol | $5.00 | $30.00 |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | |
| Gemini 3 Flash Preview | $0.50 | $3.00 | |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | |
| Gemini 3.1 Pro Preview | $2.00 | $12.00 | |
| Gemini 3.5 Flash | $1.50 | $9.00 | |
| Gemini 3.6 Flash | $1.50 | $7.50 | |
| Anthropic | Claude Haiku 4.5 | $1.00 | $5.00 |
| Anthropic | Claude Sonnet 4.6 | $3.00 | $15.00 |
| Anthropic | Claude Sonnet 5 | $2.00 | $10.00 |
| Anthropic | Claude Opus 4.8 | $5.00 | $25.00 |
| Anthropic | Claude Opus 5 | $5.00 | $25.00 |
| xAI | Grok 4.3 | $1.25 | $2.50 |
| xAI | Grok 4.5 | $2.00 | $6.00 |
| DeepSeek | DeepSeek V4 Flash | $0.14 | $0.28 |
| DeepSeek | DeepSeek V4 Pro | $0.435 | $0.87 |
| Mistral | Mistral Small 4 | $0.15 | $0.60 |
| Mistral | Mistral Medium 3.5 | $1.50 | $7.50 |
| Mistral | Mistral Large 3 | $0.50 | $1.50 |
ここでの比較は用途と価格帯の異なる24モデルを選んだもので、提供中の全モデルを網羅した一覧ではありません。品質、応答速度、コンテキスト長、利用できる機能もモデル選びでは重要です。
Claude Sonnet 5の$2/$10は2026年8月31日までの導入価格で、2026年9月1日から$3/$15へ変わります。Gemini 3.1 Pro Previewは入力20万トークン以下、GPT-5.6 Luna・Terra・Solは入力27.2万トークン以下、Grokは短いコンテキストの標準料金を使用しています。DeepSeekの入力はキャッシュ未適用時の料金です。GPT-5.6は入力が27.2万トークンを超えると、そのリクエスト全体が入力2倍・出力1.5倍になります。Gemini 3.1 Pro PreviewやGrokも長いコンテキストでは単価が変わります。
シミュレーターを見るときのポイント
入力トークンは会話が続くほど増えやすい
チャット形式のアプリでは、システムプロンプトや過去の会話を毎回送る構成があります。最初は短くても、会話履歴を無制限に含めると入力トークンが増え続けます。履歴の要約や古い発言の削除は、費用と応答速度の両方に効きます。
請求対象の出力トークンは見える回答より多い場合がある
APIに設定した最大出力トークン数が、そのまま毎回請求されるわけではありません。通常は実際に生成されたトークン数が対象です。ただし、推論モデルでは画面に表示された回答に加え、内部のreasoning・thinkingトークンも出力料金の対象になります。APIレスポンスの usage に記録された請求対象の出力トークン数を確認し、その平均値をシミュレーターへ入れると現実に近づきます。
安さだけで決めない
安価なモデルで再試行が増えたり、複雑な処理を何段階にも分けたりすると、合計費用が高くなる場合があります。候補を絞った後は、実際のプロンプトを使って品質・速度・失敗率も計測するのがおすすめです。
この概算に含まれない料金
- キャッシュ入力やプロンプトキャッシュの割引・書き込み料金
- Batch APIやFlexなどの割引料金
- Web検索、画像、音声、動画、ファイル検索などの追加料金
- リージョン指定、長いコンテキスト、優先処理などの追加料金
- 税金、為替変動、クラウド事業者経由の価格差
本番運用の予算を決めるときは、この結果に余裕を持たせ、利用しているAPIの請求画面でも上限やアラートを設定してください。
あわせて読みたい
- ローカルLLMとAPIはどちらが安いか?損益分岐点シミュレーター【2026年8月版】
- ローカルLLMは自分のGPUで動く?必要VRAM計算ツール【2026年版】
- AI VTuber 2人の会話を自然にするには?単独発話・相づち・掛け合いを分けた理由
公式料金ページ
- GPT-4o miniの公式モデル情報
- GPT-5 miniの公式モデル情報
- GPT-5の公式モデル情報
- Gemini Developer APIの公式料金表
- Claude APIの公式料金表
- xAI APIの公式料金表
- DeepSeek APIの公式料金表
- Mistral APIの公式料金表
まとめ
LLM APIの費用は、モデル単価だけでなく、呼び出し回数と入出力トークン数の組み合わせで決まります。想定値を一度だけ入れるのではなく、通常時・アクセス増加時・長文回答時の3パターンで動かし、費用の幅を確認しておくと運用計画を立てやすくなります。

コメント欄に近づくと読み込みます。