安いAI APIを比較|用途別料金と月額見積もり
DeepSeek、Qwen、Gemini、Mistral、Kimiなどの確認済みAI APIを、入力・出力・cache・用途・本番比較対象の違いから見比べます。
まず結論
安いAI APIは、入力が多いか、出力が多いか、cacheが効くか、検索やBatchを使うかで候補が変わります。「最安の1社」を固定するのではなく、同じ利用条件を料金台帳と見積もりツールへ入れて比較するのが安全です。
このページの表は、2026年8月7日に公式価格を確認できたモデルのうち、通常の標準テキスト比較へ参加できるものだけを台帳から表示します。料金はモデル・地域・コンテキスト長・機能条件で変わるため、最終的な採用前には公式Usageと請求画面を確認してください。
安いAPIを比較するときの5つの軸
単価の大小だけでなく、同じ条件で品質と運用を比べます。入力と出力を別に見るだけで、チャット、要約、分類、記事下書きの順位が変わることがあります。
| 軸 | 確認すること | 見積もりへの反映 |
|---|---|---|
| 入力 | 毎回送る指示・履歴・参考文書 | 入力トークンを実測または上限設定 |
| 出力 | 返答長・最大出力・再生成 | 出力トークンを別に入力 |
| cache / Batch | 適用条件・TTL・遅延・割引 | 通常価格と別ケースで計算 |
| 追加機能 | 検索・画像・音声・ファイル・tool | 公式の別料金を通常表に混ぜない |
| 運用 | 品質、レート制限、地域、データ方針 | 価格以外の採用条件として確認 |
低価格帯の候補をどう見るか
DeepSeek V4 Flash、Qwen Flash、Gemini Flash-Lite、Mistral Small、Claude Haiku、GPT-5.4 miniなどは、軽量処理や下書きの候補になります。ただし「安い」は入力・出力の組み合わせに対する言葉であり、すべてのタスクで最安とは限りません。
DeepSeek、Qwen、Kimiなど中国系の提供元を候補にする場合は、APIキー、顧客情報、個人情報、private repository全体をそのまま投入せず、契約・保存・学習利用・リージョン条件を確認します。価格確認とデータ方針の確認は別のゲートです。
表に載るモデル・載らないモデル
比較表は、公式一次情報で標準の入力・出力単価を確認でき、現行モデルで、通常比較の本番適格性を満たすモデルに限定します。partialは別途必須の料金が単一化できないため、blockedは公式単価を確認できないため、安い順の表へ入れません。
- 掲載:pricingAuditStatus=confirmed、rankingEligibility=default、catalogStatus=current
- 除外:Perplexityのようにtoken以外のrequest feeが必須で単一比較できないモデル
- 別枠:cache、Batch、検索、長文コンテキスト、地域差、Thinkingなど条件付きの価格
- 未確認:価格を推測せず、nullやblockedとして台帳に残す
用途別の選び方
まず品質の最低ラインを決め、そこを満たす候補だけを価格比較します。公開文章の下書き、短い分類、コード、重要なレビューでは必要な品質が違います。
| 用途 | 最初に試す候補 | 追加確認 |
|---|---|---|
| 短い分類・タグ付け | Qwen Flash / Gemini Flash-Lite / Claude Haiku | 誤分類率・無料枠・レート制限 |
| 公開文章の下書き | DeepSeek V4 Flash / Qwen Flash / Mistral Small | 事実確認・データ方針・人間レビュー |
| 一般的なチャット | GPT-5.4 mini / Gemini Flash / Kimi K2.6 | 履歴の長さ・最大出力・遅延 |
| 重要なコード・判断 | Claude Sonnet / GPT-5.5 / Gemini Pro | 品質・セキュリティ・レビュー工程 |
| 検索・最新情報 | Perplexity等を別見積 | token以外のrequest fee・検索条件 |
cache・Batch・検索は別ケースで見積もる
通常の単価表だけでは、実際の請求条件を全部表せません。cache hitは入力の一部だけに適用されることがあり、Batchは遅延や対象APIの条件があります。検索やtool callingはリクエスト単位、画像・音声・ファイルは入出力トークン以外の料金が発生することがあります。
まず通常価格で上限を置き、公式条件を確認できた場合だけcache・Batchなどの別ケースを試します。割引を先に織り込んで予算を小さく見せないことが重要です。
| 条件 | 通常比較での扱い | 実装前に確認すること |
|---|---|---|
| cache read / prompt cache | 別列・別ケース | prefix、TTL、hit率、保存料 |
| Batch | 通常価格に混ぜない | 対象モデル、遅延、入出力単価 |
| 検索・tool | 別料金があれば除外 | request fee、検索結果、tool call単価 |
| 長文コンテキスト | 標準条件とは別 | 閾値、地域、出力上限、契約 |
安いモデルは下書き、重要な確認は分ける
低価格モデルは記事構成、FAQ案、分類、比較表のたたき台に使いやすい一方、公開前の事実確認、機密情報、重要なコード、ユーザーに損失が出る判断は別のレビュー工程にします。安いAPI代だけで公開品質を保証できるわけではありません。
選び方のフロー
迷ったときは、価格順を先に決めず、公開範囲・機密性・品質の重み・処理量を順番に確認します。最後に見積もりと実測を突き合わせます。
- 入力・出力・回数を実測し、通常条件の上限を出す
- 公開情報だけか、個人情報・秘密情報を含むかを分ける
- 品質の最低ラインを小さなサンプルで確認する
- 料金台帳と見積もりツールで月額を比較する
- Usage、レート制限、エラー、レビュー工数を見て本番モデルを決める
まとめ
安いAI API探しは、単価の安い順に並べる作業ではありません。入力・出力・cache・Batch・検索を分け、確認済みの候補だけを同じ条件で比べ、品質と安全性の確認を残します。
最初は通常価格で小さく試し、低価格モデルで足りない処理だけ上位モデルへ回すと、予算と品質の両方を管理しやすくなります。
確認済み料金台帳から見る候補
2026-08-07基準の料金台帳から、公式確認済み・通常比較対象のモデルだけを表示しています。入力・出力・cache readは別列で、検索、画像、音声、ファイル、tool callingなどは含めません。
| モデル / 提供元 | API model | 入力 / 100万 | 出力 / 100万 | cache read | 確認日 |
|---|---|---|---|---|---|
| Qwen FlashQwen | qwen3.5-flash | US$0.029 | US$0.287 | 別条件 | 2026-08-07 |
| DeepSeek V4 FlashDeepSeek | deepseek-v4-flash | US$0.140 | US$0.280 | US$0.003 | 2026-08-07 |
| Gemini Flash-LiteGoogle | gemini-2.5-flash-lite | US$0.100 | US$0.400 | US$0.010 | 2026-08-07 |
| Mistral SmallMistral | mistral-small-latest | US$0.150 | US$0.600 | US$0.015 | 2026-08-07 |
| Claude Haiku 4.5Anthropic | claude-haiku-4-5 | US$1.000 | US$5.000 | US$0.100 | 2026-08-07 |
| GPT-5.4 miniOpenAI | gpt-5.4-mini | US$0.750 | US$4.500 | US$0.075 | 2026-08-07 |
| Kimi K2.6Moonshot AI | kimi-k2.6 | US$0.950 | US$4.000 | US$0.160 | 2026-08-07 |
| Qwen PlusQwen | qwen3.7-plus | US$0.400 | US$1.600 | 別条件 | 2026-08-07 |
| Gemini FlashGoogle | gemini-2.5-flash | US$0.300 | US$2.500 | US$0.030 | 2026-08-07 |
| DeepSeek V4 ProDeepSeek | deepseek-v4-pro | US$0.435 | US$0.870 | US$0.004 | 2026-08-07 |
表示単価は公式料金ページの基準単価。実際の請求はコンテキスト長、地域、無料枠、cache、Batch、検索などの条件で変わります。料金台帳をすべて見る。
公式情報の確認先
- DeepSeek API Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:DeepSeek V4 Flash、DeepSeek V4 Pro、cache hit
- Qwen Model Studio Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:Qwen Flash、Qwen Plus、地域・context条件
- Gemini API Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:Gemini Flash-Lite、Gemini Flash、Gemini Pro
- OpenAI API Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:GPT-5.4 mini、GPT-5.5
- Anthropic Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:Claude Haiku 4.5、Claude Sonnet 4.6
- Mistral API Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:Mistral Small、Mistral Large
- Kimi K2.6 Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:kimi-k2.6
- Perplexity API Pricing(新しいタブで開く)
確認日:2026-08-07 ・ 対象:Sonar、Sonar Pro、Search request fee
よくある質問
この記事の条件で見積もる
記事で扱った利用イメージ(月間1,000回・入力約800・出力約800トークン)を、トークン見積所でそのまま再現できます。
この条件で見積もる関連記事
AI API料金が高くなる理由と、安いモデルへの切り替え、モデルルーティング、キャッシュ、短いコンテキスト、予算上限の考え方を個人開発者向けに整理します。
API基礎AI APIの入力トークン・出力トークンとは?料金が増える仕組みAI API料金でよく出てくる入力トークン、出力トークン、キャッシュ、会話履歴の考え方を整理します。
DeepSeekDeepSeek APIでブログ記事を100本下書きしたら何円かかる?DeepSeek APIでブログ記事の下書きを大量生成した場合の料金を、入力・出力・キャッシュ・レビュー工数まで含めて整理します。
API代回収AI API代は成果物で回収できる?個人サイト運営者向けの考え方AI API代をただの消える課金にせず、記事・計算機・テンプレ・比較表を作るための小さな仕入れとして考える方法を整理します。
API代回収OpenRouter Freeだけでどこまで試せる?有料化前の使い方OpenRouter Freeで試しやすい作業、有料APIに切り替えた方がよい作業、無料モデルを成果物化前の試作に使う考え方を整理します。
モデル比較Mistral Small 4はいくら?Small 3.1との違いと乗り換えの目安Mistral Small 4(mistral-small-2603)の位置づけと、Small 3.1(mistral-small-2506)との単価・用途の違い、乗り換えの目安を整理します。
モデル比較Claude Haiku 4.5とGPT-5.4 miniのコスパ比較:軽処理の選び方Claude Haiku 4.5とGPT-5.4 miniのAPI単価を、軽い高頻度処理での使い分けで比較し、個人開発のデフォルトモデル選びを整理します。
モデル比較Gemini 3系が出たら2.5系は使える?移行と料金の考え方Gemini 3.x系の登場で2.5系をどう扱うか、料金・互換・キャッシュを整理し、個人開発での乗り換え判断をまとめます。