本文へスキップ
モデル比較読了目安 10分

安いAI APIを比較|用途別料金と月額見積もり

DeepSeek、Qwen、Gemini、Mistral、Kimiなどの確認済みAI APIを、入力・出力・cache・用途・本番比較対象の違いから見比べます。

公開:2026-06-13更新:2026-08-07料金確認:2026-08-07
料金について:料金台帳は2026年8月7日に公式ページを確認し、通常の同期API・Standard・テキスト入出力・cacheなし・Batchなし・検索/画像/音声/ファイルなしを基準にしています。記事内の比較表は台帳から生成し、未確認・partial・ランキング除外モデルは通常比較へ混ぜません。

まず結論

安いAI APIは、入力が多いか、出力が多いか、cacheが効くか、検索やBatchを使うかで候補が変わります。「最安の1社」を固定するのではなく、同じ利用条件を料金台帳と見積もりツールへ入れて比較するのが安全です。

このページの表は、2026年8月7日に公式価格を確認できたモデルのうち、通常の標準テキスト比較へ参加できるものだけを台帳から表示します。料金はモデル・地域・コンテキスト長・機能条件で変わるため、最終的な採用前には公式Usageと請求画面を確認してください。

結論:低価格候補を見つける入口として使い、品質・データ取扱い・レート制限・追加料金を小さな実測で確認してから本番採用します。

安いAPIを比較するときの5つの軸

単価の大小だけでなく、同じ条件で品質と運用を比べます。入力と出力を別に見るだけで、チャット、要約、分類、記事下書きの順位が変わることがあります。

確認すること見積もりへの反映
入力毎回送る指示・履歴・参考文書入力トークンを実測または上限設定
出力返答長・最大出力・再生成出力トークンを別に入力
cache / Batch適用条件・TTL・遅延・割引通常価格と別ケースで計算
追加機能検索・画像・音声・ファイル・tool公式の別料金を通常表に混ぜない
運用品質、レート制限、地域、データ方針価格以外の採用条件として確認

低価格帯の候補をどう見るか

DeepSeek V4 Flash、Qwen Flash、Gemini Flash-Lite、Mistral Small、Claude Haiku、GPT-5.4 miniなどは、軽量処理や下書きの候補になります。ただし「安い」は入力・出力の組み合わせに対する言葉であり、すべてのタスクで最安とは限りません。

DeepSeek、Qwen、Kimiなど中国系の提供元を候補にする場合は、APIキー、顧客情報、個人情報、private repository全体をそのまま投入せず、契約・保存・学習利用・リージョン条件を確認します。価格確認とデータ方針の確認は別のゲートです。

表に載るモデル・載らないモデル

比較表は、公式一次情報で標準の入力・出力単価を確認でき、現行モデルで、通常比較の本番適格性を満たすモデルに限定します。partialは別途必須の料金が単一化できないため、blockedは公式単価を確認できないため、安い順の表へ入れません。

  • 掲載:pricingAuditStatus=confirmed、rankingEligibility=default、catalogStatus=current
  • 除外:Perplexityのようにtoken以外のrequest feeが必須で単一比較できないモデル
  • 別枠:cache、Batch、検索、長文コンテキスト、地域差、Thinkingなど条件付きの価格
  • 未確認:価格を推測せず、nullやblockedとして台帳に残す

用途別の選び方

まず品質の最低ラインを決め、そこを満たす候補だけを価格比較します。公開文章の下書き、短い分類、コード、重要なレビューでは必要な品質が違います。

用途最初に試す候補追加確認
短い分類・タグ付けQwen Flash / Gemini Flash-Lite / Claude Haiku誤分類率・無料枠・レート制限
公開文章の下書きDeepSeek V4 Flash / Qwen Flash / Mistral Small事実確認・データ方針・人間レビュー
一般的なチャットGPT-5.4 mini / Gemini Flash / Kimi K2.6履歴の長さ・最大出力・遅延
重要なコード・判断Claude Sonnet / GPT-5.5 / Gemini Pro品質・セキュリティ・レビュー工程
検索・最新情報Perplexity等を別見積token以外のrequest fee・検索条件

cache・Batch・検索は別ケースで見積もる

通常の単価表だけでは、実際の請求条件を全部表せません。cache hitは入力の一部だけに適用されることがあり、Batchは遅延や対象APIの条件があります。検索やtool callingはリクエスト単位、画像・音声・ファイルは入出力トークン以外の料金が発生することがあります。

まず通常価格で上限を置き、公式条件を確認できた場合だけcache・Batchなどの別ケースを試します。割引を先に織り込んで予算を小さく見せないことが重要です。

条件通常比較での扱い実装前に確認すること
cache read / prompt cache別列・別ケースprefix、TTL、hit率、保存料
Batch通常価格に混ぜない対象モデル、遅延、入出力単価
検索・tool別料金があれば除外request fee、検索結果、tool call単価
長文コンテキスト標準条件とは別閾値、地域、出力上限、契約

安いモデルは下書き、重要な確認は分ける

低価格モデルは記事構成、FAQ案、分類、比較表のたたき台に使いやすい一方、公開前の事実確認、機密情報、重要なコード、ユーザーに損失が出る判断は別のレビュー工程にします。安いAPI代だけで公開品質を保証できるわけではありません。

選び方のフロー

迷ったときは、価格順を先に決めず、公開範囲・機密性・品質の重み・処理量を順番に確認します。最後に見積もりと実測を突き合わせます。

  1. 入力・出力・回数を実測し、通常条件の上限を出す
  2. 公開情報だけか、個人情報・秘密情報を含むかを分ける
  3. 品質の最低ラインを小さなサンプルで確認する
  4. 料金台帳と見積もりツールで月額を比較する
  5. Usage、レート制限、エラー、レビュー工数を見て本番モデルを決める

まとめ

安いAI API探しは、単価の安い順に並べる作業ではありません。入力・出力・cache・Batch・検索を分け、確認済みの候補だけを同じ条件で比べ、品質と安全性の確認を残します。

最初は通常価格で小さく試し、低価格モデルで足りない処理だけ上位モデルへ回すと、予算と品質の両方を管理しやすくなります。

確認済み料金台帳から見る候補

2026-08-07基準の料金台帳から、公式確認済み・通常比較対象のモデルだけを表示しています。入力・出力・cache readは別列で、検索、画像、音声、ファイル、tool callingなどは含めません。

モデル / 提供元API model入力 / 100万出力 / 100万cache read確認日
Qwen FlashQwenqwen3.5-flashUS$0.029US$0.287別条件2026-08-07
DeepSeek V4 FlashDeepSeekdeepseek-v4-flashUS$0.140US$0.280US$0.0032026-08-07
Gemini Flash-LiteGooglegemini-2.5-flash-liteUS$0.100US$0.400US$0.0102026-08-07
Mistral SmallMistralmistral-small-latestUS$0.150US$0.600US$0.0152026-08-07
Claude Haiku 4.5Anthropicclaude-haiku-4-5US$1.000US$5.000US$0.1002026-08-07
GPT-5.4 miniOpenAIgpt-5.4-miniUS$0.750US$4.500US$0.0752026-08-07
Kimi K2.6Moonshot AIkimi-k2.6US$0.950US$4.000US$0.1602026-08-07
Qwen PlusQwenqwen3.7-plusUS$0.400US$1.600別条件2026-08-07
Gemini FlashGooglegemini-2.5-flashUS$0.300US$2.500US$0.0302026-08-07
DeepSeek V4 ProDeepSeekdeepseek-v4-proUS$0.435US$0.870US$0.0042026-08-07

表示単価は公式料金ページの基準単価。実際の請求はコンテキスト長、地域、無料枠、cache、Batch、検索などの条件で変わります。料金台帳をすべて見る

公式情報の確認先

よくある質問

この記事の条件で見積もる

記事で扱った利用イメージ(月間1,000回・入力約800・出力約800トークン)を、トークン見積所でそのまま再現できます。

この条件で見積もる

関連記事

コスト運用AI API料金高騰で何が変わる?安いモデルへの切り替え・ルーティング・予算管理ガイド

AI API料金が高くなる理由と、安いモデルへの切り替え、モデルルーティング、キャッシュ、短いコンテキスト、予算上限の考え方を個人開発者向けに整理します。

API基礎AI APIの入力トークン・出力トークンとは?料金が増える仕組み

AI API料金でよく出てくる入力トークン、出力トークン、キャッシュ、会話履歴の考え方を整理します。

DeepSeekDeepSeek APIでブログ記事を100本下書きしたら何円かかる?

DeepSeek APIでブログ記事の下書きを大量生成した場合の料金を、入力・出力・キャッシュ・レビュー工数まで含めて整理します。

API代回収AI API代は成果物で回収できる?個人サイト運営者向けの考え方

AI API代をただの消える課金にせず、記事・計算機・テンプレ・比較表を作るための小さな仕入れとして考える方法を整理します。

API代回収OpenRouter Freeだけでどこまで試せる?有料化前の使い方

OpenRouter Freeで試しやすい作業、有料APIに切り替えた方がよい作業、無料モデルを成果物化前の試作に使う考え方を整理します。

モデル比較Mistral Small 4はいくら?Small 3.1との違いと乗り換えの目安

Mistral Small 4(mistral-small-2603)の位置づけと、Small 3.1(mistral-small-2506)との単価・用途の違い、乗り換えの目安を整理します。

モデル比較Claude Haiku 4.5とGPT-5.4 miniのコスパ比較:軽処理の選び方

Claude Haiku 4.5とGPT-5.4 miniのAPI単価を、軽い高頻度処理での使い分けで比較し、個人開発のデフォルトモデル選びを整理します。

モデル比較Gemini 3系が出たら2.5系は使える?移行と料金の考え方

Gemini 3.x系の登場で2.5系をどう扱うか、料金・互換・キャッシュを整理し、個人開発での乗り換え判断をまとめます。

このテーマのほかの見方