最安の AI API プロバイダー: 6 つの低コスト オプションの比較

6 つの手頃な価格の AI API プロバイダーを、実際のモデルの価格、コーディングの使用例、各料金の背後にあるトレードオフで比較します。

Ethan ParkDIT.ai編集部
最安の AI API プロバイダー: 6 つの低コスト オプションの比較

要点

  • ここに記載されているレートが最も低いプロバイダーはどこですか? DeepInfra の Llama 3.1 8B Turbo は、100 万入力トークンあたり $0.02、100 万出力トークンあたり $0.04 です。この率は、カタログ内のすべてのモデルではなく、小型モデルに適用されます。
  • 複数のモデル系列を使うなら? DIT では、1 つの API キーで複数の開発元が提供する対応モデルにアクセスできます。モデル一覧に掲載されている GLM 5.3 Flash の料金は、入力 100 万トークンあたり $0.12、出力 100 万トークンあたり $0.40 です。利用前に実際の請求額を確認してください。
  • コーディングにはどの API を試しるべきですか? DIT の GLM 5.3 Flash、DeepSeek Flash、および Groq または Together AI の適切なモデルを独自のコーディング タスクに対してテストします。トークン レートが低いからといって、受け入れられる変更あたりのコストが下がるという保証はありません。
  • 最も安価な普遍的な AI API プロバイダーはありますか? いいえ、モデル、出力量、キャッシュの使用、処理層、および必要な品質によって料金が決まります。

最安の AI API プロバイダーの概要

以下の例は、2026 年 10 月 8 日にチェックされた、100 万入出力トークンあたりの公開された米ドル レートです。これらはさまざまなモデルを比較しているため、この表は同等の品質のランキングではなく、プロバイダー オプションの最終リストです。行に特に記載がない限り、標準的な有料の同期レートが表示されます。容量を購入する前に現在のレートを確認してください。 DIT の 最新モデル一覧 には、利用可能な市場レートが表示されます。

プロバイダーモデル例入力/1M出力 / 1Mベストフィット
DITGLM 5.3 Flash$0.12$0.40サポートされているモデルとマーケットルーティング用の 1 つの API
DeepInfraLlama 3.1 8B Instruct Turbo$0.02$0.04この候補リストで最も低いエントリー率
GroqGPT-OSS 20B$0.075$0.30サポートされているオープンモデルでの高速応答
Together AIQwen3.8 Flash$0.15$0.47ホスト型モデルの幅広い選択肢
Google Gemini APIGemini 2.5 Flash-Lite$0.10$0.40低コストのマルチモーダルでロングコンテキストのタスク
DeepSeek APIDeepSeek V4.1 Flash、オフピーク$0.15$0.60直接コーディングと推論 API

このモデルのDeepSeek に記載されているピーク レートは、$0.30 入力と $1.20 出力です。現在、DIT のカタログとモデル詳細ページには、GLM 5.3 Flash の異なる出力レートが表示されています。表はカタログ見積もりを使用していますので、ご購入前に料金をご確認ください。無料枠、バッチ価格、キャッシュされた入力、ツール、税金は表から除外されています。モデルの例は機能も異なります。小さな命令モデルはコーディング エージェントの直接の代替品ではありません。

6 つの手頃な価格の AI API プロバイダー

DIT: 市場価格によるマルチプロバイダー アクセス

DIT は、1 つの API キーと互換性のあるエンドポイントを通じてサポートされているモデルを呼び出したいチームのための AI トークン交換です。価格、品質、入手可能性のシグナルを使用して適格な供給ルートを評価します。これは、要件の変化に応じてアプリケーションのモデルやプロバイダーを切り替える可能性がある場合に役立ちます。

具体的な価格の例として、DIT の モデルカタログ は、100 万トークンごとに $0.12 入力と $0.40 出力で GLM 5.3 Flash をリストします。そのモデルの詳細ページでは、コーディング、ツールの使用、および意図されたアプリケーションとしてのロングコンテキストの作業について説明していますが、現在は異なる出力レートが表示されています。これはモデル固有の見積もりであり、DIT がすべての直接 API またはホスト API よりも安いという約束ではありません。使用する予定のモデルの料金、エンドポイントのサポート、およびルートの可用性を確認してください。

最適な用途: 複数のモデル ファミリを必要とするアプリケーション、または個別のプロバイダー統合を行わずに代替供給パスをテストしたいアプリケーション。 注意事項: ルーティング層は、遅延、機能、プライバシー、および信頼性の要件を満たしている必要があります。対象となるルートが 1 つしかないモデルでは、そのリクエストに対してプロバイダー フェールオーバーを提供できません。

低コストの API スタックに DIT を使用する方法:

  1. DIT API キーを 1 つ作成し、タスクの品質要件を満たすサポートされているモデルを選択します。
  2. OpenAI 互換クライアントのベース URL を https://api.dit.ai/v1 に設定し、代表的なリクエストのセットを送信します。
  3. トラフィックをさらに移動する前に、請求料金、応答品質、遅延、完了したタスクを比較します。

DeepInfra: 小規模オープンモデルの非常に低いレート

DeepInfra の Llama 3.1 8B Instruct Turbo は、100 万トークンごとに $0.02 入力と $0.04 出力にリストされます。これは、この記事の代表的なモデルの中で最も低い支払いトークン レートです。また、その OpenAI 互換 API により、そのリクエスト形式をすでに使用しているチームの統合作業も軽減されます。

用途: 分類、抽出、短い回答、および小さなモデルが品質チェックに合格するその他のタスク。 注意してください: 低レートは特定の 8B モデルに属します。複雑なコーディング タスクでは、別のより高価なモデルや数回の再試行が必要になる場合があります。

Groq: サポートされているモデルでの高速応答

Groq は、$0.075 入力で GPT-OSS 20B をリストし、100 万トークンごとに $0.30 を出力します。そのモデルの公開速度は 1 秒あたり約 1,000 出力トークンです。これは、インタラクティブ機能に迅速な初期応答が必要であり、モデルの機能がジョブに一致する場合に有用な候補です。

最適な用途: Groq の現在のカタログに適した、応答性の高いアシスタント、シンプルなコード ヘルプ、および大量のタスク。 注意事項: 正確なモデル、レート制限、コンテキスト ウィンドウ、およびツールのサポートを確認してください。高速生成だけでは、応答が有用になったり、ワークロードが安くなったりするわけではありません。

Together AI: 幅広いホスト型モデルの選択

Together AI は、多くのオープン モデルにわたってサーバーレス推論を提供し、それを必要とするチームに専用の容量を提供します。現在の価格リストには、100 万トークンあたりの$0.15 入力と $0.47 出力での Qwen3.8 Flash が表示されます。広範なカタログは、より高いトークン価格を正当化するのに十分なほど、より高性能なモデルがエラーを削減するかどうかをテストするのに役立ちます。

最適な用途: 複数のオープン モデルを評価するチーム、または可変サーバーレス トラフィックから専用スループットに移行するチーム。 注意事項: 価格と機能はモデルと展開の種類によって異なります。選択したエンドポイントが、アプリケーションが必要とするツール、コンテキストの長さ、出力形式をサポートしていることを確認してください。

Google Gemini API: 低コストのマルチモーダル用途

Google は、標準有料レベルの 100 万トークンごとに $0.10 入力に Gemini 2.5 Flash-Lite をリストし、$0.40 を出力します。テキスト、画像、ビデオの入力を受け入れ、Google はモデル固有の制限に従って無料アクセスもリストしています。ジョブが待機できる場合、バッチ処理の公開レートは低くなります。

最適な用途: テキストと他の入力タイプを組み合わせる大量の軽量タスク、または Google のモデル ファミリーでのロングコンテキストの実験。 注意してください: 無料枠の割り当てと、オーディオ、キャッシュ、ストレージ、およびグラウンディングの課金ルールは、通常のテキスト リクエストとは異なります。無料料金またはバッチ料金を実稼働価格として扱う前に、請求可能な単位を比較してください。 AI モデルの価格ガイド では、そのための実践的な方法について説明しています。

DeepSeek API: コーディングと推論のための直接アクセス

DeepSeek の現在の Flash モデルは DeepSeek V4.1 Flash で、deepseek-flash モデル ID を通じて呼び出されます。公開されているオフピークレートは、100 万トークンあたりの$0.15 インプットと $0.60 アウトプットです。ピークレートは2倍です。 API ドキュメントには、ツール呼び出し、JSON 出力、大きなコンテキスト ウィンドウ、および OpenAI と Anthropic リクエスト形式の両方がリストされています。

最適な用途: コーディング、ツールベースのエージェント、および推論タスク用の直接 API を必要とするチーム。 注意: 最も安価なスケジュールは、リクエストがいつ実行されるか、およびキャッシュされた入力が別のレートの対象となるかどうかによって異なります。新しいアプリケーションを構成するときは、古い V4 フラッシュ エイリアスではなく現在のモデル ID を使用してください。

コーディング用の最も安い AI API: どのプロバイダーが適していますか?

日常的なコードの説明、書式設定、および限定的な編集の場合は、低コストのモデルから始めて、その出力がテストまたはレビューに合格するかどうかを測定します。 Groq の GPT-OSS 20B、Together AI の Qwen3.8 Flash、および DIT の GLM 5.3 Flash がテストの具体的な候補です。 DeepInfra の 8B の例は、単純な機械的タスクには十分安価かもしれませんが、その定価だけでは複数ファイル変更のパフォーマンスについてはほとんどわかりません。

デバッグ、ツール ループ、およびリポジトリ全体の編集については、DIT のコーディング可能なモデルを、DeepSeek Flash および必要なコンテキストとツールをサポートする他のモデルと比較してください。各ルートで同じタスクを実行します。成功した変更、再試行、人による修正、入出力トークン、待ち時間を記録します。受け入れられた結果ごとのコストに基づいて選択し、ワークロードが変化したときに再評価します。 DIT の ルーティング戦略ガイド は、その決定の背後にある価格、品質、入手可能性のシグナルをカバーしています。

ワークロードに最も安価な LLM API プロバイダーを選択する方法

最初に正確なタスクごとに候補リストを作成します。軽量の要求を確実に完了できる場合、小型で安価なモデルが適切な選択となります。 1 つのモデルのネイティブ機能が不可欠な場合、直接プロバイダーが合理的です。マルチプロバイダー サービスは、サポートされているモデルや供給ルートを 1 つの統合を通じて比較する必要がある場合にさらに役立ちます。 DIT の ゲートウェイとダイレクト API ガイド は、その運用上のトレードオフを示しています。

次に、代表的なプロンプトから請求額を見積もります: 入力トークン × 入力レート、プラス出力トークン × 出力レート、さらにキャッシュされた入力、再試行、および追加料金。総支出を成功した結果で割ります。この計算により、リストに記載されているレートが低いと、高価な障害が発生する場合が明らかになります。プロバイダーを選択した後に料金を削減するその他の方法については、LLM API コストの最適化 を参照してください。

最も安価な AI API プロバイダーは、測定コストが最も低く、品質と運用要件を満たすプロバイダーです。価格表を最新の状態に保ち、モデル、トラフィック ミックス、プロバイダー条件が変更されるたびに比較を再実行します。

よりスマートにルーティングする準備はできていますか?

1つのDITキーを使用して、認定されたAIプロバイダーのマーケットを通じてサポートされているモデルにアクセスしましょう。

APIキーを取得