大半の「無料LLM API」プランは無制限アクセスではなく、レート制限付きモデル、1日のリクエスト割り当て、または紹介クレジットです。この比較では、検証済みの無料プラン仕組みと具体的な数値を持つ6つのプロバイダーを紹介します。構築を始める前に「無料」が実際に何を提供するのか正確に把握できます。
無料LLM APIのクイック比較
| プロバイダー | 無料プランの種類 | 具体的な制限 | 対応モデル |
|---|---|---|---|
| Novita AI | 紹介クレジット(双方) | 紹介成功ごとに紹介者と招待された新規アカウントの両方に$10のクレジット、最大$500まで | サーバーレスLLM API全カタログ |
| OpenRouter | レート制限付き無料モデル | 20リクエスト/分、購入クレジットなしの場合50リクエスト/日、生涯クレジット$10以上で1,000リクエスト/日 | 414モデル中17モデルが:freeバリアント対応 |
| Google Gemini API | 無料のフラッグシップトークン、Groundingには課金が必要 | Gemini 3.7 Flashで入出力・コンテキストキャッシュが課金有効化なしで$0、Google Search Groundingは課金有効化まで利用不可、有効化後は月5,000リクエストまで | Gemini 3.xモデルファミリー |
| Groq | モデル別レート制限付き無料プラン | openai/gpt-oss-120bで30リクエスト/分、1,000リクエスト/日、200Kトークン/日 |
13のホステッドモデル(プロダクションおよびプレビュー) |
| Cloudflare Workers AI | 1日のコンピュート割り当て | FreeおよびPaid Workersプランで1日10,000ニューロンまで無料 | 84のホステッドモデル(2026-08-18時点、随時更新) |
| Hugging Face Inference Providers | 月額クレジット | Freeアカウントで月額$0.10 | 18のパートナー推論プロバイダーにわたる数百モデル |
主なポイント
- このリストのプロバイダーで無制限の無料LLM APIアクセスを提供しているものはありません。すべての無料プランはリクエストレート、1日の上限、またはドル建てクレジットで制限されています。
- クレジットベースの無料プラン(Novita AI、Hugging Face)は1分あたりのリクエスト数を制限しません。レート制限付き無料プラン(OpenRouter、Groq)は制限があり、その上限はモデルに固有です。
- OpenRouterの
:freeバリアントはカタログの一部(確認時点で414モデル中17モデル)のみで、マーケットプレイス全体ではありません。 - Googleの無料プランはモデルと機能に固有です。現在のフラッグシップFlashモデルでのトークン価格は課金有効化なしで$0ですが、Search Groundingはその無課金プランには含まれません。課金を有効化して初めて利用可能になり、別途月間上限が適用されます。
- 無料プランの数値は予告なく変更されることがあります。以下のすべての数値には出典と確認日があります。本番環境で依存する前に必ず再確認してください。
これらの無料LLM APIの比較方法
既存の「無料LLM API」まとめのほとんどは、具体的な数値を省いたり、Novita AIを完全に除外したり、更新間で情報が古くなったりします。この比較では、すべての行に対して3つのチェックを行っています。
- 明示された無料プランの仕組み。 各プロバイダーの無料アクセスは、一回限りのサインアップまたは紹介クレジット、レート制限付き無料モデル、または1日のコンピュート・リクエスト割り当ての3つの形式のいずれかに分類されます。
- 検証済みの数値制限。 毎分リクエスト数、毎日リクエスト数、ドル金額、トークン上限のすべてが、プロバイダー自身の最新の価格またはレート制限ドキュメントから取得されており、二次的なブログ記事からではありません。
- 確認時点での最新ステータス。 無料プランの条件は頻繁に変わります(OpenRouterの高日次制限のしきい値、Googleのモデル別無料価格、Cloudflareのニューロン割り当てなどは過去のサイクルで変更されています)。したがって、以下のすべての数値には日付が付されています。
プロバイダーは、公開されている1日の無料割り当ての大まかなサイズ順にリストされています。クレジットベースのプラン(リクエスト数で制限されない)は、代わりにドル建ての上限で配置されています。
詳細比較:無料LLM API
Cloudflare Workers AI:最大の生の日次割り当て
CloudflareのWorkers AIは、Free Workersプランを含むすべてのアカウントに、モデル別のリクエスト上限ではなく、1日の固定ニューロン割り当てを提供します。確認時点で、その割り当ては1日10,000ニューロまで無料で、それを超える使用量はPaidプランで1,000ニューロあた$0.011が請求されます。ニューロンコストはモデルに依存するため、10,000ニューロは、呼び出すモデルによっで実際のリクエスト数が異なります。
最適な用途: すでにCloudflare Workersを実行しているチームで、同一プラットフォームに推論をバンドルしたい場合。 注意点: 無料割り当てはニューロン単位であり、リクエスト単位ではありません。大規模または長コンテキストのモデルは、小規模モデルよりも早く消費します。
OpenRouter:最も広いカタログ、狭い無料スライス
OpenRouterは多くのプロバイダーから数百のモデルにルーティングしますが、:freeサフィックスを持つのは一部のみです。確認時点で、414のカタログモデルのうち17モデルに無料バリアントがありました。無料バリアントは1分あたり20リクエストに制限されています。1日の上限はアカウントの生涯クレジット購入額に依存し、合計$10未満のクレジットを購入した場合は1日50リクエスト、$10以上購入すると1日1,000リクエストに増加します。
モデルファミリー固有の例については、現在の無料GLM APIオプションと各ルートに付随する制限を参照してください。
最適な用途: プロバイダーにコミットせずに、たまたま:freeバリアントがある特定のオープンウェイトモデルをテストする場合。
注意点: 無料スライスはカタログのごく一部であり、実用的な1日上限にはサインアップだけでなく、一回限りの$10クレジット購入が必要です。
Groq:最速の推論、最小のカタログ
Groqの無料プランはアカウント全体ではなくモデルごとにレート制限されます。openai/gpt-oss-120bの場合、公表されている制限は1分あたり30リクエスト、1日あたり1,000リクエスト、1分あたり8,000トークン、1日あたり200,000トーケンです。Groqの無料プランにある他のホステッドモデルには、それぞれ別途の制限があります。
最適な用途: Groqの推論速度がモデルの豊富さよりも重要となる、低レイテンシのプロトタイピング。 注意点: 制限はモデルごとに設定されているため、プロジェクトの途中でモデルを切り替えると、制限表を読み直す必要があります。
Google Gemini API:無料のフラッグシップトークン、限定的なGrounding上限
まだ設定していない場合は、以下の制限を確認する前に、Google AI StudioでのGemini APIキーの取得方法を参照してください。Geminiの無料プランは、一律の割り当てではなく、モデルと機能ごとに価格設定されています。現在のフラッグシップモデルGemini 3.7 Flashでは、入力価格、出力価格、コンテキストキャッシング価格はすべて、アカウントで課金が有効化されていない限り無料として表示されます。別のアドオン機能であるGoogle Search Groundingは、課金が有効化されていない状態ではまったく利用できません。課金をオンにして初めて使用可能になり、その時点で有料プランにはGemini 3.xモデルファミリー全体で月間5,000の無料Groundingリクエストが含まれ、それを超えると1,000リクエストあた$14が請求されます。
最適な用途: 現在のフラッグシップモデルでトークンコストを$0にし、Search Groundingを課金有効化なしで必要としないチーム。 注意点: トークンレベルの無料価格とSearch Groundingは同じプランではありません。Groundingは、どのリクエスト割り当てが存在する前に課金をオンにする必要があるため、純粋な無課金アカウントでは grounded な回答を得ることはできません。
Hugging Face Inference Providers:最小のクレジット、最低の摩擦
すべてのHugging Faceアカウントには、オープンモデルのサーードパーティ推論バックエンドにルーティングするマーケットプレイスであるInference Providers向けの月額クレジットが付与されます。Freeアカウントは月額$0.10、PROアカウントは月額$2.00、TeamまたはEnterpriseアカウントはシートあたり月額$2.00です。
最適な用途: すでにHugging Faceのプロバイダーマーケットプレイスを通じてホストされているオープンモデルに対する迅速な一回限りの呼び出し。 注意点: 月額$0.10では、ほとんどのモデルで少数の呼び出ししかカバーできません。毎月リセットされますが、繰り越しや積み立てはできません。
Novita AI:レート制限付き無料モデルなし、ただし実際の紹介クレジットあり
Novita AIのサーバーレスLLM APIカタログはモデルごとに価格設定されており、現在のカタログには$0/トークンのモデルはありません。代わりに、Novitaの紹介プログラムから無料アクセスの仕組みが提供されます。紹介が成功すると、紹介者と招待された新規アカウントの両方に、LLM APIクレジットとして$10が付与され、一人の紹介者は合計で最大$500のクレジットを得られます。そのクレジットは、単一の無料モデルではなく、Novitaのサーバーレスモデルカタログ全体に適用されるため、OpenRouterやGroqの無料プランのように1分あたりまたは1日あたりのリクエスト数で制限されることはありません。
最適な用途: 別途制限のある無料モデルではなく、プロダクショングレードのモデル価格と可用性に対して無料使用を希望する開発者。 注意点: クレジットは紹介によるものであり、すべての新規サインアップに自動的に付与されるものではありません。また、無制限の無料モデルではなく、支出枠です。使い切ると、標準のトークン価格が適用されます。特定のクレジットがどの程度の使用量に相当するかを推定する前に、最新の料金については必ずNovitaの現在の価格ページを確認してください。
適切な無料LLM APIの選び方
無料プランの仕組みを実際の用途に合わせてください。
- 1つのオープンモデルに対して多数の小規模なテスト呼び出しを実行する場合: 必要なモデルに無料バリアントがある限り、レート制限付き無料プラン(OpenRouterの
:freeバリアントまたはGroq)で実際のリクエストボリュームを得られます。 - 出荷する可能性のあるプロダクションモデルに対してプロトタイピングを行う場合: 紹介クレジット(Novita AI)を使用すると、無料プランから卒業するときにモデルを切り替える代わりに、本番環境と同じカタログと価格設定に対して支出できます。
- 複数のプロバイダーやモデルを迅速にテストする場合: Hugging FaceのInference Providersクレジットは少額ですが、すでにアカウントを持っていれば最もセットアップが簡単です。
- 生のモデル呼び出しだけでなく、検索に基づいた回答が必要な場合: 特にGoogleのGroundingの上限を確認してください。これは無課金の無料プランにはまったく含まれていません。Groundingリクエストが(有料プランの)月間上限にカウントされる前に、課金を有効化する必要があります。
どのプランを選ぶ場合でも、構築を始める前にプロバイダー自身の最新のレート制限または価格ページを読んでください。上記のすべての数値には確認日があり、無料プランの条件はどの推論プラットフォームでも最も頻繁に改訂されるペーじの一でつです。
この比較が対象としないユーザー
上記のどのプランも、本番トラフィックを処理するようには設計されていません。アプリケーションがすでに1日数千リクエストを一貫して必要としている場合、サポートSLAが必要な場合、またはGPT-5やClaudeのようなクローズドなフロンティアモデルへのアクセスが必要な場合、ここに挙げた6つのプロバイダーのいずれも無料プランでは提供していません。どのプロバイダーを選んでも、有料使用が必要になります。また、この比較は出荷前に各プロバイダーの現在の利用規約を読む代わりにはなりません。各無料プランが確認日時点でどのような状態であったかを示すものであり、実際にキャパシティが必要になった時点でどのようになっているかを示すものではありません。
Novita AIでの無料クレジットの使用方法
Novita AIの紹介クレジットを使用するには:
- 友人の紹介リンクからNovita AIアカウントを作成するか、自身のリンクを使って友人を招待し、双方が$10の紹介クレジットを受け取ります。
- Novita AIコンソールからAPIキーを生成します。
- OpenAI互換のエンドポイント
https://api.novita.ai/openai/v1/chat/completionsにAPIキーと現在のカタログからモデルIDを使用して、サーバーレスLLM APIカタログ内の任意のモデルを呼び出します。 - Novita AI紹介ページから紹介リンクを共有し、紹介成功ごとに$10のクレジットを追加します(最大$500まで)。
curl https://api.novita.ai/openai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <NOVITA_API_KEY>" \
-d '{
"model": "<MODEL_ID>",
"messages": [{"role": "user", "content": "Hello"}],
"max_tokens": 512
}'
特定のモデルに対してクレジットを使用する前に、Novita AIモデルカタログで現在のモデルIDとモデルごとの価格を確認してください。
価格、ライセンス、可用性に関する注意事項
この比較の無料プラン条件は、2026-08-18に各プロバイダー自身の価格またはレート制限ドキュメントから直接確認しました。サインアップクレジット、紹介上限、レート制限、1日あたの割り当ては、プロバイダーが通常の製品アプデートで変える種類の詳細であり、常にチェンジログエントリがあるわけではありません。本番計画で特定の数値に依存する前に、プロバイダーのソースページを再確認し、上記のすべての数値を恒久的な保証ではなくスナップショットとして扱ってください。
開発者向け意思決定チェックリスト
- [ ] 該当する無料プランの形式を確認する(サインアップクレジット、紹介クレジット、レート制限付き無料モデル、または1日のコンピュート割り当て)。
- [ ] 必要なモデルが、プロバイダー全般ではなく、その無料プランでカバーされていることを確認する。
- [ ] 特定の数値制限(リクエスト/分、リクエスト/日、トークン/日、またはドル建てクレジット)を、この記事ではなく、プロバイダーの現在のドキュメントで確認してから、それに依存するものを出荷する。
- [ ] 無料プランで、より高い制限を適用するために購入クレジットのしきい値が必要かどうかを確認する(OpenRouterの場合のように)。
- [ ] 無料プランを使い切った場合の対応を計画する。単に課金が開始されるのか、リクエストが拒否されるのか。
FAQ
本当に無制限の無料LLM APIはありますか?
いいえ。ここで比較したすべてのプロバイダーは、無料使用をレート制限、1日の上限、またはドル建てクレジットで制限しています。「無料」としてマーケティングされているプロバイダーは、無制限アクセスではなく、制限付きプランを説明しています。
1日あたりのリクエスト上限が最もの高い無料LLM APIはどれですか?
確認したレート制限付き無料プランの中で、OpenRouterとGroqは、OpenRouterの生涯クレジット$10のしきい値を満たした場、それぞれの無料プランモデルに対して1日1,000リクエストの上限を公開しています。Cloudflare Workers AIの1日10,000ニューロンの割り当ては、固定リクエスト数ではなくコンピュート予算であるため、単一の比較可能なリクエスト数には変換されません。
Novita AIは無料のLLMモデルを提供していますか?
Novita AIの現在のサーバーレスLLM APIカタログには、$0/トークンのモデルはありません。その無料プランの仕組みは、紹介プログラムであり、紹介が成功するごとに紹介者と招待された新規アカウントの両方に$10のクレジットを提供し、サーバーレスカタログ全体に対して使用できる最大$500までのクレジットです。
無料プランの制限はAPIキーごとですか、アカウントごとですか?
これはプロバイダーによって異なり、各プロバイダーのレート制限ペーじに文書されています。たとえば、Groqは制限が個別のAPIキーではなク、組織ベルで適用されると明記しています。リクエストの統合動作を仮定する前に、該当するプロバイダーのドキュメントでアカウントとキーの区別を確認してください。
