ほとんどの「無料LLM API」プランは無制限アクセスではありません。レート制限付きモデル、1日のリクエスト割り当て、または紹介クレジットのいずれかです。この比較では、6つのプロバイダーを取り上げ、それぞれに検証済みの無料プランの仕組みと具体的な数値を添付しているので、実際に組み込み始める前に「無料」が何をもたらすのかを正確に確認できます。
無料LLM APIのクイック比較
| プロバイダー | 無料プランの種類 | 具体的な制限 | 対象モデル |
|---|---|---|---|
| Novita AI | 紹介クレジット(双方) | 紹介が成立するごとに紹介者と新規紹介アカウントの両方に$10のクレジット、最大合計$500 | サーバーレスLLM APIカタログ全体 |
| OpenRouter | レート制限付き無料モデルバリアント | 20リクエスト/分。クレジット未購入の場合は50リクエスト/日、$10以上の累計クレジットがある場合は1,000リクエスト/日 | カタログの414モデルのうち17モデルが:freeバリアントを提供 |
| Google Gemini API | 無料のフラッグシップトークン。groundingには支払い設定が必要 | Gemini 3.7 Flashで支払い設定を有効にしない場合、トークン単位の入力/出力/コンテキストキャッシュが$0。Google検索によるGroundingは支払い設定を有効にするまで利用できず、有効後は月5,000リクエストに制限 | Gemini 3.xモデルファミリー |
| Groq | モデルごとのレート制限付き無料プラン | openai/gpt-oss-120bで30リクエスト/分、1,000リクエスト/日、200Kトークン/日 |
本番/プレビューの各プランにまたがる13のホストモデル |
| Cloudflare Workers AI | 1日のコンピュート割り当て | FreeおよびPaid Workersプランの両方で1日あたり10,000ニューロンを無料で利用可能 | 2026-08-18時点で84のホストモデル(カタログは継続的に更新) |
| Hugging Face Inference Providers | 月額クレジット | Freeプランのアカウントは月額$0.10 | 18のパートナー推論プロバイダーにわたる数百のモデル |
重要なポイント
- このリストのプロバイダーはどれも、無制限の無料LLM APIアクセスを提供していません。すべての無料プランは、リクエストレート、1日の上限、またはドル建てクレジットによって制限されています。
- クレジットベースの無料プラン(Novita AI、Hugging Face)は1分あたりのリクエスト数を制限しません。レート制限付きの無料プラン(OpenRouter、Groq)は制限し、その上限はモデル固有です。
- OpenRouterの
:freeバリアントは、マーケットプレイス全体ではなく、カタログの一部(確認時点で414モデル中17モデル)にのみ存在します。 - Googleの無料プランはモデルと機能に固有です。現在のフラッグシップFlashモデルのトークン価格は、支払い設定を有効にしなければ$0ですが、Google検索によるgroundingはその支払い不要プランには一切含まれません。支払い設定を有効にした時点で、別途の月間上限付きで利用可能になります。
- 無料プランの数値は予告なく変わることがあります。以下のすべての数値には出典と確認日があります。いずれかに本番依存する前に再確認してください。
無料LLM APIの比較方法
既存の「無料LLM API」まとめ記事の多くは、具体的な数値を省略するか、Novita AIを完全にスキップするか、更新の間に古くなってしまいます。この比較では、すべての行について3つのチェックを行っています。
- 明示された無料プランの仕組み。 各プロバイダーの無料アクセスは、1回限りのサインアップまたは紹介クレジット、レート制限付きの無料モデル、または1日のコンピュート/リクエスト割り当てのいずれかに該当します。
- 検証済みの数値制限。 毎分リクエスト数、毎日リクエスト数、ドル金額、トークン上限はすべて、二次情報のブログ記事ではなく、プロバイダー自身の現在の価格またはレート制限ドキュメントから取得しています。
- 確認時点のライブステータス。 無料プランの条件は頻繁に変わります(OpenRouterのより高い1日制限のしきい値、Googleのモデルごとの無料価格、Cloudflareのニューロン割り当ては、過去のサイクルですべて変更されています)。そのため、以下の数値はすべて日付付きです。
プロバイダーは、公開されている場合は1日の無料割り当ての概算サイズ順にリストされ、クレジットベースのプラン(リクエスト数による制限がない)は、代わりにドル上限で配置されています。
無料LLM APIの詳細比較
Cloudflare Workers AI:最大の1日割り当て
Cloudflare Workers AIは、Free Workersプランを含むすべてのアカウントに、モデルごとのリクエスト上限ではなく、毎日一定量のニューロン割り当てを提供します。確認時点では、その割り当ては1日あたり10,000ニューロンが無料で、Paidプランでは、超過分が1,000ニューロンあたり$0.011で請求されます。ニューロンのコストはモデルによって異なるため、10,000ニューロンが実際に何回のリクエストに相当するかは、呼び出すモデルによって異なります。
最適な用途: すでにCloudflare Workers上で運用しており、推論を同じプラットフォームに組み込みたいチーム。 注意点: 無料割り当てはリクエスト数ではなくニューロン単位です。そのため、大規模または長いコンテキストのモデルは、小規模なモデルよりも速く消費します。
OpenRouter:広範なカタログ、狭い無料枠
OpenRouterは多数のプロバイダーの何百ものモデルにルーティングしますが、:free サフィックスを持つモデルは一部だけです。確認時点では、カタログの414モデルのうち17モデルに無料バリアントがありました。無料バリアントは1分あたり20リクエストに制限されています。1日の上限はアカウントの累計クレジット購入額に依存し、合計で$10未満のクレジットを購入している場合は1日50リクエスト、少なくとも$10を購入すると1日1,000リクエストに引き上げられます。
最適な用途: 特定のプロバイダーにコミットせずに、たまたま:freeバリアントがある特定のオープンウェイトモデルをテストする場合。
注意点: 無料枠はカタログのごく一部であり、実用的な1日の上限を利用するには、サインアップだけでなく、1回限りの$10クレジット購入が必要です。
Groq:最速の推論、最小のカタログ
Groqの無料プランはアカウント全体ではなくモデルごとにレート制限されます。openai/gpt-oss-120bの場合、公開されている制限は、1分あたり30リクエスト、1日あたり1,000リクエスト、1分あたり8,000トークン、1日あたり200,000トークンです。Groqの無料プランで利用できる他のホストモデルには、それぞれ別の制限があります。
最適な用途: モデルの豊富さよりもGroqの推論速度が重要となる、低レイテンシのプロトタイピング。 注意点: 制限はモデルごとに設定されているため、プロジェクト途中でモデルを切り替えると、制限テーブルを読み直す必要があります。
Google Gemini API:無料のフラッグシップトークン、限定的なグラウンディング上限
Geminiの無料プランは、一律の割り当てではなく、モデルと機能ごとに価格設定されています。現在のフラッグシップモデルであるGemini 3.7 Flashでは、アカウントで支払い設定が有効になっていない限り、入力価格、出力価格、コンテキストキャッシュ価格はすべて無料と記載されています。別のアドオン機能であるGoogle検索によるGroundingは、支払い設定が有効でないとまったく利用できません。支払い設定を有効にすると、有料プランにはGemini 3.xモデルファミリー全体で共有される月5,000回の無料グラウンディングリクエストが含まれ、その後は1,000リクエストあたり$14で請求されます。
最適な用途: 現在のフラッグシップモデルでトークンコストを$0にしたいが、支払い設定を有効にせずにGoogle検索によるGroundingを必要としないチーム。 注意点: トークンレベルの無料価格とGoogle検索によるGroundingは同じプランではありません。Groundingは、リクエスト割り当てが存在する前に支払い設定をオンにする必要があるため、完全に支払い不要のアカウントではグラウンディングされた回答を得られません。
Hugging Face Inference Providers:最小のクレジット、最低限の手間
すべてのHugging Faceアカウントには、オープンモデル向けにサードパーティの推論バックエンドへルーティングするマーケットプレイスであるInference Providers向けの月額クレジットが付与されます。Freeプランのアカウントは月額$0.10、PROアカウントは月額$2.00、TeamまたはEnterpriseアカウントはシートあたり月額$2.00です。
最適な用途: Hugging Faceのプロバイダーマーケットプレイスで既にホストされているオープンモデルに対する、手軽な単発呼び出し。 注意点: 月額$0.10は、ほとんどのモデルで少量の呼び出ししかカバーしません。毎月リセットされますが、繰り越しや積み立てはできません。
Novita AI:レート制限付き無料モデルはないが、実際の紹介クレジットあり
Novita AIのサーバーレスLLM APIカタログはモデルごとに価格設定されており、現在のカタログ内にトークンあたり$0のモデルはありません。無料プランの仕組みは、代わりにNovitaの紹介プログラムによるものです。紹介が成立すると、紹介者と新規紹介アカウントの両方にLLM APIクレジットとして$10が付与され、紹介者1人につき合計最大$500まで受け取れます。このクレジットは単一の無料モデルではなくNovitaのサーバーレスモデルカタログ全体に適用されるため、OpenRouterやGroqの無料プランのように1分あたりや1日あたりのリクエスト数で制限されません。
最適な用途: 別途制限のある無料モデルではなく、本番グレードのモデル価格と可用性に対して無料利用を希望する開発者。 注意点: クレジットは紹介経由でのみ得られるもので、すべての新規サインアップに自動付与されるわけではありません。また、無制限の無料モデルではなく利用枠です。使い切ると、標準のトークン単価が適用されます。クレジットがどの程度使えるかを推定する前に、必ずNovitaの現在の価格ページで最新レートを確認してください。
適切な無料LLM APIの選び方
実際に行っている作業に合わせて、無料プランの仕組みを選んでください。
- 1つのオープンモデルに対して大量の小規模テスト呼び出しを行う場合: レート制限付きの無料プラン(OpenRouterの
:freeバリアントやGroq)なら、必要なモデルに無料バリアントがあれば、費用をかけずに実際のリクエスト量を得られます。 - 本番で使うかもしれないプロダクションモデルでプロトタイピングする場合: 紹介クレジット(Novita AI)なら、無料プランから卒業するときにモデルを切り替える代わりに、本番と同じカタログと価格に対して利用できます。
- 複数のプロバイダーやモデルを素早くテストする場合: Hugging FaceのInference Providersクレジットは少額ですが、すでにアカウントがあれば最もセットアップが少なくて済みます。
- 単なるモデル呼び出しではなく、検索グラウンディングされた回答が必要な場合: Googleのグラウンディング上限を具体的に確認してください。これは支払い不要の無料プランにはまったく含まれません。グラウンディングリクエストが(有料プランの)月間上限にカウントされる前に、支払い設定を有効にする必要があります。
どのプランを選ぶ場合でも、構築を始める前にプロバイダー自身の現在のレート制限または価格ページを読んでください。上記のすべての数値には確認日があり、無料プランの条件はどの推論プラットフォームでも最も頻繁に改訂されるページの1つです。
この比較が向かない人
上記のどのプランも、本番トラフィックを支えるようには設計されていません。アプリがすでに毎日数千リクエスト以上を安定的に必要としている場合、サポートSLAが必要な場合、またはGPT-5やClaudeのようなクローズドなフロンティアモデルへのアクセスが必要な場合、ここで取り上げた6つのプロバイダーのうち、無料プランでそれを提供しているところはありません。どれを選んでも有料利用が必要になります。また、この比較は、リリース前にプロバイダー自身の現在の利用規約を読む代わりにはなりません。各無料プランが確認日時点でどのような状態だったかを示すものであり、実際にキャパシティが必要になった時点での状態を示すものではありません。
Novita AIで無料クレジットを使う
Novita AIの紹介クレジットを利用するには:
- 友人の紹介リンクからNovita AIアカウントを作成するか、自分のリンクで友人を招待して、両方が$10の紹介クレジットを受け取ります。
- Novita AIコンソールからAPIキーを生成します。
- OpenAI互換エンドポイント
https://api.novita.ai/openai/v1/chat/completionsを介して、サーバーレスLLM APIカタログ内の任意のモデルを、APIキーと現在のカタログのモデルIDを使用して呼び出します。 - Novita AI紹介ページから紹介リンクを共有すると、紹介が成立するごとに$10のクレジットが追加され、合計で最大$500になります。
curl https://api.novita.ai/openai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <NOVITA_API_KEY>" \
-d '{
"model": "<MODEL_ID>",
"messages": [{"role": "user", "content": "Hello"}],
"max_tokens": 512
}'
特定のモデルにクレジットを使う前に、Novita AIモデルカタログで現在のモデルIDとモデルごとの価格を確認してください。
価格、ライセンス、利用可否に関する注意
この比較における無料プランの条件は、2026-08-18に各プロバイダー自身の価格またはレート制限ドキュメントを直接確認したものです。サインアップクレジット、紹介上限、レート制限、1日の割り当ては、プロバイダーが通常の製品アップデートで変更する種類の詳細であり、常にチェンジログの記録があるわけではありません。本番計画で特定の数値に依存する前に、必ずプロバイダーのソースページを再確認し、上記のすべての数値を恒久的な保証ではなくスナップショットとして扱ってください。
開発者向けチェックリスト
- [ ] どの無料プランの形態が該当するかを確認する(サインアップクレジット、紹介クレジット、レート制限付き無料モデル、1日のコンピュート割り当て)。
- [ ] 実際に必要なモデルが、その無料プランでカバーされていることを確認する(プロバイダー全体でカバーされているだけでは不十分)。
- [ ] 依存するものをリリースする前に、この記事ではなくプロバイダーの現在のドキュメントで、具体的な数値制限(リクエスト/分、リクエスト/日、トークン/日、ドル建てクレジット)を確認する。
- [ ] より高い制限が適用される前に、クレジット購入のしきい値が必要かどうか(OpenRouterのように)を確認する。
- [ ] 無料プランを使い切った場合の挙動を計画する:単に課金が始まるのか、それともリクエストが拒否されるのか。
よくある質問
本当に無制限の無料LLM APIはありますか?
いいえ。ここで比較したすべてのプロバイダーは、無料利用をレート制限、1日の上限、またはドル建てクレジットで制限しています。「無料」として販売されているプロバイダーは、無制限アクセスではなく、上限付きプランを説明しているのです。
1日あたりのリクエスト上限が最も高い無料LLM APIはどれですか?
ここで確認したレート制限付き無料プランのうち、OpenRouterとGroqは、それぞれの無料モデルで1日1,000リクエストの上限を公開しています(OpenRouterの場合は$10の累計クレジットしきい値を満たした後)。Cloudflare Workers AIの1日10,000ニューロンは、固定のリクエスト数ではなくコンピュート予算であるため、単一の比較可能なリクエスト数には換算できません。
Novita AIは無料のLLMモデルを提供していますか?
Novita AIの現在のサーバーレスLLM APIカタログには、トークンあたり$0のモデルはありません。無料プランの仕組みは紹介プログラムであり、紹介が成立するごとに紹介者と新規紹介アカウントの両方に$10のクレジットを付与し、合計最大$500まで、サーバーレスカタログ全体で利用できます。
無料プランの制限はAPIキーごとですか、それともアカウントごとですか?
これはプロバイダーによって異なり、各プロバイダーのレート制限ページに記載されています。たとえばGroqは、制限が個々のAPIキーごとではなく組織レベルで適用されると明言しています。リクエストのプール動作を想定する前に、特定のプロバイダーのドキュメントでアカウントとキーの区別を確認してください。
