2026年に無料で使えるオープンソースLLM APIキー:6社を比較

2026年に無料で使えるオープンソースLLM APIキー:6社を比較

はい、オープンソースLLMを呼び出すための無料APIキーを提供しているプロバイダーは複数あります。ただし「無料」は、まったく異なる3つの形態に分かれます。レート制限付きで期限なしの永続無料枠、使い切ると終了する一回限りのサインアップクレジット、あるいは自分でダウンロードしてホストする必要があるモデル重みです。以下は2026年8月時点で利用可能な6社を、どの形態に該当するかで分類したものです。実際に無料アクセスが必要な期間に基づいて選択でき、3週間目に請求書が届いて驚くことがありません。

短い答え:はい、ただし「無料」には3種類あります

今日すぐにキーが欲しいがカード情報は入力したくない場合、OpenRouterGroq はどちらも期限なしの永続無料アクセスを提供しています。レート制限を受け入れるだけです。一時的に高いスループットが必要な場合は、Together AI、Novita AI、Hugging Face が最初に無料クレジットまたは無料モデルを提供し、その許容量を超えると請求が発生します。プロバイダーの稼働状況や価格変更にまったく依存したくない場合は、オープンウェイトモデルを Hugging Face Hub から直接ダウンロードして、自分のハードウェアで実行できます。これは Hugging Face のホスト型サービスへのAPI呼び出しではありませんが、レート制限ゼロで永遠に無料という唯一の選択肢です。

無料形態1:永続無料枠のLLM API(レート制限あり・期限なし)

これらは支払い情報を求めず、トライアル期間後に停止することもありません。問題は時間ではなくスループットです。

OpenRouter は、クレジットを追加しなくてもカタログ内の :free タグが付いた任意のモデルを呼び出せます。制限は毎分20リクエスト、毎日50リクエストです。$10分のクレジットを購入すると(一度きりで有効期限なし)、毎日の上限は1,000リクエストに上がり、毎分の上限は変わりません。執筆時点で、OpenRouter は :free サフィックスを持つ17モデルを掲載しています。Z.ai の GLM-5.2、Google の Gemma 4(26B および 31B バリアント)、複数の Nvidia Nemotron モデルなどです。 (2026-08-18 に openrouter.ai/api/v1/models とプラットフォームのレート制限ドキュメント openrouter.ai/docs/api_reference/limits で確認)

Groq は、無料枠でクレジットカードを必要とせず、トライアル期間による制限もありません。ただし、モデルごとに毎分・毎日のリクエスト数とトークン数の上限が設定されています。たとえば、無料枠の openai/gpt-oss-120b は毎分30リクエスト、毎日1,000リクエスト、毎分8,000トークン、毎日200,000トークンに制限されています。Llama Prompt Guard 系のような小規模なテキストモデルでは、トークン上限がはるかに高く設定されています(毎日500Kトークン)。「オンデマンド」ティアの有料顧客は、リクエスト数とトークン数の余裕がおよそ30〜40倍になりますが、無料枠自体に有効期限はありません。 (2026-08-18 に Groq の公開レート制限テーブルで確認)

Novita AI は、期間限定プロモーションではなく、カタログの常設部分として、トークンあたり $0 のオープンウェイトモデルのローテーションセットを維持しています。現在は、ライブモデルリストによると、Qwen3.5-Plus、Qwen3.6-Plus、Bunny がそれぞれ入力/出力とも 0/0 の価格です。これは、Llama、Qwen、GLM、BGE-M3 をカバーする Novita の専用無料モデルまとめとは別で、後述のプラットフォーム全体の紹介プログラムとも別です。ここでの無料枠モデルの選定は、新しいモデルの登場や古いモデルの有料化に合わせてローテーションするため、特定のモデルが無料のままだと思い込まずに、ライブカタログを確認してください。 (2026-08-18 に api.novita.ai/openai/v1/models で確認)

無料形態2:サインアップクレジット型LLM API(上限額あり・以降は有料)

これが最もよく見かける「無料」であり、人々を驚かせるタイプです。メーターは初日から動いており、ただゼロから始まるだけです。

Novita AI の紹介プログラム は、紹介者と新規登録者の両方に $10 の LLM API クレジットを付与し、紹介を通じて獲得できる合計は最大 $500 と明記されています。これはレート制限付きティアではなく、ウォレットへのチャージです。$10 を使い切ると、標準のトークン単価が適用されます。 (2026-08-18 に novita.ai/referral で確認)

Together AI は、2025年7月の請求体系変更で一般的な無料トライアルを廃止しました。新規アカウントは、API呼び出しを行う前に最低 $5 のプリペイド残高が必要になりました。ただし、そのプリペイド要件の対象外として、$0.00/1Mトークンで利用できる特定のモデルエンドポイントを提供しています。例としては、Prism-ML の Ternary-Bonsai-27B(262K コンテキストウィンドウを持つ 27B オープンウェイトモデル)があります。スタートアップは、Startup Accelerator プログラムを通じて最大 $50,000 のクレジットを別途申請することもできますが、これは申し込みプロセスであり、サインアップ特典ではありません。 (2026-08-18 に together.ai/models/prism-ml-ternary-bonsai-27b の価格ブロックと Together の請求ドキュメントで確認)

Hugging Face の Inference Providers はホスト型 API です。OpenRouter や Together AI を呼び出すのと同じように、Hugging Face アクセストークンを使ってリモートから呼び出し、Hugging Face がリクエストを基盤プロバイダーにルーティングして請求します。無料アカウントには毎月 $0.10 のクレジットが自動的に付与され、月額 $9 の PRO プランでは月 $2.00 に増えます。これは小規模モデルの軽いテストには十分ですが、本番トラフィックには不十分です。クレジットは一度きりの付与ではなく毎月更新されますが、金額が小さいため、ほとんどの実用的なワークロードは数回のリクエストで使い切ってしまいます。 (2026-08-18 に huggingface.co/docs/api-inference/en/pricing で確認)

DeepInfra は、価格ページで「毎月 $10 USD 無料」と宣伝しています。これは一回限りのサインアップボーナスではなく、毎月繰り返し付与される手当てとして構成されています。 (2026-08-18 に deepinfra.com/pricing で確認)

無料形態3:セルフホスト型オープンソースLLM(APIなし・請求なし・レート制限なし)

これは API キーではなく、モデルの重みを自分でダウンロードし、管理下のハードウェア上で vLLM や Ollama、llama.cpp などを通じて実行する方法です。Hugging Face Hub はオープンウェイトリリースの主要な配布場所です(Llama、Qwen、GLM、その他ほとんどのオープンソースファミリーはすべてそこで重みを公開しています)。これは前述の Hugging Face 自身のホスト型 Inference Providers API とは別物で、Hub は単にファイルをホストしているだけです。トークンではなくコンピュートに対して支払い、共有サービスがないためレート制限もありません。ただし、GPU、サービングスタック、稼働時間に対する責任は自分にあります。この選択肢は、可用性を保証したい場合や、レンタルGPUの方がトークン単価より安くなるほどの処理量がある場合に有効です。今日の午後にモデルをテストしたいだけなら、間違った選択です。

無料LLM APIプロバイダー比較

プロバイダー 無料タイプ 内容 有効期限
OpenRouter 永続無料枠 50リクエスト/日($10クレジット購入後は1,000/日)、20リクエスト/分、:free モデルのみ なし
Groq 永続無料枠 モデルごとの RPM/RPD/TPM/TPD 上限。例:gpt-oss-120b は1,000リクエスト/日 なし
Novita AI(無料枠モデル) 永続無料枠 厳選されたオープンモデルを $0/Mトークンで提供、カタログはローテーション なし(ただしモデル一覧は変更あり)
Novita AI(紹介) サインアップクレジット 紹介1件につき $10 のクレジット、合計上限 $500 あり(使い切ると終了)
Together AI サインアップクレジット + 無料エンドポイント 一般利用には最低 $5 のプリペイドが必要。特定モデルのエンドポイントは $0.00/M(例:Ternary-Bonsai-27B) 無料エンドポイント:なし。一般クレジット:2025年7月以降提供なし
Hugging Face(Inference Providers、ホスト型 API) サインアップクレジット(毎月) 無料で月 $0.10、PRO では月 $2.00 毎月更新される(少量)
DeepInfra サインアップクレジット(毎月) 毎月 $10 USD 無料 毎月更新
セルフホスト(Hugging Face Hub からの重み) APIなし 完全なモデル重みを自分の GPU で実行 なし(ただし API やレート制限の利点もない)

実際に使うべき無料LLM APIはどれか?

プロトタイピングをしていてセットアップの手間をゼロにしたいなら、OpenRouter か Groq から始めましょう。カードも不要、有効期限もありません。レート制限が自分のユースケースにとって本当の制約になるかどうかは、1時間以内にわかります。支払いを始める前に安定したスループットが必要なものを構築しているなら、Novita AI の紹介 $10 や Together AI の $0.00 モデルエンドポイントのようなサインアップクレジットは、永続無料枠が課す厳しい毎分の上限なしに、実際のテストの余裕をもたらします。特定のモデルにすでにコミットしていて、どのプロバイダーのレート制限や価格変更にも依存せずに無期限に稼働させる必要があるなら、Hugging Face Hub から重みをダウンロードしてセルフホストしましょう。

これらはいずれも「無制限で永遠に無料」ではありません。ホスト型APIにはその組み合わせは存在しません。なぜなら、その背後で誰かが GPU 時間に対して支払っているからです。永続無料枠はドルではなくリクエスト数を制限し、サインアップクレジットはリクエスト数ではなくドルを制限します。セルフホストは両方の制限を取り除きますが、その代わりにインフラ費用と運用作業が自分に降りかかります。

まとめ

はい、無料のオープンソースLLM APIは現在存在します。ただし「無料」は、1つの形態ではなく3つの異なる形態を指すラベルです。永続無料枠(OpenRouter、Groq、Novita AI のローテーションする $0 モデル)は期限がありませんが、リクエスト数やトークン数のスループットを制限します。サインアップクレジット(Novita AI の紹介、Together AI のプリペイド不要エンドポイント、Hugging Face、DeepInfra)は、実際のドル建ての許容量を提供し、超えると終了します。Hugging Face Hub からのオープンウェイトのセルフホストは、両方の制限を完全に取り除きますが、自分で GPU を実行して支払うというコストがかかります。あなたにとっての「無料オプション」がどれかは、制約がレート制限なのか、支出上限なのか、それともプロバイダーの価格決定から長期的に独立することなのかによって決まります。3つのトレードオフすべてを同時に回避できる単一のプロバイダーを探すことではありません。なぜなら、現在そのようなプロバイダーは存在しないからです。

FAQ

オープンソースLLM APIは本当に無料ですか?それとも必ず何かしらの条件がありますか?

必ず何らかの条件があります。その形は3つのうちのいずれかです。期限なしの1日/1分あたりのリクエスト上限(OpenRouter、Groq)、使い切ると終了するドル建てクレジット(Novita AI の紹介、Together AI の最低 $5、Hugging Face、DeepInfra)、または自分のハードウェアでのセルフホスト要件です。構築を始める前にどの形かを把握しておけば、予期しない請求や予期しない 429 エラーを避けられます。

最も手厚い永続無料枠を提供しているプロバイダーはどこですか?

Groq の無料枠は、一部のモデルでより高いトークン上限を提供します。gpt-oss-120b では最大 200,000トークン/日、小規模なガードモデルでは 500,000トークン/日です。一方、OpenRouter はクレジットを追加する前は一律 50リクエスト/日です。どちらが優れているかは、ボトルネックがリクエスト数かトークン量かによって決まります。短いやり取りのチャットアプリはまず OpenRouter のリクエスト上限に達し、バッチ要約のようなワークロードはまずトークン上限に達します。

複数のプロバイダーの無料枠を組み合わせて容量を増やすことはできますか?

はい、可能です。これはテストでは一般的なパターンです。1つのプロバイダーに依存するのではなく、異なるトラフィックを異なるプロバイダーの無料枠にルーティングします。ただし、無料枠のモデル選定は時間とともに変わります(今日 OpenRouter で :free のモデルが次の四半期もそうとは限りません)。そのため、特定の無料モデルIDをハードコードするのではなく、プロバイダーのフォールバックを考慮して構築してください。

Novita AI の $10 紹介クレジットは無料枠モデルと同じものですか?

いいえ、別物です。紹介プログラムは、標準のトークン単価請求に使える一回限りの $10 クレジットで、全紹介を通じて合計 $500 が上限です。無料枠モデルは、紹介コードを使用したかどうかに関係なく、継続的にトークンあたり $0 の価格が設定された特定のカタログエントリです。現在どのモデルが $0 価格かを確認するには、ライブモデルカタログを確認してください。新しいモデルの登場に合わせてリストはローテーションするためです。

オープンソースモデルをセルフホストすれば、本当に無料ですか?

モデルの重みは無料でダウンロードできますが、実行するのは無料ではありません。トークン単位の API 価格の代わりに、GPU コンピュート、ストレージ、自分の稼働時間に対して支払うことになります。低く安定したトラフィックの場合、アイドル状態の GPU 時間を考慮すると、通常は有料 API ティアよりも高くなります。主に、高く予測可能なボリュームがある場合や、データの局所性が保証されている必要がある場合に、価値が生まれます。

おすすめ記事