いいえ — Anthropicは独自の埋め込みモデルを提供していません。Anthropicの公式ドキュメントにも明確に「Anthropicは独自の埋め込みモデルを提供していない」と記載されており、開発者向けに推奨される埋め込みパートナーとしてVoyage AIを挙げています。 (2026-09-08時点、platform.claude.com/docs/en/build-with-claude/embeddings で確認) これが正確な回答ですが、唯一の選択肢ではありません。以下の表では、Voyage AIと、Novita AIのOpenAI互換エンドポイントを通じて呼び出せる2つのオープンソース埋め込みモデルを比較しています。スタックに別のSDKを追加する必要はありません。
| モデル | 100万トークンあたりの価格 | コンテキスト長 | OpenAI互換エンドポイント |
|---|---|---|---|
Voyage voyage-4(Anthropic推奨ベンダー) |
$0.06 | 32,000 トークン | いいえ — Voyage独自のSDK/REST形式を使用 |
| BAAI BGE-M3(Novita AI) | $0.01 | 8,192 トークン | はい — /openai/v1/embeddings |
| Qwen3 Embedding 8B(Novita AI) | $0.07 | 32,768 トークン | はい — /openai/v1/embeddings |
(2026-09-08時点で確認。Voyage voyage-4 の価格とコンテキスト長は docs.voyageai.com/docs/pricing および platform.claude.com/docs/en/build-with-claude/embeddings より。BGE-M3 と Qwen3 Embedding 8B の価格とコンテキストは novita.ai/pricing より:BGE-M3 は コンテキスト 8192、入力価格 $0.01/Mt;Qwen3 Embedding 8B は context_size 32768、入力価格 $0.07/Mt。エンドポイント互換性は raw.githubusercontent.com/novitalabs/novita-skills/main/skills/novita-ai/references/llm-api.md より:POST /openai/v1/embeddings。)
Anthropicが埋め込みモデルを提供しない理由
Claudeは生成と推論(チャット、ツール使用、エージェントワークフロー)のために構築されています。埋め込みは別の問題です。つまり、類似性検索、クラスタリング、または検索のためにテキストを固定長ベクトルに変換することです。Anthropicのドキュメントでは、別の埋め込みモデルを構築して維持する代わりに、「特定のユースケースに最適なものを見つけるために、さまざまな埋め込みベンダーを評価すること」を推奨しており、Voyage AIをガイドで取り上げられている主要なオプションとして挙げています。
これは、ClaudeベースのRAGパイプラインを構築する方法にとって重要です。つまり、埋め込みステップのために、Voyageであれ他のものであれ、非Anthropicのエンドポイントへの2回目のAPI呼び出しが常に必要になります。
オプション1:Voyage AI(Anthropic推奨のパス)
| モデル | コンテキスト長 | 100万トークンあたりの価格 | 無料枠 |
|---|---|---|---|
voyage-4-large |
32,000 トークン | $0.12 | 最初の2億トークン無料 |
voyage-4 |
32,000 トークン | $0.06 | 最初の2億トークン無料 |
voyage-4-lite |
32,000 トークン | $0.02 | 最初の2億トークン無料 |
(2026-09-08時点で確認。モデル名とコンテキスト長は platform.claude.com/docs/en/build-with-claude/embeddings、無料枠とトークン単価は docs.voyageai.com/docs/pricing より:「voyage-4-large、voyage-4、voyage-4-lite の最初の2億トークンは、すべてのアカウントで無料です。」)
Voyage AIのエンドポイントは POST https://api.voyageai.com/v1/embeddings で、独自のSDKまたは直接のREST呼び出しを使用します。OpenAI SDK形式ではありません。Anthropicが推奨するベンダーを利用したい場合で、埋め込み用に別のアカウントと請求関係を気にしないのであれば、堅実な選択肢です。
オプション2:Novita AI上のOpenAI互換オープンソース埋め込み
Voyage固有のSDKを追加する代わりに、すべてを1つのOpenAI互換クライアントで管理したい場合、Novita AIはチャット補完にすでに使用しているのと同じ /openai/v1/embeddings エンドポイントの背後で、オープンソースの埋め込みモデルをホストしています。
BGE-M3 は100以上の言語をサポートし、1つのモデルで高密度、マルチベクター、スパース検索を組み合わせており、8,192トークンのコンテキストウィンドウを備えているため、RAGパイプラインのほとんどのドキュメントチャンクに十分対応できます。 (2026-09-08時点で novita.ai/pricing より確認:「100以上の言語と、短文から長文(最大8,192トークン)までの入力を処理可能…MIRACLやMKQAなどのベンチマークでトップの成績。」)
Qwen3 Embedding 8B は、2025年6月のリリース時点でMTEB多言語リーダーボードでスコア70.58を記録して1位にランクインし、BGE-M3よりも長い32,768トークンのコンテキストウィンドウをサポートしています。 (2026-09-08時点で、Hugging Faceの Qwen/Qwen3-Embedding-8B モデルカードより確認。70.58のMTEB多言語スコアと1位のランキングが報告されています。) BGE-M3よりもトークン単価は高いですが、チャンク分割なしで長い入力を処理できます。
OpenAI SDKをすでに使用しているコードからの呼び出し方
from openai import OpenAI
import os
client = OpenAI(
base_url="https://api.novita.ai/openai/v1",
api_key=os.environ["NOVITA_API_KEY"],
)
response = client.embeddings.create(
model="baai/bge-m3",
input="Anthropic recommends Voyage AI for embeddings, but this text is being embedded with BGE-M3 instead.",
)
print(response.data[0].embedding[:5]) # 最初の5次元
より長いコンテキストのモデルを使用するには、model="baai/bge-m3" を model="qwen/qwen3-embedding-8b" に置き換えてください。どちらも input として文字列または文字列の配列を受け入れ、浮動小数点数の配列として data[].embedding を返します。これはOpenAIの埋め込みレスポンス形式と一致します。 (2026-09-08時点で raw.githubusercontent.com/novitalabs/novita-skills/main/skills/novita-ai/references/llm-api.md より確認:POST /openai/v1/embeddings、パラメータ input と model、「Returns data[].embedding (float array)」。)
パイプラインに合った選択
すでにAnthropicのエコシステムに深く関わっており、Anthropicが明示的に承認しているベンダーを利用したい場合、Voyage AIが最も摩擦の少ないパスです。マトリョーシカスタイルの可変次元出力と、コードおよび多言語検索に最適化されたモデルが得られます。パイプラインがOpenAI SDKベース(LangChain、LlamaIndex、または /embeddings エンドポイントを指すカスタムクライアント)であり、埋め込みステップのために2つ目のSDKを避けたい場合、Novita AI上のBGE-M3またはQwen3 Embedding 8Bは、ベースURLの変更だけで、新しいクライアントライブラリなしで導入できます。
コストももう一つのレバーです。BGE-M3は100万トークンあたり$0.01と、voyage-4-liteの$0.02を含むすべてのVoyageモデルよりも安価です。コンテキストウィンドウがBGE-M3の8,192トークン制限に収まる場合、ここで比較した4つのオプションの中で最も低いトークン単価となります。長いチャンクを分割せずに埋め込む必要がある場合、Qwen3 Embedding 8Bの32,768トークンウィンドウは、Voyageの voyage-4 ファミリーと同等のトークン単価($0.07対$0.06)で一致します。
FAQ
Claudeに組み込みの埋め込み機能はありますか? いいえ。Anthropicのドキュメントは、Claudeは埋め込みモデルを提供しておらず、サードパーティプロバイダー(主にVoyage AI)を利用するよう開発者に指示していると直接述べています。
同じパイプラインでVoyage AIの埋め込みとClaudeを一緒に使用できますか? はい — それが意図されたパターンです。生成にはClaudeを、埋め込みにはVoyage AIを別々に呼び出します。統合されたエンドポイントはありません。
OpenAIスタイルのコードで動作し、Voyage AIよりも安価な代替案はありますか?
はい。BAAI BGE-M3やQwen3 Embedding 8Bのようなオープンソースモデルは、Novita AI上でOpenAI互換の /embeddings エンドポイントの背後でホストされており、それぞれ100万トークンあたり$0.01と$0.07で、Voyageの中間層の価格を下回ります。
どのコンテキストウィンドウを選ぶべきですか? BGE-M3は入力あたり8,192トークンが上限です。Qwen3 Embedding 8BとVoyageの現行世代モデルはどちらも32,000+トークンをサポートしています。平均的なチャンクサイズではなく、最大のチャンクサイズに基づいて選択してください。
