لا — لا تقدم Anthropic نموذج تضمين خاص بها. توثيق Anthropic يذكر ذلك بوضوح: “Anthropic لا تقدم نموذج تضمين خاص بها”، ويوجه المطورين إلى Voyage AI كشريك موصى به للتضمين بدلاً من ذلك. (تم التحقق في 2026-09-08 عبر platform.claude.com/docs/en/build-with-claude/embeddings.) هذه هي الإجابة الدقيقة، لكنها ليست الخيار الوحيد. الجدول أدناه يقارن Voyage AI مع نموذجين مفتوحين المصدر للتضمين يمكنك استدعاؤهما من خلال نقطة نهاية متوافقة مع OpenAI على Novita AI، دون إضافة حزمة SDK ثانية إلى مجموعة أدواتك.
| النموذج | السعر لكل مليون رمز | طول السياق | نقطة نهاية متوافقة مع OpenAI |
|---|---|---|---|
Voyage voyage-4 (البائع الموصى به من Anthropic) |
$0.06 | 32,000 رمز | لا — يستخدم حزمة SDK الخاصة بـ Voyage أو تنسيق REST |
| BAAI BGE-M3 (Novita AI) | $0.01 | 8,192 رمزاً | نعم — /openai/v1/embeddings |
| Qwen3 Embedding 8B (Novita AI) | $0.07 | 32,768 رمزاً | نعم — /openai/v1/embeddings |
(تم التحقق في 2026-09-08. أسعار Voyage voyage-4 وطول السياق عبر docs.voyageai.com/docs/pricing و platform.claude.com/docs/en/build-with-claude/embeddings. أسعار BGE-M3 وQwen3 Embedding 8B والسياق عبر novita.ai/pricing: BGE-M3 مدرج بسياق 8192، وسعر إدخال $0.01/Mt؛ Qwen3 Embedding 8B مدرج بحجم سياق 32768، وسعر إدخال $0.07/Mt. توافق نقطة النهاية عبر raw.githubusercontent.com/novitalabs/novita-skills/main/skills/novita-ai/references/llm-api.md: POST /openai/v1/embeddings.)
لماذا لا توفر Anthropic نموذج تضمين
Claude مبني للتوليد والاستدلال — الدردشة، استخدام الأدوات، سير العمل العاملي (agentic). التضمينات مشكلة مختلفة: تحويل النص إلى متجه بطول ثابت للبحث عن التشابه، التجميع، أو الاسترجاع. بدلاً من بناء وصيانة نموذج تضمين منفصل، يوصي توثيق Anthropic بتقييم “مجموعة متنوعة من بائعي التضمين للعثور على الأنسب لحالة الاستخدام الخاصة بك”، مع تسمية Voyage AI كخيار أساسي تم تناوله في دليلهم.
هذا مهم لكيفية تصميم خط أنابيب RAG قائم على Claude: ستحتاج دائماً إلى استدعاء API ثاني لنقطة نهاية غير تابعة لـ Anthropic لخطوة التضمين، سواء كان ذلك Voyage أو أي شيء آخر.
الخيار 1: Voyage AI (المسار الموصى به من Anthropic)
| النموذج | طول السياق | السعر لكل مليون رمز | الطبقة المجانية |
|---|---|---|---|
voyage-4-large |
32,000 رمز | $0.12 | أول 200 مليون رمز مجانية |
voyage-4 |
32,000 رمز | $0.06 | أول 200 مليون رمز مجانية |
voyage-4-lite |
32,000 رمز | $0.02 | أول 200 مليون رمز مجانية |
(تم التحقق في 2026-09-08 عبر platform.claude.com/docs/en/build-with-claude/embeddings لأسماء النماذج/طول السياق، وعبر docs.voyageai.com/docs/pricing لأرقام الطبقة المجانية والسعر لكل رمز: “أول 200 مليون رمز لـ voyage-4-large وvoyage-4 وvoyage-4-lite… مجانية لكل حساب.”)
نقطة نهاية Voyage AI هي POST https://api.voyageai.com/v1/embeddings، باستخدام حزمة SDK الخاصة بها أو استدعاء REST مباشر — وليس تنسيق OpenAI SDK. إنه خيار متين إذا كنت تريد البائع المعتمد من Anthropic ولا تمانع في وجود حساب وعلاقة فوترة منفصلة للتضمينات.
الخيار 2: تضمينات مفتوحة المصدر متوافقة مع OpenAI على Novita AI
إذا كنت تفضل إبقاء كل شيء خلف عميل متوافق مع OpenAI واحد بدلاً من إضافة حزمة SDK خاصة بـ Voyage، فإن Novita AI تستضيف نماذج تضمين مفتوحة المصدر خلف نفس نقطة النهاية /openai/v1/embeddings التي ستستخدمها بالفعل لإكمالات الدردشة.
BGE-M3 يدعم أكثر من 100 لغة ويجمع بين الاسترجاع الكثيف (dense) ومتعدد المتجهات (multi-vector) والمتناثر (sparse) في نموذج واحد، مع نافذة سياقية تبلغ 8,192 رمزاً — كافية لمعظم كتل المستندات في خط أنابيب RAG. (تم التحقق في 2026-09-08 عبر novita.ai/pricing: “قادر على معالجة أكثر من 100 لغة ومدخلات تتراوح من الجمل القصيرة إلى المستندات الطويلة (حتى 8,192 رمزاً)… يتصدر المعايير مثل MIRACL وMKQA.”)
Qwen3 Embedding 8B احتل المرتبة الأولى على لوحة متصدرين MTEB متعددة اللغات بدرجة 70.58 اعتباراً من إصداره في يونيو 2025، ويدعم نافذة سياق أطول تبلغ 32,768 رمزاً مقارنة بـ BGE-M3. (تم التحقق في 2026-09-08 عبر بطاقة نموذج Hugging Face الخاصة بـ Qwen/Qwen3-Embedding-8B، والتي تبلغ عن درجة 70.58 متعددة اللغات من MTEB والمرتبة الأولى.) تكلفته أعلى لكل رمز من BGE-M3 لكنه يعالج مدخلات أطول دون الحاجة إلى تقسيمها.
استدعاؤه من كود يستخدم بالفعل حزمة OpenAI SDK
from openai import OpenAI
import os
client = OpenAI(
base_url="https://api.novita.ai/openai/v1",
api_key=os.environ["NOVITA_API_KEY"],
)
response = client.embeddings.create(
model="baai/bge-m3",
input="Anthropic recommends Voyage AI for embeddings, but this text is being embedded with BGE-M3 instead.",
)
print(response.data[0].embedding[:5]) # first 5 dimensions
استبدل model="baai/bge-m3" بـ model="qwen/qwen3-embedding-8b" لاستخدام النموذج ذي السياق الأطول. كلاهما يقبل سلسلة نصية أو مصفوفة من السلاسل النصية كمدخل input ويعيد data[].embedding كمصفوفة أعداد عشرية، مطابقاً شكل استجابة تضمينات OpenAI. (تم التحقق في 2026-09-08 عبر raw.githubusercontent.com/novitalabs/novita-skills/main/skills/novita-ai/references/llm-api.md: POST /openai/v1/embeddings، المعاملات input وmodel، “يعيد data[].embedding (مصفوفة أعداد عشرية).”)
أي واحد يناسب خط الأنابيب الخاص بك
إذا كنت منغمساً بالفعل في نظام Anthropic البيئي وتريد البائع الذي يتحقق منه صراحة، فإن Voyage AI هو المسار الأقل احتكاكاً — تحصل على مخرجات متعددة الأبعاد من نوع Matryoshka ونماذج مصممة للكود والاسترجاع متعدد اللغات. إذا كان خط الأنابيب الخاص بك يعتمد على OpenAI SDK (LangChain أو LlamaIndex أو عميل مخصص موجه إلى نقطة نهاية /embeddings) وتريد تجنب حزمة SDK ثانية فقط لخطوة التضمين، فإن BGE-M3 أو Qwen3 Embedding 8B على Novita AI يتوافقان مع تغيير عنوان URL الأساسي وبدون مكتبة عميل جديدة.
التكلفة هي الرافعة الأخرى: BGE-M3 بسعر $0.01 لكل مليون رمز أرخص من كل نماذج Voyage، بما في ذلك voyage-4-lite بسعر $0.02. إذا كانت نوافذ السياق الخاصة بك تتسع ضمن حد BGE-M3 البالغ 8,192 رمزاً، فهذه أقل تكلفة لكل رمز من بين الخيارات الأربعة المقارنة هنا. إذا كنت بحاجة إلى تضمين كتل أطول دون تقسيمها، فإن نافذة Qwen3 Embedding 8B البالغة 32,768 رمزاً تطابق عائلة Voyage voyage-4 بسعر مشابه لكل رمز ($0.07 مقابل $0.06).
الأسئلة الشائعة
هل تحتوي Claude على ميزة تضمين مدمجة؟
لا. توثيق Anthropic يذكر مباشرة أن Claude لا يقدم نموذج تضمين ويوجه المطورين إلى مزودين خارجيين، أساساً Voyage AI.
هل يمكنني استخدام تضمينات Voyage AI مع Claude في نفس خط الأنابيب؟
نعم — هذا هو النمط المقصود. يمكنك استدعاء Claude للتوليد وVoyage AI بشكل منفصل للتضمين؛ لا توجد نقطة نهاية مشتركة.
هل هناك بديل أرخص من Voyage AI يعمل مع كود متوافق مع نمط OpenAI؟
نعم. النماذج مفتوحة المصدر مثل BAAI BGE-M3 وQwen3 Embedding 8B مستضافة على Novita AI خلف نقطة نهاية /embeddings متوافقة مع OpenAI، بسعر $0.01 و $0.07 لكل مليون رمز على التوالي، كلاهما أقل من التسعير المتوسط لـ Voyage.
أي نافذة سياق يجب أن أختار؟
BGE-M3 يحد عند 8,192 رمزاً لكل إدخال؛ Qwen3 Embedding 8B ونماذج Voyage الحالية تدعم جميعها 32,000+ رمز. اختر بناءً على أكبر حجم للكتلة (chunk) لديك، وليس متوسطها.