لا — لا توفر أنثروبيك نموذج تضمين خاصًا بها. توثيق أنثروبيك الرسمي يوضح ذلك بوضوح: “لا تقدم Anthropic نموذج تضمين خاصًا بها”، ويوجه المطورين إلى Voyage AI كشريك موصى به للتضمين. (تم التحقق في 2026-09-08 عبر platform.claude.com/docs/en/build-with-claude/embeddings.) هذه هي الإجابة الدقيقة، لكنها ليست الخيار الوحيد. الجدول أدناه يقارن بين Voyage AI ونموذجين مفتوحي المصدر للتضمين يمكنك استدعاؤهم عبر نقطة نهاية متوافقة مع OpenAI على Novita AI، دون إضافة SDK ثانية إلى مجموعتك التقنية.
| النموذج | السعر لكل مليون رمز (token) | طول السياق | نقطة نهاية متوافقة مع OpenAI |
|---|---|---|---|
Voyage voyage-4 (المورد الموصى به من أنثروبيك) |
$0.06 | 32,000 رمز | لا — يستخدم SDK/تنسيق REST الخاص بـ Voyage |
| BAAI BGE-M3 (Novita AI) | $0.01 | 8,192 رمز | نعم — /openai/v1/embeddings |
| Qwen3 Embedding 8B (Novita AI) | $0.07 | 32,768 رمز | نعم — /openai/v1/embeddings |
(تم التحقق في 2026-09-08. تسعير وطول سياق Voyage voyage-4 عبر docs.voyageai.com/docs/pricing و platform.claude.com/docs/en/build-with-claude/embeddings. تسعير/سياق BGE-M3 و Qwen3 Embedding 8B عبر novita.ai/pricing: BGE-M3 مُدرج بسياق 8192، تسعير إدخال $0.01/Mt؛ Qwen3 Embedding 8B مُدرج بحجم_سياق 32768، تسعير إدخال $0.07/Mt. توافق نقطة النهاية عبر raw.githubusercontent.com/novitalabs/novita-skills/main/skills/novita-ai/references/llm-api.md: POST /openai/v1/embeddings.)
لماذا لا توفر أنثروبيك نموذج تضمين
تم بناء Claude للتوليد والاستدلال — الدردشة، استخدام الأدوات، سير العمل الوكيل. التضمينات مشكلة مختلفة: تحويل النص إلى متجه ثابت الطول للبحث عن التشابه، التجميع، أو الاسترجاع. بدلاً من بناء وصيانة نموذج تضمين منفصل، توصي وثائق أنثروبيك بتقييم “مجموعة متنوعة من موردي التضمينات للعثور على أفضل ملاءمة لحالة الاستخدام الخاصة بك”، مع تسمية Voyage AI كخيار أساسي تغطيه أدلتهم.
هذا مهم لكيفية بناء خط أنابيب RAG قائم على Claude: ستحتاج دائمًا إلى استدعاء API ثاني لنقطة نهاية غير تابعة لأنثروبيك لخطوة التضمين، سواء كان ذلك Voyage أو غيره.
الخيار 1: Voyage AI (المسار الموصى به من أنثروبيك)
| النموذج | طول السياق | السعر لكل مليون رمز | الطبقة المجانية |
|---|---|---|---|
voyage-4-large |
32,000 رمز | $0.12 | أول 200 مليون رمز مجانًا |
voyage-4 |
32,000 رمز | $0.06 | أول 200 مليون رمز مجانًا |
voyage-4-lite |
32,000 رمز | $0.02 | أول 200 مليون رمز مجانًا |
(تم التحقق في 2026-09-08 عبر platform.claude.com/docs/en/build-with-claude/embeddings لأسماء النماذج/طول السياق، و docs.voyageai.com/docs/pricing لأرقام الطبقة المجانية والتسعير لكل رمز: “أول 200 مليون رمز لـ voyage-4-large، voyage-4، voyage-4-lite… مجانية لكل حساب.”)
نقطة نهاية Voyage AI هي POST https://api.voyageai.com/v1/embeddings، باستخدام SDK الخاص بها أو استدعاء REST مباشر — وليس تنسيق SDK الخاص بـ OpenAI. إنه خيار قوي إذا كنت تريد المورد المعتمد من أنثروبيك ولا تمانع في وجود حساب منفصل وعلاقة فوترة للتضمينات.
الخيار 2: تضمينات مفتوحة المصدر متوافقة مع OpenAI على Novita AI
إذا كنت تفضل الاحتفاظ بكل شيء خلف عميل واحد متوافق مع OpenAI بدلاً من إضافة SDK خاص بـ Voyage، فإن Novita AI تستضيف نماذج تضمين مفتوحة المصدر خلف نفس نقطة النهاية /openai/v1/embeddings التي ستستخدمها بالفعل لإكمال المحادثة.
يدعم BGE-M3 أكثر من 100 لغة ويجمع بين الاسترجاع الكثيف ومتعدد المتجهات والمتناثر في نموذج واحد، مع نافذة سياق تبلغ 8,192 رمزًا — كافية لمعظم أجزاء المستندات في خط أنابيب RAG. (تم التحقق في 2026-09-08 عبر novita.ai/pricing: “قادر على معالجة أكثر من 100 لغة ومدخلات تتراوح من الجمل القصيرة إلى المستندات الطويلة (حتى 8,192 رمزًا)… متصدرًا معايير مثل MIRACL و MKQA.”)
احتل Qwen3 Embedding 8B المرتبة الأولى على لوحة متصدرات MTEB متعددة اللغات بنتيجة 70.58 اعتبارًا من إصداره في يونيو 2025، ويدعم نافذة سياق أطول تبلغ 32,768 رمزًا مقارنة بـ BGE-M3. (تم التحقق في 2026-09-08 عبر بطاقة نموذج Qwen/Qwen3-Embedding-8B على Hugging Face، والتي تبلغ عن نتيجة 70.58 على MTEB متعدد اللغات والمرتبة الأولى.) تبلغ تكلفته لكل رمز أكثر من BGE-M3 لكنه يعالج مدخلات أطول دون تجزئة.
استدعاؤه من كود يستخدم بالفعل SDK الخاص بـ OpenAI
from openai import OpenAI
import os
client = OpenAI(
base_url="https://api.novita.ai/openai/v1",
api_key=os.environ["NOVITA_API_KEY"],
)
response = client.embeddings.create(
model="baai/bge-m3",
input="توصي Anthropic بـ Voyage AI للتضمينات، ولكن هذا النص يتم تضمينه باستخدام BGE-M3 بدلاً من ذلك.",
)
print(response.data[0].embedding[:5]) # أول 5 أبعاد
استبدل model="baai/bge-m3" بـ model="qwen/qwen3-embedding-8b" لاستخدام النموذج ذو السياق الأطول. يقبل كلاهما سلسلة نصية أو مصفوفة من السلاسل كـ input ويعيدان data[].embedding كمصفوفة float، مطابقين شكل استجابة تضمينات OpenAI. (تم التحقق في 2026-09-08 عبر raw.githubusercontent.com/novitalabs/novita-skills/main/skills/novita-ai/references/llm-api.md: POST /openai/v1/embeddings، المعاملات input و model، “يعيد data[].embedding (مصفوفة float).”)
أيهما يناسب خط أنابيبك
إذا كنت بالفعل متعمقًا في نظام أنثروبيك البيئي وتريد المورد الذي يفحصونه صراحةً، فإن Voyage AI هو المسار الأقل احتكاكًا — تحصل على إخراج متعدد الأبعاد على نمط Matryoshka ونماذج مضبوطة للبرمجة والاسترجاع متعدد اللغات. إذا كان خط أنابيبك قائمًا على SDK الخاص بـ OpenAI (LangChain أو LlamaIndex أو عميل مخصص موجه إلى نقطة نهاية /embeddings) وتريد تجنب SDK ثانية فقط لخطوة التضمين، فإن BGE-M3 أو Qwen3 Embedding 8B على Novita AI يتناسبان مع تغيير عنوان URL الأساسي وبدون مكتبة عميل جديدة.
التكلفة هي العامل الآخر: BGE-M3 بسعر $0.01 لكل مليون رمز أرخص من كل نموذج Voyage، بما في ذلك voyage-4-lite بسعر $0.02. إذا كانت نوافذ السياق الخاصة بك تناسب حد BGE-M3 البالغ 8,192 رمزًا، فهذه هي أقل تكلفة لكل رمز من بين الخيارات الأربعة المقارنة هنا. إذا كنت بحاجة إلى تضمين أجزاء أطول دون تقسيمها، فإن نافذة Qwen3 Embedding 8B البالغة 32,768 رمزًا تتطابق مع عائلة Voyage voyage-4 بسعر مشابه لكل رمز ($0.07 مقابل $0.06).
الأسئلة الشائعة
هل يحتوي Claude على ميزة تضمين مدمجة؟ لا. تنص وثائق Anthropic مباشرة على أن Claude لا يقدم نموذج تضمين وتوجه المطورين إلى مزودين خارجيين، بشكل أساسي Voyage AI.
هل يمكنني استخدام تضمينات Voyage AI مع Claude في نفس خط الأنابيب؟ نعم — هذا هو النمط المقصود. تستدعي Claude للتوليد و Voyage AI بشكل منفصل للتضمينات؛ لا توجد نقطة نهاية مدمجة.
هل هناك بديل أرخص من Voyage AI يعمل مع كود على غرار OpenAI؟
نعم. يتم استضافة نماذج مفتوحة المصدر مثل BAAI BGE-M3 و Qwen3 Embedding 8B على Novita AI خلف نقطة نهاية /embeddings متوافقة مع OpenAI، بسعر $0.01 و $0.07 لكل مليون رمز على التوالي، وكلاهما أقل من تسعير Voyage المتوسط.
أي نافذة سياق يجب أن أختار؟ BGE-M3 يبلغ حده الأقصى 8,192 رمزًا لكل إدخال؛ بينما يدعم كل من Qwen3 Embedding 8B ونماذج الجيل الحالي من Voyage أكثر من 32,000 رمز. اختر بناءً على أكبر حجم للقطعة لديك، وليس متوسطها.
