هل يُعد الذكاء الاصطناعي ذي الأوزان المفتوحة فعليًّا أرخص من واجهات برمجة التطبيقات API الخاصة الكبرى — وبكم تبلغ هذه الفروق؟ لقد جمعنا أسعار واجهات برمجة التطبيقات لجميع النماذج الـ29 المُسعَّرة في قاعدة بياناتنا قاعدة بيانات النماذجونمّطناها جميعًا إلى تكلفة مدمجة واحدة لكل مليون رمز، ثم قسّمناها إلى فئتين: نماذج ذات أوزان مفتوحة ونماذج خاصة. والنتيجة أن الفجوة أكبر بكثير — وأكثر اتساقًا — مما يفترضه معظم الناس.
أبرز النقاط المستخلصة
- أرخص خمسة نماذج في عام 2026 كلها ذات أوزان مفتوحة، بينما أغلى خمسة نماذج هي جميعها نماذج خاصة.
- الـ وتبلغ التكلفة النموذجية (الوسيطة) لنماذج الأوزان المفتوحة حوالي 0.15 دولارًا أمريكيًّا لكل مليون رمز مدمج؛ أما التكلفة النموذجية للنماذج الخاصة فهي حوالي 6.00 دولارات أمريكيّة — أي فجوة تبلغ 39 ضعفًا.
- وبالمتوسط، تكلّف النماذج الخاصة حوالي 16 ضعفًا أكثر من النماذج المفتوحة.
- وتتراوح الفجوة الكاملة في الأسعار عبر جميع النماذج الـ29 بين حوالي 890 ضعفًا — من نحو 0.02 دولار أمريكي إلى 20 دولارًا أمريكيًّا لكل مليون رمز مدمج.
- وهذا لا يشمل الاستضافة الذاتية، التي تحذف تكلفة الرمز الواحد تمامًا في حالة النماذج ذات الأوزان المفتوحة. الفجوة في جدول واحد
كيف قمنا بقياسه
- النطاق — جميع النماذج الـ29 التي كانت تمتلك أسعار واجهة برمجة تطبيقات عامة في قاعدة بيانات Convly وقت تشغيل هذا التحليل، في 1 أغسطس 2026.
- التكلفة المدمجة —
(3 × الإدخال + الإخراج) ÷ 4، وهي نسبة إدخال إلى إخراج تبلغ 3:1، وتُعتبر نموذجية لحركة مرور واجهات برمجة التطبيقات الفعلية، وبالتالي يمكن مقارنة النماذج التي تكون تكلفة إدخالها منخفضة لكن تكلفة إخراجها مرتفعة بشكل مباشر. - التصنيف — «ذو أوزان مفتوحة» = أوزان قابلة للتنزيل يمكن استضافتها ذاتيًّا (22 نموذجًا)؛ و«خاص» = واجهة برمجة تطبيقات فقط (7 نماذج).
- المصادر — أسعار واجهات برمجة التطبيقات المنشورة عبر OpenRouter وDeepInfra، يونيو 2026.
الفجوة في جدول واحد
| المقياس (الدولار المدمج لكل مليون) | ذو أوزان مفتوحة (22) | خاص (7) | فجوة |
|---|---|---|---|
| متوسط | $0.50 | $8.16 | 16× |
| الوسيط (النموذج النموذجي) | $0.15 | $6.00 | 39× |
| أرخص نموذج في المجموعة | 0.02 دولار أمريكي (Llama 3.1 بسعة 8 مليار معلَّمة) | 2.00 دولار أمريكي (Claude Haiku 4.5) | — |
| أغلى نموذج في المجموعة | 3.00 دولار أمريكي (Mistral Large 3) | 20.00 دولار أمريكي (Claude Fable 5) | — |
الحالات المتطرفة تروي القصة
عند ترتيب جميع النماذج الـ29 حسب التكلفة المدمجة، يظهر النمط جليًّا: فالنماذج المفتوحة المصدر تهيمن على القسم الأدنى من السوق، بينما تهيمن النماذج الملكية على القسم الأعلى منه:
| أرخص 5 نماذج (جميعها ذات أوزان مفتوحة) | المتوسط المُدمج بالدولار لكل مليون دولار | أغلى 5 نماذج (جميعها مملوكة) | المتوسط المُدمج بالدولار لكل مليون دولار |
|---|---|---|---|
| Llama 3.1 8B | $0.02 | Claude Fable 5 | $20.00 |
| Mistral 7B | $0.02 | GPT-5.5 | $11.25 |
| Mistral NeMo 12B | $0.03 | Claude Opus 4.8 | $10.00 |
| Gemma 3 4B | $0.06 | Claude Sonnet 4.6 | $6.00 |
| Qwen3 8B | $0.07 | Gemini 3.1 Pro | $4.50 |
لا توجد نماذج خاصة في الثلث الأرخص من السوق، ولا توجد نماذج مفتوحة الوزن في الثلث الأغلى. أما منطقة التداخل الوحيدة فهي ضيقة جدًّا: أرخص نموذج خاص (Claude Haiku 4.5، 2.00 دولار أمريكي) يقع مباشرةً تحت أغلى نموذج مفتوح (Mistral Large 3, $3.00).
توضيح هام: هذا يتعلّق بالتكلفة وليس بالقدرات
ومع ذلك، لا تزال النماذج الأغلى سعرًا تقود المنافسة في أصعب مهام الاستنتاج والمهام التي تتطلب وكالة (Agentic tasks). وفي مؤشرنا المرافق مؤشر السعر-الأداء للذكاء الاصطناعي وجدنا أن العلاوة المفروضة على النماذج الرائدة تُشتري النقاط الأخيرة من الذكاء، وليس قيمةً متناسبةً. أما بالنسبة لغالبية أحمال العمل الإنتاجية — مثل التصنيف والاستخراج وتقنيات الاسترجاع المعزَّزة بالذكاء الاصطناعي (RAG) والتلخيص والدردشة — فإن الفجوة في القدرات بين نموذج مفتوح جيد ونموذج رائد أصغر بكثير من فجوة السعر البالغة 39×. إذ إنك غالبًا ما تدفع 39 ضعفًا مقابل آخر 10–20٪ من القدرات التي قد لا تحتاجها أصلًا.
لماذا توجد هذه الفجوة بشكل هيكلي
وهذا ليس مجرد حرب خصومات مؤقتة. فالمنافسة الشديدة بين النماذج ذات الأوزان المفتوحة — مثل Qwen وLlama وGemma، DeepSeek وMistral، والتي تُطلق جميعها نماذج قوية بموجب تراخيص مرنة — دفعت الحد الأدنى للسعر نحو الصفر. وفي الوقت نفسه، تُحدِّد المختبرات الرائدة أسعار نماذجها وفقًا لأقصى قدرات أداءً واستعداد المؤسسات للدفع. والنتيجة هي سوقٌ تنقسم إلى شقين: قاعٌ يتسابق نحو الصفر، وسقفٌ عاليٌ يحمل علاوةً، مع اتساع الهوة بينهما باستمرار.
الخلاصة
وبالنسبة لأحمال العمل الإنتاجية الحساسة من حيث التكلفة، يُعد النموذج المفتوح أو المتوسط الخيار الافتراضي العقلاني في عام 2026 — كما أن استضافة النموذج ذاتيًّا تلغي تمامًا التكلفة المفروضة لكل رمز (token) (راجع ما يمكن لبطاقتك الرسومية تشغيله باستخدام أداتنا حاسبة الذاكرة VRAM). واحرص على احتكار النماذج المملوكة الرائدة لأصعب المهام فقط. وقم بتشغيل بيانات استخدامك الخاصة عبر حاسبة تكلفة واجهة برمجة التطبيقات (API) لرؤية أرقامك الدقيقة.
البيانات: Convly قاعدة بيانات نماذج الذكاء الاصطناعي (أسعار واجهة برمجة التطبيقات عبر OpenRouter وDeepInfra). يُحسب متوسط التكلفة باستخدام نسبة 3:1 بين المدخلات والمخرجات. الأرقام سارية اعتبارًا من يونيو 2026.
