كم ستكون تكلفة واجهة برمجة التطبيقات (API) الخاصة بشركة OpenAI أو Anthropic أو DeepSeek شهريًّا؟ أدخل حجم استخدامك وقارن كل نموذجٍ مع الآخر جنبًا إلى جنب — ويتم استخراج أسعار التسعير مباشرةً من موقعنا جوجل ويتم استخراج أسعار التسعير مباشرةً من موقعنا قاعدة بيانات نماذج الذكاء الاصطناعي.
| النموذج | المطوّر | الدولار لكل مليون رمز مُدخل | الدولار لكل مليون رمز مُخرج | التكلفة التقديرية الشهرية |
|---|
التقدير = (عدد الرموز المُدخلة بالملايين × سعر الرمز المُدخل) + (عدد الرموز المُخرَجة بالملايين × سعر الرمز المُخرج). وتتفاوت الفواتير الفعلية باختلاف عوامل مثل التخزين المؤقت (Caching)، وخصومات الدفع الجماعي (Batch Discounts)، والرسوم الإضافية على السياقات الطويلة (Long-context Surcharges). أما النماذج المفتوحة المصدر التي تستضيفها بنفسك فهي غير مدرجة هنا (حيث تتمثل تكلفتها في أجهزتك وتكاليف الكهرباء، وليس في تكلفة كل رمز على حدة).
أرخص نموذج ليس بالضرورة الأنسب دائمًا — لذا تحقَّق من صفحة كل نموذج لمعرفة حجم نافذة السياق (Context Window) والأداء في الاختبارات المرجعية (Benchmarks) والقدرات قبل التحويل إليه. ولا تنسَ أن النماذج المفتوحة المصدر التي تستضيفها بنفسك لا تترتَّب عليها أي تكلفة مقابل كل رمز.
كم تكلّف واجهة برمجة تطبيقات نموذج لغوي كبير (LLM)، وكيف تحسبها؟
تُحتسب أسعار واجهات برمجة تطبيقات الذكاء الاصطناعي حسب الرمز (token)، وتُفوَّت بشكل منفصل عن الرموز المُدخلة (أي الموجه الذي ترسله بالإضافة إلى أي سياق تزوده به) والرموز الخارجة (أي رد النموذج)، وتُذكر الأسعار عادةً لكل مليون رمز. ولتقدير الفاتورة الشهرية، تضرب عدد الرموز الداخلة في سعر الرمز الداخل، ثم تضيف إليه حاصل ضرب عدد الرموز الخارجة في سعر الرمز الخارج، ثم تضاعف المجموع بعدد الطلبات التي تُرسلها شهريًّا. وفي عام ٢٠٢٦ تتراوح أسعار الرموز الداخلة بين ٠٫١٠ دولار و٥ دولارات لكل مليون رمز، بينما تتراوح أسعار الرموز الخارجة بين ٠٫٣٠ دولار و٣٠ دولارًا لكل مليون رمز، مع كون سعر الرموز الخارجة دائمًا أعلى من سعر الرموز الداخلة — وعادةً ما يكون السعر الخارجي ٢–٥ أضعاف السعر الداخل (وبمتوسط وسطي يبلغ نحو ٤ أضعاف).
- الصيغة الرياضية: التكلفة الشهرية ≈ (عدد الطلبات/شهر × متوسط عدد الرموز الداخلة لكل طلب × سعر الرمز الداخل ÷ ١٬٠٠٠٬٠٠٠) + (عدد الطلبات/شهر × متوسط عدد الرموز الخارجة لكل طلب × سعر الرمز الخارج ÷ ١٬٠٠٠٬٠٠٠).
- قاعدة التحويل بين الرموز والكلمات: ما يقارب رمز واحد وثلث لكل كلمة إنجليزية، وبالتالي فإن ١٠٠٠ رمز تساوي تقريبًا ٧٥٠ كلمة، و١ مليون رمز تساوي نحو ٧٥٠٬٠٠٠ كلمة.
- نطاق التسعير: تنتمي النماذج الاقتصادية أو «الخفيفة» (budget / «lite») إلى نطاق ٠٫١٠–٠٫١٥ دولار لكل مليون رمز داخلي، أما النماذج الرائدة الحدّية (frontier flagship models) فتصل أسعار رموزها الداخلة إلى نحو ٥ دولارات، والخارجة إلى ٢٥–٣٠ دولارًا.
- النماذج مفتوحة الوزن التي تستضيفها ذاتيًّا لا تفرض عليك رسومًا على كل رمز — بل تدفع فقط مقابل وحدة معالجة الرسوميات (GPU) والطاقة والخدمات الاستضافة.
الأسئلة الشائعة
كيف أحسب التكلفة الشهرية لواجهة برمجة تطبيقات الذكاء الاصطناعي؟
خذ متوسط عدد الرموز الداخلة والخارجة لكل طلب، واضرب كلًّا منهما في سعر الرمز لكل مليون (مع العلم أن سعر الرمز الداخل وسعر الرمز الخارج منفصلان)، ثم اجمع الناتجين للحصول على التكلفة لكل طلب، وبعد ذلك اضرب المجموع في عدد الطلبات الشهري. فمثلًا: إذا أرسلت ١٠٠٬٠٠٠ طلب شهريًّا، وكل طلب يتضمّن ١٠٠٠ رمزًا داخليًّا و٥٠٠ رمز خارجي، فإن إجمالي الرموز الداخلة يبلغ ١٠٠ مليون رمز، والخارجية ٥٠ مليون رمز؛ وبسعر ١ دولار لكل مليون رمز داخلي و٤ دولارات لكل مليون رمز خارجي تكون التكلفة الإجمالية ١٠٠ دولار + ٢٠٠ دولار = ٣٠٠ دولار شهريًّا.
لماذا تكلّف الرموز الخارجة أكثر من الرموز الداخلة؟
يتم معالجة الرموز الداخلة في عملية تمرير واحدة متوازية، أما كل رمز خارجي فيتطلّب تمريرًا أماميًّا كاملاً عبر النموذج، لذا فإن توليد النص يستهلك قدرًا هائلًا من قوة المعالجة مقارنةً بقراءته فقط. ولهذا السبب تُحدَّد أسعار الرموز الخارجة عادةً بنسبة ٢–٥ أضعاف أسعار الرموز الداخلة، بمعدل نموذجي يبلغ نحو ٤ أضعاف. وعند تقدير الفاتورة، يجب أن تأخذ في الحسبان هذه النسبة العالية للرموز الخارجة بدلًا من افتراض تساوي تكلفة الرموز الداخلة والخارجة.
ما المقصود فعليًّا بعبارة «التكلفة لكل مليون رمز»؟
تُعلن مقدِّمو الخدمات الأسعار لكل مليون رمز بدلًا من تحديدها لكل طلب، لأن عدد الرموز يتفاوت اختلافًا كبيرًا بين الطلبات المختلفة. والرمز الواحد يعادل تقريبًا ثلاثة أرباع الكلمة الإنجليزية، وبالتالي فإن مليون رمز تساوي نحو ٧٥٠٬٠٠٠ كلمة — أي ما يعادل طول كتاب طويل. ولحساب التكلفة الفعلية، اقسم السعر المعلن لكل مليون رمز على ١٬٠٠٠٬٠٠٠، ثم اضرب الناتج في العدد الدقيق للرموز التي ترسلها وتتلقاها.
ما أرخص واجهة برمجة تطبيقات لنموذج لغوي كبير (LLM) في عام ٢٠٢٦؟
تتمثّل الخيارات الأقل تكلفة في واجهات برمجة التطبيقات من نوع «فلاش» (flash) و«خفيفة» (lite) والمبنية على نماذج مفتوحة المصدر، والتي تتراوح أسعار رموزها الداخلة فيها بين ٠٫١٠ و٠٫١٥ دولار لكل مليون رمز، وأسعار رموزها الخارجة بين ٠٫٣٠ و٠٫٦٠ دولار لكل مليون رمز — وهي غالبًا أرخص بنسبة ٣٠–٥٠ ضعفًا من النماذج الرائدة الحدّية التي تبلغ أسعار رموزها الداخلة نحو ٥ دولارات والخارجة ٢٥–٣٠ دولارًا. وأفضل قيمة تحققها عادةً هي أرخص نموذج لا يزال يفي بمعايير الجودة المطلوبة لديك، لذا ينبغي أن تختار النموذج المناسب للمهمة بدلًا من الاعتماد تلقائيًّا على الأغلى ثمنًا. وبما أن الأسعار تتغير غالبًا كل ربع سنة، استخدم الأرقام الحية في الآلة الحاسبة أعلاه قبل الالتزام بحجم طلبات معين.
هل تفرض النماذج مفتوحة المصدر أو مفتوحة الوزن رسومًا على كل رمز عند استخدام واجهة برمجة التطبيقات؟
كلا — فإذا استضفت ذاتيًّا نموذجًا مفتوح الوزن (مثل Llama أو Qwen أو DeepSeek أو إصدارات Mistral) فلا توجد أي رسوم على كل رمز على الإطلاق؛ بل تدفع فقط مقابل وحدة معالجة الرسوميات (GPU) أو الخادم والكهرباء وتكاليف الصيانة. وهذا يقلب المعادلة الاقتصادية: فالاستضافة الذاتية تكلّفك تكلفة ثابتة بالساعة بغض النظر عن حجم الاستخدام، لذا فهي تصبح مربحة فقط عند مستويات استخدام عالية ومستقرة. أما عند مستويات استخدام منخفضة أو متقطعة (bursty)، فإن استخدام واجهة برمجة التطبيقات المستضافة يكون أرخص دائمًا، لأنك تدفع فقط مقابل الرموز التي تستخدمها فعلًا.
كم سعة الذاكرة المخصصة لوحدات معالجة الرسوميات (VRAM) التي أحتاجها لاستضافة النموذج ذاتيًّا بدلًا من الدفع مقابل كل رمز؟
عند التكمية (quantisation) بـ ٤ بت يحتاج النموذج إلى نحو ٠٫٥–٠٫٦ جيجابايت من ذاكرة VRAM لكل مليار معامل (billion parameters)، بالإضافة إلى سعة إضافية لمخبأ KV (KV cache) الذي يزداد حجمه مع طول السياق. وبالتالي فإن نموذجًا بحجم ٨ مليار معامل (8B) يحتاج إلى نحو ٥–٦ جيجابايت، ويمكن استضافته على وحدة معالجة رسوميات استهلاكية، أما نموذج بحجم ٧٠ مليار معامل (70B) فيحتاج إلى نحو ٤٠–٤٨ جيجابايت (أي بطاقة مركز بيانات واحدة أو بطاقتَي GPU بسعة ٢٤ جيجابايت)، كما أن إضافة هامش أمان بنسبة ١٥–٢٠٪ لتغطية مخبأ KV والتكاليف التشغيلية الأخرى يُعد قاعدة إرشادية آمنة. ويزيد اتساع نافذة السياق (context window) وزيادة حجم الدفعة (batch size) من متطلبات مخبأ KV، لذا يجب أن تختار سعة الذاكرة بناءً على أطوال الموجهات الفعلية التي ستستخدمها، وليس فقط حجم أوزان النموذج.
كيف يمكنني خفض فاتورتي الخاصة بواجهة برمجة تطبيقات الذكاء الاصطناعي؟
أهم أدوات التخفيض هي تقليل عدد الرموز المرسلة واختيار مستوى أرخص من النماذج للمهام البسيطة. ويمكن لتقنية تخزين الموجهات في الذاكرة المؤقتة (prompt caching) أن تخفض تكلفة الموجهات النظامية المتكررة أو السياقات المشتركة بنسبة تصل إلى ٩٠٪ تقريبًا، كما توفر نقاط النهاية الدفعية أو غير المتزامنة (batch/asynchronous endpoints) خصمًا يبلغ عادةً نحو ٥٠٪ للأعمال غير العاجلة. ومن أبرز الإجراءات أيضًا: تقصير السياق الطويل، وتحديد حد أقصى لطول المخرجات، وتوجيه الطلبات البسيطة إلى نموذج خفيف (lite model) مع الاحتفاظ بالنماذج الرائدة للمهام الصعبة — وهذه الإجراءات مجتمعةً تخفض الفاتورة عادةً بنسبة كبيرة جدًّا.
أدوات مجانية إضافية من Convly
التكلفة المدمجة لواجهة برمجة التطبيقات لكل مليون رمز — ما تكلّفه النماذج الفعلية للذكاء الاصطناعي حقًّا
$0.02
$0.02
$0.03
$0.06
$0.07
$0.07
$0.09
$0.10
$0.13
$0.15
$10.00
$10.00
$11.25
$11.25
$20.00
$20.00
Blended cost = (3 × input + output) ÷ 4 · 10 cheapest + 6 priciest of 37 tracked, log scale · full spread 909× · Green = best value, orange = highest. Updated Sep 21, 2026.
🔍 أدمج هذه المخططات في موقعك (مجاني، مع ذكر المصدر)
احصل على الأرقام قبل الجميع
رسالة بريد إلكتروني أسبوعية واحدة: أي نماذج ذكاء اصطناعي غيَّرت أسعارها، وما الذي قاسَته الاختبارات الجديدة فعليًّا، وأي وحدة معالجة رسومات (GPU) تستحق الشراء. بدون ضجيج، وبلا محتوى زائد.
مجاني تمامًا. يمكنك إلغاء الاشتراك بنقرة واحدة. ولا نبيع أو نشارك عنوانك أبدًا.
