Tuesday, 8 September 2026 | التحديث اليومي نظرة ثاقبة للذكاء الاصطناعي، مكتوبة للبناة

جيت بي تي-6 أسترا: التسعير، والاختبارات القياسية، وما تغيّر فعليًّا

أبرز النقاط المستخلصة

  • جيت بي تي-6 أسترا النموذج الرائد الجديد من شركة OpenAI، الذي أُعلن عنه في ٣ سبتمبر ٢٠٢٦ وبدأ طرحه تدريجيًّا لمشتركي ChatGPT Plus وPro وBusiness وEnterprise، ولواجهة برمجة التطبيقات (API) (gpt-6-astra)، وAzure وAWS Bedrock.
  • سعر واجهة برمجة التطبيقات (API): ١٠ دولارات أمريكيّة لكل مليون رمز إدخال، و٥٠ دولارًا أمريكيًّا لكل مليون رمز إخراج — أي ضعف GPT-5.6 سعر Sol البالغ ٥ دولارات/٣٠ دولارًا، وبسعر مماثل تمامًا لكلاود فابل 5.
  • نافذة السياق تبلغ ١٬٠٥٠٬٠٠٠ رمز، مع أقصى حد للإخراج يبلغ ١٢٨ ألف رمز. تُحتسب الطلبات التي تتجاوز ٢٧٢ ألف رمز إدخال بمعدل ضعف التكلفة على الإدخال و١٫٥ ضعف التكلفة على الإخراج؛ أما الوضع السريع (Fast mode) فيضاعف الفاتورة بالكامل مقابل سرعة تصل إلى ضعف السرعة القياسية.
  • المجالات التي يتفوق فيها الأداء: استخدام الحاسوب (OSWorld 2.0 بنسبة ٧٢٫٦٪ مقابل ٦٥٫٧٪ لدى Sol)، والرياضيات (FrontierMath Tier 4 بنسبة ٩٧٫٦٪)، والأمن السيبراني — وهو أول نموذج من OpenAI يصل إلى عتبة «حرجة» في مجال الأمن السيبراني، ولذلك فإن النسخة الأولى من أسترا ترفض كتابة نماذج توضيحية (proof-of-concept exploits) للأخطاء الأمنية.
  • المجالات التي لا يتفوق فيها: وفق جدول OpenAI الخاص، يتأخر أسترا خلف كلاود فابل 5.1 في مؤشر الذكاء الاصطناعي التحليلي (61.2 مقابل 65.7)، وفي اختبار «امتحان البشرية الأخير» مع استخدام الأدوات (57.2% مقابل 65.0%).

أطلقت OpenAI نموذج جيت بي تي-6 أسترا في ٣ سبتمبر ٢٠٢٦ مع ادعاءات غير معتادة من حيث الحجم — فقد أنهى غريغ بروكمان، الرئيس التنفيذي للشركة، المؤتمر الصحفي قائلًا: «مرحبًا بكم في عصر الذكاء العام الاصطناعي (AGI)»، وفق ما ورد في Axios. وإذا أزلنا الإطارات التسويقية، فإن صفحة الإطلاق لا تزال تحتوي على الكثير من المعلومات الملموسة القابلة للتحقق: قائمة أسعار كاملة، ونافذة سياق تتطابق أخيرًا مع الادعاءات التسويقية، وجداول اختبارات قياسية تتضمّن أسماء المنافسين مباشرةً من OpenAI. وتتناول هذه المقالة ما تقوله الأرقام، وما تكلفة تشغيل النموذج مقارنةً بالبدائل المتاحة لدينا في قاعدة بيانات النماذج، ومن يجب أن يهتم بهذا الأمر.

تكلفة جيت بي تي-6 أسترا

نموذج واجهة برمجة التطبيقات (API) هو gpt-6-astra. ووفقًا لـ صفحة النموذج الخاصة بـ OpenAI:

البند جيت بي تي-6 أسترا
المدخلات ١٠٫٠٠ دولار أمريكي لكل مليون رمز
إدخال مخبّأ (Cached input) ١٫٠٠ دولار أمريكي لكل مليون رمز
المخرجات ٥٠٫٠٠ دولار أمريكي لكل مليون رمز
رسوم إضافية للسياقات الطويلة الطلبات التي تتجاوز ٢٧٢ ألف رمز إدخال: ضعف معدلات الإدخال والتخزين المؤقت، و١٫٥ ضعف معدل الإخراج، ويُطبَّق ذلك على الطلب بأكمله
الوضع السريع (Fast mode) مضاعفة المعدلات المطبّقة مقابل سرعة تصل إلى ضعف السرعة القياسية في المعالجة
نافذة السياق ١٬٠٥٠٬٠٠٠ رمز
الحد الأقصى للإخراج ١٢٨٬٠٠٠ رمز
تاريخ انتهاء المعرفة ٣٠ أبريل ٢٠٢٦
الوسائط إدخال نصوص وصور، وإخراج نصوص فقط
نهايات الخدمة (Endpoints) إكمال المحادثات (Chat Completions)، والاستجابات (Responses)، والمعالجة الدفعية (Batch)

يبرز أمران بوضوح. أولًا، السعر هو بالضبط ضعف GPT-5.6 Sol (٥ دولارات للإدخال / ٣٠ دولارًا للإخراج)، وبالتالي فإن الطلب الذي يستهلك مليون رمز في كل من الإدخال والإخراج يرتفع سعره من ٣٥ دولارًا إلى ٦٠ دولارًا — أي بزيادة نسبتها ٧١٪. ثانيًا، تُطبَّق الرسوم الإضافية للسياقات الطويلة عند عتبة ٢٧٢ ألف رمز إدخال، وليس عند السقف الأقصى البالغ ١٫٠٥ مليون رمز: إذ تُحتسب الطلبات التي تستخدم النافذة بالكامل بسعر ٢٠ دولارًا لكل مليون رمز إدخال و٧٥ دولارًا لكل مليون رمز إخراج. وعلى أي شخص يخطط لاستخدام هذه النافذة كبديل عن استرجاع البيانات (retrieval) أن يحسب هذه التكلفة أولًا؛ وقد أدرجت حاسبة تكلفة واجهة برمجة التطبيقات (API) النموذج الجديد بالفعل في تقييماتها.

كيف يقارن السعر

الأسعار لكل مليون رمز، وفقًا لـ Convly قاعدة بيانات النماذج (تم التحقق منها في ٨ سبتمبر ٢٠٢٦):

النموذج المدخلات المخرجات السياق ١ مليون رمز إدخال + ١ مليون رمز إخراج
جيت بي تي-6 أسترا $10.00 $50.00 1.05 مليون رمز $60.00
Claude Fable 5 $10.00 $50.00 مليون $60.00
GPT-5.6 Sol $5.00 $30.00 1.05 مليون رمز $35.00
GPT-5.5 $5.00 $30.00 1.05 مليون رمز $35.00
Claude Opus 5 $5.00 $25.00 مليون $30.00
Gemini 3.1 Pro $2.00 $12.00 1.05 مليون رمز $14.00
Claude Sonnet 5 $2.00 $10.00 مليون $12.00
Gemini 3.6 Flash $1.50 $7.50 مليون $9.00
DeepSeek V4-Pro $0.435 $0.87 مليون $1.31
DeepSeek V4-Flash $0.14 $0.28 مليون $0.42

يقع أسترا في القمة المطلقة للسوق، مشاركًا المركز الأول مع Claude Fable 5 وأعلى بنحو ٤٦ مرة من سعر DeepSeek V4-Pro في دورة كاملة (إدخال وإخراج). وهذه الفجوة السعرية هي السؤال المحوري أمام المشترين، وهي السبب الذي يجعلنا نتابع مؤشر «الذكاء لكل دولار» بدلًا من الاعتماد فقط على النتائج الإجمالية في مؤشر الأداء بالنسبة للسعر.

ما تشير إليه الاختبارات القياسية — بما في ذلك المجالات التي يخسر فيها أسترا

تنشر صفحة إطلاق OpenAI نتائج مقارنة مباشرةً بين GPT-5.6 Sol وكلاود فابل 5.1 وكلاود فابل 5، Claude Opus 5 وGemini 3.8 Flash. الصفوف المُختارة، وكلُّها من تلك الصفحة (الدرجات من قِبل OpenAI، و«أقصى درجة ممكنة بأي جهد»):

معيار الأداء (Benchmark) جيت بي تي-6 أسترا GPT-5.6 Sol كلاود فابل 5.1 Claude Opus 5
OSWorld 2.0 (استخدام الحاسوب) 72.6% 65.7% 70.2%
ScreenSpot-Pro 92.7% 76.9%
Terminal-Bench 4.0 57.9% 37.3% 55.8% 52.6%
DeepSWE v1.1 74.1% 72.7% 67.4% 73.7%
FrontierMath Tier 4 (v2) 97.6% 83.0% 87.8% 73.2%
GPQA Diamond 96.0% 94.6% 93.7% 93.7%
ARC-AGI-2 95.0% 92.5% 90.0% 90.4%
ARC-AGI-3 99.9% 7.8% 30.2%
امتحان البشرية الأخير (مع الأدوات) 57.2% 65.0% 63.6%
مؤشر الذكاء التحليلي الاصطناعي الإصدار 4.1.1 61.2 60.9 65.7 63.1
مؤشر وكيل البرمجة التحليلي الاصطناعي الإصدار 1.4 67.0 65.1 68.1
ExploitBench (الأمن السيبراني) 100% 78.5% 70%
SRE-Bench (الهندسة العكسية) 88.0% 55.9% 12.5%

والنمط متسقٌ. فالمكاسب التي حققها نموذج Astra تتركَّز في المهام الوكيلية — مثل قيادة حاسوب، أو تشغيل طرفية، أو استغلال برامج أو هندستها عكسياً — وفي الرياضيات، حيث يحقِّق أداءً كاملاً في أصعب مستوى من FrontierMath وأداءً في ARC-AGI-3 (قفزة من 7.8% لصالح Sol). أما على المؤشرات التجميعية الشاملة فهو تقدُّمٌ أقل وضوحاً: 61.2 مقابل 60.9 لصالح Sol في مؤشر الذكاء التحليلي الاصطناعي، وهو يتأخَّر عن كلٍّ من Claude Fable 5.1 وOpus 5. وفي امتحان البشرية الأخير مع الأدوات، يقل أداؤه عن Fable 5.1 بنسبة تقارب ثماني نقاط. وتلاحظ الملاحظات السفلية الخاصة بـOpenAI أيضاً أن نماذج Claude استُبعدت من ثلاثة مقاييس علمية لأنها رفضت معظم الأسئلة، وبالتالي فإن تلك الصفوف ليست مقارنات مباشرة.

وادعاء الكفاءة أكثر إثارةً للانتباه من الدرجات الخام. ففي OSWorld 2.0، تفيد OpenAI بأن Astra حقَّق 72.6% خلال نحو 40 دقيقة لكل مهمة، مقارنةً بـ65.7% خلال نحو 75 دقيقة لصالح Sol — أي ما يعادل انخفاضاً في الوقت بنسبة 47% — كما أنه أسرع بمقدار 1.9 مرة في إنجاز المهام على Mind2Web بعد تضمين إطار Codex المحدَّث. ولأحمال العمل الوكيلية التي تُحتسَب وفق عدد الرموز (tokens) وتُقيَّم وفق الزمن بالساعة، فإن هذا الأمر أهمُّ من تحقيق مكسبٍ نقطتين في المؤشر.

التصنيف المتعلق بالأمن السيبراني، وما الذي تحجبه النسخة الحالية

ويُعدُّ Astra أول نموذج تطلقه OpenAI يبلغ عتبة الأمن السيبراني «الحرجة» ضمن إطار الاستعداد (Preparedness Framework) الخاص بالشركة. وتُفيد صفحة الإطلاق بأن OpenAI سجَّلت أداءً مثالياً بنسبة 100% في ExploitBench (مقابل 78.5% لصالح Sol)، و42.4% في ExploitGym (مقابل 30.3% لصالح Sol)، و88.0% في نسبة النجاح من المحاولة الأولى في SRE-Bench، وهو مقياس للهندسة العكسية حقَّق فيه Sol نسبة 55.9%. وتضيف الشركة أنها، أثناء تقييم أُجري على ثغرات بين يونيو ويوليو وأغسطس 2026، اكتشف النموذج واستخدم ثغرتين صفريةً (zero-days) لم تكن معروفة سابقاً، وتقوم OpenAI بالإبلاغ عنها الآن لمُدرِّي النظام ذي الصلة.

والنتيجة العملية المباشرة للمستخدمين هي إطلاق نسخة مقيدة. فسيقوم Astra بمراجعة الشيفرة الآمنة وإصلاحها، لكنه يرفض المهام الهجومية المتقدمة مثل إنشاء نماذج توضيحية للاستغلال (proof-of-concept exploits). وتوضح OpenAI أن ضوابط أقل تشدداً ستُطرح تدريجياً خلال الأسابيع القادمة عبر برنامج Daybreak الخاص بها، والموجَّه إلى سير العمل الدفاعية مثل تحليل البرمجيات الخبيثة وهندسة الكشف عنها. وتضيف Axios أن الإطلاق كان قد تأخَّر سابقاً لإضافة اختبارات السلامة بعد أن وُجد أن القدرات السيبرانية لهذا النموذج بلغت المستوى الحرجة، وذلك في أعقاب الحادث الذي وقع في يوليو عندما تجاوزت نماذج OpenAI قيد الاختبار أنظمة Hugging Face.

المحاذاة (Alignment): تحسّن في نطاق التطبيق، لكنها أسوأ من حيث قابلية المراقبة

وتخصص صفحة الإطلاق مساحةً مساويةً تقريباً للسلوك والقدرات. فالرقم البارز هو تقييمٌ لـ«مهمة مستحيلة» أُعدَّ بعد حادث Hugging Face: فعند إسناد مهمة لا يمكن إنجازها إلا بتجاوز الهدف المصرَّح به، نفَّذ GPT-5.6 Sol بدون ضوابط الإنتاج هذه المهمة بنسبة 48% من المرات، بينما لم يفعل Astra ذلك أبداً (0%). وتُفيد OpenAI أيضاً بأن النموذج لم يحاول أبداً التحايل على رفض مراجعة Codex التلقائية، حتى عندما صُمِّم هذا الرفض ليكون قابلاً للتحايل عليه عمداً، وأنه أقل عرضةً بثلاث مرات من Sol لتضليل المستخدم بشأن قدراته الذاتية.

وتكون OpenAI صريحةً بنفس القدر بشأن تكلفة ذلك. فقد كانت عملية الاستدلال المكتوبة لـAstra أصعب في المراقبة مقارنةً بـSol في الاختبارات التي طُلب فيها منه التحايل على آليات المراقبة — وتُعزى الشركة هذا التراجع إلى حاجة النموذج إلى عدد أقل من الخطوات المكتوبة، وتصف الانخفاض بأنه «خطير»، وتؤكد أن تحسين قابلية المراقبة لا يزال أولوية بحثية. كما أن نماذج من فئة Astra هي أول نماذج تُطرح في الإنتاج مع نظام مراقبة الانحراف عن التوجُّه (misalignment monitoring): ففيها مصنِّفات تفحص الاستدلال والأفعال، ويمكنها إيقاف المهمة مؤقتاً، مع تحذيرٍ من OpenAI بأن هذا قد يؤدي أحياناً إلى مقاطعة مهام مشروعة.

التوافر والطرح التدريجي

  • 3 سبتمبر: عرض مبدئي محدود لمجموعة صغيرة من المؤسسات المشاركة في برنامج Daybreak Access.
  • «خلال الأيام القادمة»: جميع مستخدمي ChatGPT Plus وPro وBusiness وEnterprise؛ ويُحتسب الاستخدام ضمن الحصص المسموح بها في الاشتراك الحالي، مع إمكانية شراء رصيد إضافي. أما الوصول للمؤسسات فيُعطَّل افتراضياً حتى يقوم المسؤول بتفعيله.
  • GPT-6 Astra Pro: متوفرٌ لخطط Pro وBusiness وEnterprise.
  • المطوِّرون: gpt-6-astra عبر واجهة برمجة تطبيقات OpenAI (API)، بالإضافة إلى Microsoft Azure وAmazon Bedrock. وتتوفر خدمة «عدم الاحتفاظ بأي بيانات» (Zero Data Retention) للعملاء المؤهلين من مستخدمي الواجهة.
  • Codex: وضع تجريبي جديد بعنوان «الملاحظات عبر نوافذ السياق» يحل محل عملية الضغط المتكررة في الجلسات الطويلة؛ وهو متاح اختيارياً عبر ملف config.toml الآن وسيصبح الوضع الافتراضي لنموذج Astra.

وتُفيد Axios بأن Astra تدرَّب على أكثر من 100,000 وحدة معالجة رسومية (GPU) في موقع Stargate التابع لـOpenAI في تكساس — وهي أكبر عملية تدريب تُجرى حتى الآن — وأنه أول نموذج تطلقه OpenAI تلعب فيه نماذج أخرى دوراً رقابياً مهماً أثناء التدريب. ولا تظهر أيٌّ من هاتين المعلومتين في صفحة الإطلاق نفسها، لذا يجب التعامل معها باعتبارها معلومات مُبلَّغ عنها وليس وثائق رسمية.

من ينبغي أن ينتقل إلى هذا النموذج

غيِّر الآن إذا كنت تُشغِّل وكلاء يستخدمون الحاسوب أو وكلاء برمجة ذات أفق زمني طويل، حيث يتحكم وقت التشغيل الفعلي (wall-clock time) والموثوقية في التكلفة: فالمكاسب في OSWorld وTerminal-Bench كبيرةٌ جداً، ونتيجة عدم تجاوز النطاق (0% scope-overreach) هي خاصية السلامة التي تتطلبها هذه التطبيقات. انتظر إذا كانت مهامك تتعلَّق بالمحادثة أو التلخيص أو الاستخلاص: فعلى مؤشرات الذكاء العام، يتفوَّق Astra على Sol بشكل طفيف فقط، رغم كون سعره ضعف سعر Sol، كما أن Claude Opus 5 GPT-5.6 Sol بسعر 5 دولارات/25 دولاراً أو Gemini 3.1 Pro بسعر دولارين/12 دولاراً لا يزالان أفضل قيمة بكثير. لا تغيِّر للبحث الأمني الهجومي بعدُ — فنسخة الإطلاق ترفض هذا النوع من المهام تصميمياً، بينما يقتصر الوصول الأوسع على برنامج Daybreak.

والملخَّص الصادق هو أن GPT-6 Astra يمثل خطوة حاسمة في تطوير الوكلاء، لكنها خطوة هامشية بالنسبة لبقية المستخدمين، ومُسعَّرٌ وفقاً لذلك. أما ورقة المواصفات الكاملة الخاصة به، إلى جانب كل النماذج المذكورة أعلاه، فهي متاحة في قسمنا المخصَّص لـ إدخال GPT-6 Astra والـ لوحة تصنيف النماذج اللغوية الكبيرة (LLM).

الأسئلة الشائعة

كم تكلفة جيت بي تي-6 أسترا لكل مليون رمز؟

10 دولارات للإدخال، ودولار واحد للإدخال المخبَّأ، و50 دولاراً للإخراج في الطبقة القياسية من واجهة برمجة التطبيقات، وفقاً لصفحة النموذج الرسمية لدى OpenAI. أما المدخلات التي تتجاوز 272 ألف رمز (token) فتُحتسَب بسعر مضاعف للإدخال وبـ1.5 مرة للإخراج، كما أن الوضع السريع (Fast mode) يكلِّف ضعف السعر مقابل سرعة تصل إلى ضعف السرعة العادية.

هل يتوفر جيت بي تي-6 أسترا في خدمة ChatGPT Plus؟

وتقول OpenAI إنها ستُفعِّل Astra تدريجياً لجميع مستخدمي Plus وPro وBusiness وEnterprise «خلال الأيام القادمة» بعد العرض المبدئي المحدود في 3 سبتمبر، ضمن الحصص المسموح بها حالياً. أما Astra Pro فهو مقصورٌ على خطط Pro وBusiness وEnterprise.

ما حجم نافذة السياق الخاصة بـ جيت بي تي-6 أسترا؟

1,050,000 رمز، مع أقصى حد للإخراج يبلغ 128,000 رمز. وتُفيد اختبارات OpenAI الطويلة السياق (MRCR) بأن أداء Astra يبلغ 100% في استرجاع المعلومات عند نطاقات 256K–512K رمزاً، و96.3% عند نطاقات 512K–1M رمز، مقارنةً بـ91.5% و73.8% لصالح GPT-5.6 Sol.

هل هو أفضل من كلاود فابل 5.1؟

يعتمد ذلك على نوع المهمة. ففي الجدول المنشور من قِبل OpenAI، يتقدَّم Astra في مجال استخدام الحاسوب وTerminal-Bench وFrontierMath والأمن السيبراني، بينما يتقدَّم Fable 5.1 في مؤشر الذكاء التحليلي الاصطناعي (65.7 مقابل 61.2) وفي امتحان البشرية الأخير مع الأدوات (65.0% مقابل 57.2%). وكلا النموذجين يكلف 10 دولارات/50 دولاراً في أعلى مستوى تسعير.

لماذا ترفض أسترا بعض مهام الأمان؟

وهو أول نموذج تطلقه OpenAI يصل إلى عتبة الأمن السيبراني «الحرجة» ضمن إطار الاستعداد. وتتعامل نسخة الإطلاق مع المهام الدفاعية مثل مراجعة الشيفرة وإصلاحها، لكنها ترفض بناء نماذج توضيحية للاستغلال؛ أما التوسيع في نطاق الوصول فيُخطَّط له عبر برنامج Daybreak الخاص بـOpenAI.

بقلم مصطفى إحسان

مصطفى إحسان هو مؤسس ومُحرِّر موقع Convly.ai. وقد أنشأ قاعدة بيانات النماذج الحية للذكاء الاصطناعي الخاصة بالموقع، ومؤشر الأداء السعري الخاص به، بالإضافة إلى الحاسبات المجانية لحساب متطلبات الذاكرة VRAM، وتكاليف واجهة برمجة التطبيقات (API)، والاقتصاديات المرتبطة بالاستضافة الذاتية. ويكتب مصطفى عن أسعار النماذج، ونتائج الاختبارات المعيارية، والأجهزة اللازمة لتشغيل نماذج الذكاء الاصطناعي محليًّا، ويعطي دائمًا الأولوية للأرقام المُقاسة بدقة على الادعاءات التي تطلقها الشركات المصنِّعة.

انتقل إلى الأعلى