GPT-6 أسترا للمطورين: API، الأسعار، سياق 1M، والفروقات مع GPT-5.6 سول
GPT-6 Astra API: دليل عملي للتسعير والترحيل من GPT-5.6 Sol
أصدرت OpenAI نموذج GPT-6 Astra في 3 سبتمبر 2026، أولًا لمجموعة محدودة من المؤسسات، ثم تدريجيًا لمستخدمي ChatGPT Plus وPro وBusiness وEnterprise، وواجهة برمجة تطبيقات OpenAI، وMicrosoft Azure، وAWS Bedrock. معرف النموذج هو gpt-6-astra، مع نافذة سياق تبلغ 1,050,000 رمز، وتصفه OpenAI بأنها «أفضل نموذج لهندسة البرمجيات حتى الآن». وهو أول نموذج تصنفه OpenAI بأنه حرج لقدرته على الأمن السيبراني، ما يؤثر في سلوكه عبر واجهة برمجة التطبيقات.
يركز هذا الدليل على واجهة برمجة التطبيقات: معرف النموذج ونقاط النهاية، أول طلب، مستويات جهد الاستدلال، التسعير، تغييرات الترحيل من GPT-5.6 Sol، وطريقة اختبار ما إذا كانت الزيادة في السعر تستحقها.
الخلاصة السريعة
- معرف النموذج هو
gpt-6-astra، وهو متاح عبر إكمال الدردشة، والردود، والدفعات. - لا يدعم الوقت الحقيقي أو المساعدين أو الضبط الدقيق.
- نافذة السياق: 1,050,000 رمز. الحد الأقصى للإخراج: 128,000 رمز. تاريخ قطع المعرفة: 30 أبريل 2026.
- يدعم إدخال النص والصورة، ويُخرج النص.
- التسعير القياسي لكل مليون رمز: 10 دولارات للإدخال، و1 دولار للإدخال المخزن مؤقتًا، و12.50 دولارًا لكتابة ذاكرة التخزين المؤقت، و50 دولارًا للإخراج.
- تتضاعف أسعار السياق الطويل عند تجاوز 272,000 رمز إدخال. الدفعات وFlex بنصف السعر، بينما الوضع السريع بضعف السعر.
- مستويات جهد الاستدلال:
lowوmediumوhighوxhighوmax. لم يعدnoneأوminimalمتاحًا. - أزالت OpenAI معاملات
temperatureوtop_pوlogprobs. كما استُبدلprompt_cache_retentionبـprompt_cache_options.ttl. - يبقى GPT-5.6 Sol متاحًا بالسعر الترويجي 4 دولارات للإدخال و20 دولارًا للإخراج حتى 21 نوفمبر 2026 على الأقل؛ لذلك يكلف Astra 2.5 ضعف هذا السعر.
GPT-6 Astra في لمحة
| العنصر | القيمة |
|---|---|
| معرف النموذج | gpt-6-astra |
| نافذة السياق | 1,050,000 رمز |
| أقصى إخراج | 128,000 رمز |
| تاريخ قطع المعرفة | 30 أبريل 2026 |
| الأنماط | الإدخال: نص، صورة. الإخراج: نص |
| نقاط النهاية | إكمال الدردشة، الردود، الدفعات |
| غير مدعوم | الوقت الحقيقي، المساعدون، الضبط الدقيق |
| الميزات | البث، المخرجات المهيكلة، استدعاء الدوال، البحث في الملفات، البحث في الويب، التخزين المؤقت للمطالبات، إدخال الصور |
| الأدوات المدمجة | استخدام الكمبيوتر، البحث في الويب، البحث في الملفات، مفسر الأكواد، توليد الصور |
| جهد الاستدلال | low، medium، high، xhigh، max |
| حدود المعدل - المستوى 5 | 15,000 طلب في الدقيقة، و40,000,000 رمز في الدقيقة |
| متاح أيضًا على | Microsoft Azure، وAWS Bedrock، وOpenRouter باسم openai/gpt-6-astra |
| معالجة البيانات | الاحتفاظ بالبيانات صفرًا لعملاء واجهة برمجة التطبيقات المؤهلين |
يُوقف Astra افتراضيًا في مساحات عمل المؤسسات، ويجب على المسؤول تمكينه. أما في ChatGPT، فيُحتسب استخدامه ضمن بدل الاشتراك الحالي، كما تحصل خطط Pro وBusiness وEnterprise على GPT-6 Astra Pro أيضًا.
أول طلب واجهة برمجة تطبيقات
واجهة برمجة تطبيقات الردود (Responses API) هي السطح الأساسي لـAstra، وهي مطلوبة عند استخدام الأدوات.
Python
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6-astra",
reasoning={"effort": "medium"},
input=[
{
"role": "developer",
"content": "You are a senior API engineer. Bias towards action. Ask only when the answer would change the result."
},
{
"role": "user",
"content": "Review this OpenAPI operation for auth and validation gaps, then propose three test cases."
},
]
)
print(response.output_text)
print(response.usage)
curl
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"reasoning": {"effort": "medium"},
"input": "Review this OpenAPI operation for auth and validation gaps, then propose three test cases."
}'
تظل إكمالات الدردشة (Chat Completions) مناسبة للنص العادي: بدّل نقطة النهاية وشكل الرسالة، واحذف أي حقول temperature أو top_p. عند الحاجة إلى استدعاء دالة أو أداة مدمجة، استخدم Responses API. للاطلاع على شكل الطلب بالتفصيل، راجع دليل واجهة برمجة تطبيقات الردود.
تحسين رسالة المطور
رسالة المطور أكثر أهمية مع Astra. تشير إرشادات نموذج OpenAI إلى أن النموذج «يطلب التوضيح بسهولة أكبر» من سابقاته، لذلك وجّهه إلى التحيز نحو العمل واطلب منه طرح الأسئلة فقط عندما تغير النتيجة.
- Astra أكثر حساسية للتعليمات الموجودة في المهارات والملفات المرفقة، لذا صرّح بأن تعليمات المستخدم لها الأولوية عند التعارض.
- كما أنه ينشئ القوائم والجداول افتراضيًا؛ اطلب نصًا نثريًا إذا كانت واجهتك تحتاج إلى ذلك.
جهد الاستدلال: خمسة مستويات
يكشف GPT-5.6 عن ستة مستويات، من none إلى max. أما Astra فيدعم خمسة فقط: low، medium، high، xhigh، max.
توصية OpenAI للترحيل مباشرة: استبدل none أو minimal بـ low، ثم أعد التقييم. أبقِ بقية المستويات كما هي.
يؤثر حذف none في أرخص جزء من عبء العمل. كانت Luna عند none خيارًا سريعًا للمهام التقليدية في عائلة GPT-5.6، ولا يوجد ما يعادلها في Astra. لذلك من المنطقي توجيه العمل الميكانيكي إلى GPT-5.6 Terra أو Luna، وحجز Astra للطلبات الصعبة. أما max فهو المستوى المستخدم في معايير الإطلاق، وقد قاست Artificial Analysis وصول أول رمز بعد أكثر من سبع دقائق في إحدى تشغيلاتها عند أقصى جهد. خصص ميزانية للانتظار قبل أن تخصص ميزانية للرموز.
تكلفة GPT-6 Astra
الأسعار التالية لكل مليون رمز وفق صفحة تسعير OpenAI:
| الفئة | الإدخال | الإدخال المخزن مؤقتًا | الإخراج |
|---|---|---|---|
| قياسي | $10.00 | $1.00 | $50.00 |
| قياسي، سياق طويل - أكثر من 272 ألف رمز إدخال | $20.00 | $2.00 | $75.00 |
| دفعة / مرن | $5.00 | $0.50 | $25.00 |
| دفعة، سياق طويل | $10.00 | $1.00 | $37.50 |
| الوضع السريع | $20.00 | $2.00 | $100.00 |
| الوضع السريع، سياق طويل | $40.00 | $4.00 | $150.00 |
تُحاسب كتابة ذاكرة التخزين المؤقت بسعر 12.50 دولارًا لكل مليون رمز. ويقدم الوضع السريع سرعة تصل إلى ضعفي المعالجة القياسية مقابل ضعفي السعر.
مقارنة بعائلة GPT-5.6
| النموذج | الإدخال | الإدخال المخزن مؤقتًا | الإخراج |
|---|---|---|---|
| GPT-5.6 Sol - عرض ترويجي حتى 21 نوفمبر 2026 على الأقل | $4.00 | $0.40 | $20.00 |
| GPT-5.6 Terra | $2.00 | $0.20 | $12.00 |
| GPT-5.6 Luna | $0.20 | $0.02 | $1.20 |
السعر المعلن لـSol هو 5 دولارات للإدخال و30 دولارًا للإخراج، لكن السعر الترويجي أصبح 4 دولارات و20 دولارًا منذ 21 أغسطس، وتقول OpenAI إنه سيستمر حتى 21 نوفمبر على الأقل. بالمقارنة مع السعر الترويجي، يكلف Astra 2.5 ضعفًا للإدخال والإخراج. وبالمقارنة مع السعر المعلن لـSol، تبلغ الزيادة ضعفًا للإدخال و1.67 ضعف للإخراج.
مثال عملي
لنفترض أن عاملًا يقرأ لقطة قاعدة بيانات بحجم 200,000 رمز مرة واحدة، ويعيد استخدامها كبادئة مخزنة مؤقتًا عبر 30 استدعاءً، ويُخرج 60,000 رمز إجمالًا:
- Astra: 2.00 دولار للقراءة الأولى + 29 قراءة مخزنة مؤقتًا بسعر 0.20 دولار لكل منها، أي 5.80 دولارات، + 3.00 دولارات للإخراج = نحو 10.80 دولارات.
- Sol الترويجي: 0.80 دولار للقراءة الأولى + 2.32 دولار للقراءات المخزنة مؤقتًا + 1.20 دولار للإخراج = نحو 4.32 دولارات.
تظل النسبة 2.5 ضعفًا. لكن Astra قد يعوض ذلك إذا أنهى المهمة بعدد أقل من الاستدعاءات والرموز. تدعي OpenAI أنه يكلف نحو 9% أقل لكل مهمة من Sol في Terminal-Bench 4.0، ويستخدم رموز إخراج أقل بنحو 65% من Claude Opus 5 في اختبار Agents' Last Exam. إذا انطبقت هذه الأرقام على عبء عملك، فقد تتقارب تكلفة المهمة. وإلا فستدفع 2.5 ضعفًا.
لتقليل التكلفة
- راقب عتبة 272,000 رمز؛ تجاوزها يضاعف أسعار الإدخال والتخزين المؤقت.
- قلّم مخرجات الأدوات.
- خزّن البادئة الثابتة مؤقتًا.
- استخدم الدفعات للأعمال التي يمكنها الانتظار، إذ تخفض الأسعار إلى النصف.
الترحيل من GPT-5.6 Sol
نشرت OpenAI قائمة قصيرة من التغييرات. تعامل معها حرفيًا:
إزالة معاملات أخذ العينات
- احذف
temperatureوtop_pوtop_logprobs. - وفي Chat Completions احذف
logprobsأيضًا. - أما في Responses فاحذف
message.output_text.logprobsمنinclude. - توصي OpenAI بإزالة هذه الحقول من كود العميل بدل الاعتماد على تجاهل واجهة برمجة التطبيقات لها.
أدنى مستوى للجهد هو low
- حوّل أي إعداد
noneأوminimalإلىlow.
تغيير شكل الاحتفاظ بذاكرة التخزين المؤقت
استبدل:
{ "prompt_cache_retention": "30m" }بـ:
{ "prompt_cache_options": { "ttl": "30m" } }
الأدوات تحتاج إلى Responses API
- يظل Chat Completions مناسبًا للنص، لكن استدعاء الدوال والأدوات المدمجة يتطلب Responses API.
اجعل المطالبات أكثر مباشرة
- أضف توجيهًا مثل «تحيز نحو العمل»، واذكر أن تعليمات المستخدم لها الأولوية على ملفات المهارات، واطلب نصًا نثريًا عندما لا تريد قوائم أو جداول.
لا توجد تغييرات معلنة على المخرجات المهيكلة أو تعريفات الدوال
- لذلك ينبغي أن يعمل المخطط الذي استخدمته مع Sol على Astra.
التغيير السلوكي الأوضح
- مطالبة كانت تعمل حتى النهاية مع Sol قد تتوقف الآن لطرح سؤال توضيحي. عالج ذلك مسبقًا في رسالة المطور.
هل يستحق Astra تكلفة 2.5 ضعفًا؟
الأرقام التالية شغلتها OpenAI بأقصى جهد لكل نموذج:
| المعيار | GPT-6 Astra | GPT-5.6 Sol | Claude Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | 57.9% | 37.3% | 55.8% |
| DeepSWE v1.1 | 74.1% | 72.7% | 67.4% |
| FrontierCode 1.1 Extended | 64.5% | 60.6% | 63.6% |
| مهام ترحيل قاعدة البيانات الداخلية | 63.9% | 42.7% | 57.8% |
| OSWorld 2.0 | 72.6% | 65.7% | - |
| MRCR v2، 8-needle، من 512K إلى 1M | 96.3% | 73.8% | - |
| GPQA Diamond | 96.0% | 94.6% | 93.7% |
| Humanity's Last Exam - مع الأدوات | 57.2% | - | 65.0% |
الفجوات الأهم للمطورين هي:
- تفوق بنحو 20 نقطة على Sol في العمل الطرفي القائم على الوكلاء.
- استرجاع سياق طويل يجعل نافذة المليون رمز عملية، لا مجرد رقم تسويقي.
- فارق صغير في DeepSWE.
- تفوق Claude Fable 5.1 على Astra في Humanity's Last Exam بنحو ثماني نقاط. لذلك ليس هذا انتصارًا ساحقًا.
وفي فهرس Artificial Analysis المستقل، يحتل Astra المرتبة الثانية بين 202 نموذجًا. راجع أيضًا تحليل معيار Fable 5.1.
متى تستخدم كل نموذج؟
يحتفظ Sol بدوره في:
- الاستدعاءات القصيرة ذات الحجم الكبير.
- المهام التي تستفيد من مستوى
noneأو زمن استجابة منخفض. - الحالات التي تجعل زيادة السعر 2.5 ضعفًا غير مبررة.
يستحق Astra التجربة في:
- تشغيل الوكلاء لفترات طويلة.
- تمرير سياق المستودع بالكامل.
- استخدام الكمبيوتر.
- المهام التي كان يفشل فيها Sol بسبب الانحراف أو الاستسلام.
اختبر التبديل قبل النشر
عملية الترحيل صغيرة، لكنها تحتاج إلى قياس:
- في Apidog، خزّن معرف النموذج في متغير بيئة.
- شغّل الطلب المحفوظ نفسه مقابل
gpt-5.6-solوgpt-6-astraبتغيير المتغير فقط. - أضف تأكيدات على:
usage.input_tokens،usage.output_tokens، عدد الرموز المخزنة مؤقتًا، الزمن الفعلي للاستجابة. - أرسل مجموعة تمثيلية من المهام إلى النموذجين.
- قارن التكلفة لكل مهمة، وعدد الاستدعاءات، ومعدل النجاح.
نفّذ اختبارين إضافيين:
- أرسل طلبًا لا يزال يحتوي على
temperature، وسجّل النتيجة في بيئة الاختبار بدل الإنتاج. - تأكد من بقاء المطالبات الطويلة تحت 272,000 رمز إدخال، لأن تجاوز الحد يضاعف السعر.
استخدم الدفعات كخطة تراجع للأعمال غير العاجلة، ونزّل Apidog إذا لم يكن مثبتًا لديك. يشرح دليل GPT-5.6 API التجهيز نفسه على الجيل السابق.
الأسئلة الشائعة
ما معرف نموذج GPT-6 Astra؟
المعرف هو gpt-6-astra، مع لقطة واحدة. يتوفر أيضًا عبر Azure وAWS Bedrock، وعلى OpenRouter باسم openai/gpt-6-astra.
هل يدعم GPT-6 Astra الضبط الدقيق أو Realtime API؟
لا. تدعم صفحة النموذج Chat Completions وResponses وBatch، بينما لا يدعم Realtime أو Assistants أو fine-tuning.
ما نافذة السياق وأقصى إخراج؟
نافذة الإدخال 1,050,000 رمز، والحد الأقصى للإخراج 128,000 رمز. تُحاسب المطالبات التي تتجاوز 272,000 رمز إدخال بسعر السياق الطويل.
لماذا فشل طلبي بعد التبديل من Sol؟
تحقق من: بقايا temperature أو top_p. استخدام مستوى جهد none أو minimal. استخدام prompt_cache_retention. أزال Astra هذه الخيارات أو غيّر شكلها؛ راجع قائمة الترحيل أعلاه.
هل يمكن أن يتوقف الطلب من تلقاء نفسه؟
نعم. تستخدم OpenAI مراقب عدم التوافق مع طلبات استخدام الأدوات. وفي واجهة برمجة التطبيقات، قد تتوقف المهمة التي تم وضع علامة عليها بدلًا من إيقافها للمراجعة. تشغيل الوكلاء لفترات طويلة أكثر عرضة لذلك، لذا اجعل مهامك قابلة للاستئناف. للاطلاع على الضمانات المرتبطة بهذا السلوك، راجع منشور عتبة الأمن السيبراني الحرجة.
ما الذي تفعله هذا الأسبوع؟
- انقل عبء عمل وكيل واحد إلى
gpt-6-astraعبر Responses API. - أزل معاملات أخذ العينات، واضبط الجهد على
medium. - قِس الرموز والزمن ومعدل النجاح مقابل Sol باستخدام المدخلات نفسها.
- إذا كانت التكلفة لكل مهمة مساوية أو أفضل، رحّل بقية العبء.
- وإلا فستحصل على رقم واقعي مبني على حركة المرور الخاصة بك، وهو أفضل من الاعتماد على مخطط الإطلاق وحده.
روابط مرجعية
- السعر الترويجي لـSol
- صفحة نموذج OpenAI
- تجربتنا العملية لمدة يومين
- دليل Responses API
- إرشادات نموذج OpenAI
- GPT-5.6 Terra
- Artificial Analysis
- صفحة تسعير OpenAI
- دليل GPT-5.6 API
- تحليل معيار Fable 5.1
- Apidog
- تنزيل Apidog
- عتبة الأمن السيبراني الحرجة
Comments
No comments yet. Start the discussion.