في الثلاثين من يوليو 2026 — أي بعد ثلاثة أسابيع فقط من الإتاحة العامة لـ GPT-5.6 — أعلنت شركة OpenAI عن تخفيضات سعرية كبيرة على نموذجين من الثلاثة في هذه العائلة. انخفض سعر GPT-5.6 Luna بنسبة 80%، فيما تراجع سعر GPT-5.6 Terra بنسبة 20%. أما GPT-5.6 Sol فيحافظ على سعره عند الإطلاق، لكنه يكتسب وضع Fast Mode الجديد الذي يوفر سرعة مضاعفة 2.5 مرة مقابل ضعف التكلفة.
الأرقام وحدها مهمة، لكن القصة التي تقف وراءها تتجاوز ذلك. Sol — النموذج الأكثر كفاءة في العائلة — ساهم بنفسه في تمويل تخفيضات أسعار النماذج الأخرى.
كيف أعاد Sol كتابة بنيته التحتية الخاصة
وثّق فريق هندسة OpenAI ما حدث داخليًا: استُخدم GPT-5.6 Sol لإعادة كتابة أنوية GPU الخاصة بالإنتاج في الشركة. وقد أسفر الجمع بين الأنوية المُعاد كتابتها بالذكاء الاصطناعي وأعمال البنية التحتية الأوسع عن خفض تكاليف الخدمة الشاملة بنسبة 20%. وجاء مجهود منفصل، بمساعدة النماذج أيضًا، لإعادة تصميم نماذج فك التشفير التخميني، مما أدى إلى تحسين كفاءة توليد الرموز بأكثر من 15%.
النتيجة: قلّصت OpenAI تكاليف تشغيل Luna وTerra الخاصة بها، ثم مررت هذه المدخرات إلى المطورين. التخفيض على Luna بنسبة 80% يتجاوز بكثير مكاسب كفاءة البنية التحتية — فالضغط التنافسي من النماذج مفتوحة المصدر وبيوت الأسعار يؤدي دوره بالتأكيد — لكن قصة التحسين الذاتي هي ما تتصدر خطاب OpenAI، وهي تُشير إلى نمط يستحق المراقبة.
نظرة سريعة على الأسعار الجديدة
| النموذج | الإدخال (قبل) | الإدخال (بعد) | الإخراج (قبل) | الإخراج (بعد) |
|---|---|---|---|---|
| GPT-5.6 Luna | 1.00 دولار / مليون | 0.20 دولار / مليون | 6.00 دولار / مليون | 1.20 دولار / مليون |
| GPT-5.6 Terra | 2.50 دولار / مليون | 2.00 دولار / مليون | 15.00 دولار / مليون | 12.00 دولار / مليون |
| GPT-5.6 Sol | 5.00 دولار / مليون | بدون تغيير | 30.00 دولار / مليون | بدون تغيير |
عند 0.20 دولار لكل مليون رمز إدخال و1.20 دولار للإخراج، يتفوق Luna الآن على Haiku 4.5 من Anthropic بفارق يتراوح بين أربعة وخمسة أضعاف على أحمال العمل المقارنة. أما Terra عند 2.00/12.00 دولار فيساوي أو يقل عن أسعار Claude Sonnet 5 القياسية. ويظل Sol عند 5.00/30.00 دولار أغلى من Opus 5 من Anthropic البالغة 5.00/25.00 دولار.
وضع Sol Fast Mode
إلى جانب تخفيضات الأسعار، قدّمت OpenAI Sol Fast Mode — كبديل مباشر لميزة Priority Processing السابقة. يوفر Fast Mode معدل نقل يصل إلى 2.5 ضعف السرعة القياسية لـ Sol بضعف التكلفة القياسية:
- الإدخال: 10.00 دولار / مليون رمز
- الإخراج: 60.00 دولار / مليون رمز
تستمر عمليات الدمج الحالية التي تستخدم Priority Processing في العمل؛ إذ يتوافق Fast Mode مع طلبات Priority Processing السابقة.
ما الذي يتغير للمطورين
خطوط الأنابيب عالية الحجم تتجاوز عتبة جديدة
يمتلك تخفيض Luna أكبر تأثير عملي على أحمال العمل التي كان تبريرها صعبًا سابقًا بأسعار النماذج المتطورة. لنتأمل خط أنابيب تصنيف يعالج 50 مليون رمز يوميًا — وهو مستوى واقعي لمعالجة المستندات أو توجيه خدمة العملاء أو وضع العلامات على قواعد المعرفة:
- تسعير Luna القديم: نحو 700 دولار يوميًا على أحمال العمل كثيفة الإدخال
- تسعير Luna الجديد: نحو 140 دولار يوميًا
يُغيّر هذا الفرق حسابات البناء مقابل الشراء للفرق التي لجأت إلى النماذج المستضافة ذاتيًا مفتوحة المصدر للتحكم في الإنفاق على نماذج اللغة الكبيرة. Luna عند 0.20 دولار للمليون أصبح تنافسيًا بما يكفي لإعادة النظر في أحمال العمل التي كانت حدية.
حلقات الوكلاء الداخلية تصبح أقل تكلفة
تستخدم الأنظمة متعددة الوكلاء عادةً نموذجًا خفيف الوزن للتنسيق والتوجيه وإرسال التعليمات للوكلاء الفرعيين. قد تستدعي حلقة التنسيق القياسية النموذج المنسّق من خمس إلى عشر مرات لكل مهمة. بتسعير Luna القديم، كانت التكلفة التراكمية للنفقات العامة مهمة على نطاق واسع. أما عند 0.20 دولار لكل مليون رمز إدخال، فإن طلبات المنسّق أصبحت بالكاد تُذكر ضمن ميزانية المهمة الإجمالية.
هنا يتجلى أعلى تأثير مضاعف لتخفيض Luna: ليس تكلفة الطلب الواحد، بل النفقات العامة التراكمية عبر آلاف مهام الوكلاء المتزامنة التي تعمل بشكل مستمر.
اقتصاديات RAG تتحول على نطاق واسع
تتضمن خطوط أنابيب التوليد المُعزَّز بالاسترداد (RAG) مدخلات سياقية كبيرة (مقتطفات مسترجعة) ولكن مخرجات مدمجة نسبيًا. يُعدّ تسعير Luna الجديد مناسبًا بشكل خاص لهذا النمط. نظام RAG للإنتاج يعالج 10,000 استعلام يوميًا بمعدل 2,000 رمز إدخال لكل منها يكلف الآن أقل من 5 دولارات يوميًا على Luna — مستوى يجعل RAG بنموذج متطور قابلًا للتطبيق اقتصاديًا حيث كان على الهامش سابقًا.
أداة تقدير التكلفة
قبل الاختيار بين Luna وTerra وSol، احسب أعداد الرموز الفعلية لديك:
const LUNA = { input: 0.20, output: 1.20 };
const TERRA = { input: 2.00, output: 12.00 };
const SOL = { input: 5.00, output: 30.00 };
function dailyCost(
model: typeof LUNA,
dailyInputTokens: number,
dailyOutputTokens: number
): number {
return (
(dailyInputTokens / 1_000_000) * model.input +
(dailyOutputTokens / 1_000_000) * model.output
);
}
// مثال: 10 ملايين إدخال / مليون إخراج يوميًا
console.log("Luna $", dailyCost(LUNA, 10_000_000, 1_000_000).toFixed(2));
console.log("Terra $", dailyCost(TERRA, 10_000_000, 1_000_000).toFixed(2));
console.log("Sol $", dailyCost(SOL, 10_000_000, 1_000_000).toFixed(2));
// Luna $3.20
// Terra $32.00
// Sol $80.00بـ 10 ملايين إدخال ومليون إخراج يوميًا، تكلف Luna الآن ما يعادل عُشر تكلفة Sol، وعُشر ما كانت تكلّفه بالتسعير القديم.
السياق التنافسي
تُعيد التخفيضات ترتيب الشريحة الاقتصادية من سوق النماذج المتطورة:
- Luna مقابل Gemini 3.5 Flash-Lite: يُقارب معدل إدخال Luna عند 0.20 دولار الشريحة الاقتصادية من Google أو يتفوق عليها في معظم أحمال العمل
- Terra مقابل Claude Sonnet 5: Terra عند 2.00/12.00 دولار أصبح تنافسيًا، وإن كان Sonnet 5 يُقدم حجة أقوى من ناحية القدرات عند نقاط سعر مماثلة
- Sol مقابل Anthropic Opus 5: يظل Sol أغلى على رموز الإخراج (30 مقابل 25 دولارًا)، مما يجعل Opus 5 الخيار الأفضل عندما تكون تكلفة الرمز للإخراج هي القيد الرئيسي
الترحيل من Priority Processing
إذا كنت تستخدم Priority Processing حاليًا، فإن Fast Mode هو البديل المباشر. تستمر الطلبات الحالية في التوجيه تلقائيًا. للتحكم الصريح، حدّث طلبات API الخاصة بك:
response = client.chat.completions.create(
model="gpt-5.6-sol",
fast_mode=True, # يحل محل priority_processing=True
messages=[...]
)ما الذي يبقى دون تغيير
سعر Sol لم يتغير. تطوير البرمجيات طويل الأمد، والتحليل المعقد لوثائق متعددة، ومهام الإنتاج التي تتطلب أقصى دقة — كلها لا تزال تستلزم تكلفة Sol. التخفيضات موجهة نحو الشرائح حيث تكون المرونة السعرية أعلى وحيث كانت النماذج مفتوحة المصدر والبيوت الاقتصادية الأكثر تنافسية.
ما يأتي بعد ذلك
صاغت OpenAI تخفيضات Luna وTerra باعتبارها مُمكّنة بفضل العمل الذاتي التحسيني لـ Sol. إذا استمر هذا النمط — حيث يُحسّن كل جيل من النماذج المتطورة كفاءة الخدمة للشرائح الأدنى — فإن تخفيضات الأسعار الإضافية على Terra وحتى Sol تصبح أكثر ترجيحًا مع تطور الجيل القادم من GPT.
للفرق التي تراجع إنفاقها على نماذج اللغة الكبيرة اليوم، تغيّر الحسابات. أحمال العمل التي انتقلت بعيدًا عن النماذج المتطورة لأسباب تتعلق بالتكلفة يجب أن تُعيد النظر في Luna. وينبغي لهندسات الوكلاء التي تعتمد على استدعاءات منسّق متكررة إعادة حساب ميزانية التكاليف العامة. منحنى تكلفة الذكاء الاصطناعي ينخفض بوتيرة أسرع مما كانت معظم خطط النشر تتوقعه.