تسعير gpt-5.6 وتكلفة خدمة المستخدم. تكلفة خدمة المستخدم هي ما يكلّفك مستخدم واحد في كل مرة يلمس فيها ميزتك القائمة على الذكاء الاصطناعي. تتيح فئات gpt-5.6 الثلاث تقسيم هذه الاستدعاءات، بحيث تتوقف الاستدعاءات الرخيصة عن دفع أسعار الفئة الرائدة. هذه قراءة مسؤول المنتج للفاتورة، لا قراءة المهندس للنموذج.
في 26 يونيو 2026، أطلقت OpenAI عائلة gpt-5.6: sol وterra وluna. تعمل luna بسعر 1 دولار للإدخال و6 دولارات للإخراج لكل مليون رمز (token). تعمل sol بسعر 5 / 30 دولارًا. هذا فارق بمقدار 5 أضعاف على نفس واجهة المنتج، بحسب ما ذكرته finout.
إن كنت تقود المنتج في شركة saas في جولة تمويل series b وتملك ميزة ذكاء اصطناعي تواجه العميل، فهذا الفارق هو مراجعتك المالية القادمة. السؤال ليس أي نموذج أذكى. السؤال هو أي الاستدعاءات تحتاج فعلًا إلى sol، وأيها كان يدفع أكثر مما يجب دون أن ينتبه أحد.
#فيمَ تُستخدم فئة luna من gpt-5.6 فعلًا؟
ما هي فئة luna من gpt-5.6 وما مدى رخصها؟
luna هي الأرخص بين فئات gpt-5.6 الثلاث من OpenAI، أُطلقت في 26 يونيو 2026 بسعر 1 دولار للإدخال و6 دولارات للإخراج لكل مليون رمز، مقابل 5 / 30 دولارًا لـ sol — فارق بمقدار 5 أضعاف. توجّه OpenAI فئة luna نحو التصنيف وتوجيه النوايا والتلخيص: الاستدعاءات عالية الحجم ومنخفضة التفكير التي تقف خلف معظم ميزات الذكاء الاصطناعي.
معظم ميزات الذكاء الاصطناعي التي تواجه العميل ليست مهمة واحدة. هي كومة من المهام الصغيرة ترتدي زرًا واحدًا. صنّف هذه الرسالة. وجّهها إلى المسار الصحيح. لخّص المحادثة. ثم، أحيانًا، فكّر فعلًا في حالة صعبة.
المهام الثلاث الأولى هي بالضبط ما سُعِّرت من أجله luna. أما الرابعة فهي ما تبقيه لـ sol. إن كانت كل واحدة من هذه الاستدعاءات تصل حاليًا إلى نموذجك الرائد، فإن نحو 80% من حجم رموزك تدفع خمسة أضعاف أكثر مما يلزم.
كم يوفّر تقسيم الفئات فعلًا من الفاتورة؟
خذ ميزة تنتج 10 ملايين رمز إخراج شهريًا، منها 80% توجيه وتصنيف وتلخيص. على sol وحدها، يكلّف هذا الإخراج 300 ألف دولار شهريًا. انقل الـ 80% إلى luna وسيكلّف العمل نفسه 88 ألف دولار. تبقى استدعاءات التفكير على sol دون تغيير، لأن هذا هو المكان الذي يجب أن تصمد فيه الجودة.
لا يرى المستخدم أي فرق. التصنيف يصل كما هو، والملخّص يُقرأ كما هو، والسؤال الصعب يحصل على الإجابة الجيدة كما هي. الشيء الوحيد الذي تغيّر هو أي فئة دُفعت مقابل أي استدعاء.
#هل يغيّر التخزين المؤقت (caching) الحساب أيضًا؟
نعم، وهذا يتراكم مع الفارق السابق. تحتفظ gpt-5.6 بخصم 90% على الإدخال المخزَّن مؤقتًا، مع نقاط تقسيم واضحة للتخزين المؤقت وحد أدنى لعمر التخزين المؤقت مدته 30 دقيقة، بحسب eesel بتاريخ 26 يونيو 2026. تُحتسب عمليات الكتابة في التخزين المؤقت بمعدل 1.25 ضعفًا، لذا تبقى التكلفة لمرة واحدة صغيرة.
موجّه النظام (system prompt) لديك ثابت في كل استدعاء. هذا هو الجزء الذي تخزّنه مؤقتًا. لميزة ترسل كتلة تعليمات من 2000 رمز مع كل طلب، يخفّض تخزينها مؤقتًا 90% من تلك الشريحة من الإدخال، إضافة إلى أي فئة وجّهت إليها الاستدعاء.
we are
stennir استشارة ذكاء اصطناعي تبني طبقة التوجيه التي تجعل ميزتك تقرأ كل استدعاء وترسل العمل الرخيص إلى luna والتفكير الحقيقي إلى sol.
we aren't
stennir ليست موزّعًا يستبدل معرّف نموذجك بأرخص فئة ويأمل أن تصمد الجودة.
هل عليك إعادة بناء الميزة للحصول على هذا؟
لا. بناءاتنا في الذكاء الاصطناعي لفرق المنتج تقسّم حركة المرور بحسب المهمة أصلًا. التوجيه والتصنيف والإشراف يذهبون إلى الفئة الرخيصة. التفكير يذهب إلى الفئة الرائدة. لذا فإن فئة جديدة مثل luna هي مجرد تغيير إعدادات في المسار الرخيص، لا إعادة بناء للميزة التي يعتمد عليها مستخدموك.
إن كانت ميزتك ترسل كل شيء إلى نموذج واحد اليوم، فهذه هي الفجوة التي يجب سدّها أولًا. التقسيم عمل يوم أو يومين. والتوفير يتراكم كل شهر ينمو فيه استخدامك.
لم يسأل مديرنا المالي عن النموذج الذي استخدمناه. سأل عن تكلفة مستخدم نشط واحد علينا. تقسيم الفئات كان الإجابة التي جعلت الميزة تصمد أمام المراجعة.
هذا العمل جزء من ممارسة الاستشارات لدينا، وتحتوي المدوّنة على البراهين من ميزات أوصلناها بالفعل إلى الإنتاج. إن كنت تريد أرقامك الخاصة قبل مراجعة المالية القادمة، احجز مكالمة استكشاف 30 دقيقة وسنمرّ معك على تقسيم حركة مرور ميزتك.