GPT-5.6 هي أول اختبار!قناصة دقيقة Mythos
للتو، أطلقت شركة Anthropic القاتل الكبير الذي كان مخفيًا لمدة شهرين…Claude Fable 5وMythos 5كما لو أنك ألقيت قنبلة.
الآن نضغط مباشرة على OpenAI.

في نفس الوقت، تم أيضًا تسريب GPT-5.6.
OpenAI بدأت في اختبار الكود الداخلي منذ الأسبوع الماضيkeplerوkindleنقطتي تحقق جديدتين. تم اختيار إصدار Kindle-alpha ليكون مرشحًا للإطلاق.

بدأت النسخة التجريبية الداخلية من GPT-5.6 في الانتشار بشكل واسع بين المطورين في الخارج ودوائر تسريب المعلومات، حيث تم قياس أدائها بشكل مكثف. تم الكشف عن الكود، والنسخ المقترحة، وتفاصيل تجربة الاستخدام بشكل كامل.

سواء كان الأمر يتعلق بالتنافس على الإدراج في البورصة (IPO) أو بتصادم النماذج الرائدة، كلا الشركتين تقولان: "أنا أيضًا سأقدم طلبي، وأنت تقدم نموذجًا جديدًا، سأقدم نموذجًا جديدًا أيضًا."
النقاء يعني أن القتال يصل إلى حد لا يمكن التوقف عنه.
لكن المشكلة هي، هل يمكن حقًا لـ GPT-5.6 أن يتغلب على Mythos؟؟

GPT-5.6 ظهر على السطح
حتى الآن، لم تصدر أي إعلانات رسمية من OpenAI حول مواجهتها لـ GPT-5.6، ولم يتم الإعلان عن ذلك بشكل رسمي.
ومع ذلك، لم يكشف العديد من مستخدمي الإنترنت في الخارج بعد عن أن اختبارات جسور التحقق الداخلية قد اكتملت.
ما يُعرف بنقطة التحقق (checkpoint) هو نسخة مؤقتة من المعلمات التي يقوم النموذج بتخزينها في نقطة زمنية معينة أثناء عملية التدريب.
داخل OpenAI، سيتم إعداد العديد من النسخ، وسيتم مقارنتها بشكل أفقي، ثم سيتم اختيار إحدى النسخ التي تعتبر “جيدة بما فيه الكفاية للنشر” وتسمى نسخة مرشحة للنشر (Release Candidate – RC).
منذ الأسبوع الماضي، بدأت شركة OpenAI في اختبار نقطتي تحقق جديدتين داخليًا، تحملان الاسمين السريين “kindle” و“kepler”.kindle-alphaتم اختيار النسخة المقترحة ونشرها.

من خلال ما يتم تدفقه من معلومات حسية،GPT-5.6الترقية التي تم ذكرها مرارًا وتكرارًا هذه المرة هيتطوير واجهة المستخدم الأمامية。
قال المستخدم بانكاج كومار إن جهاز Kindle قد رفع بشكل كبير من قدرات إنتاج الواجهة الأمامية (frontend generation) لنظام Alpha.يمكن إنتاج واجهات أكثر قوة مباشرة، دون الحاجة إلى كلمات توجيهية معقدة أو مهارات إضافية.。

بالإضافة إلى ذلك، فإن قدراته البصرية ممتازة أيضًا، حيث يؤدي بشكل جيد في مهام فهم الصور واستخدامها، كما شهد تحسنًا ملحوظًا في مجالات المنطق والترميز وتوليد واجهات المستخدم (UI).
هذا هو تقييم من المستخدم كريس لأداء جهاز كيندل، حيث تم استخدام السرعة المتوسطة:

هذه هي النتائج التي قام بها مستخدم آخر في الاختبار على نسخة Joule غير المخصصة للتفكير الاستدلالي:

الأول أكثر رقيًا بكثير.
لكن المستخدم ليو استخدم نفس المؤشر (prompt) وجهاز كيبلر (Kepler) وجهاز كيندل (Kindle) لإجراء القياسات على مستوى السرعة العالي (xhigh).
مقارنةً بكيبلر، تبين أن كيندل لا يزال يتراجع في أدائه.

أمم... من الصعب حقًا تقييم هذا التأثير.
حتى أنه يعتقد أن من المحتمل جدًا أن تواصل شركة OpenAI تحسين منتجاتها وتطويرها،لا يمكن استبعاد إمكانية التخلي في النهاية عن استخدام الكيندل كإحدى الخيارات المحتملة.。
أحدث الأخبار هو أن جهاز Kindle قد تم إزالته من سلسلة Arena، وقد ظهر نموذج جديد.Levi。
تكهن بعض المستخدمين بأن “Levi” قد يكون أيضًا اسمًا مستعارًا لإحدى الإصدارات الداخلية لـ “GPT-5.6”, وقاموا بمقارنتها بالقدرات الأمامية لـ “GPT-5.5”:

من هنا يمكننا أن نرى أن واجهة المستخدم الأمامية لـ Levi جيدة جدًا أيضًا، بأسلوب عصري وبسيط، وتتميز بالرقي، كما أن معالجة التفاصيل ممتازة.
لكن بعض المستخدمين اكتشفوا أن ليفي قد يأتي من Meta، وليس من GPT-5.6.

إذًا، هل يمكن لـ GPT-5.6 أن يتغلب على Mythos؟
يدعي المستخدم mark_k أن GPT-5.6 "عدة وكالات تفوقت في معايير الكودинг الخاصة بـ Mythoss".

لكن الأكثر إقناعًا حاليًا هو الاختبار العملي الذي قام به المستخدم Leo الذي تم عرضه سابقًا. يعتقد أن حالة GPT-5.6 ليست مبشرة:
مقارنةً بكيبلر، الكيندل يمثل تراجعًا. بالشكل الذي هو عليه الآن،يمكن أن يتم هزيمته بسهولة من قبل Mythos。
في يونيو، قدمت العائلات الثلاث الكبرى عرضًا تحت عنوان "السرعة والعاطفة"
في يونيو، جاء الصيف، وبدأ مجال النماذج الكبيرة (big models) يشهد نشاطًا متزايدًا أيضًا.
تم إصدار ثلاثة من أبرز نماذج الذكاء الاصطناعي الخارجية في نفس الوقت: Fable 5، Gemini 3.5 Pro، و GPT-5.6، مما أدى إلى ما يشبه سباقًا "بين الحياة والموت".
وعلاوة على ذلك، فإن الألعاب تستخدم نفس مجموعة المهارات: التفكير الاستدلالي، الوكلاء الذكية، الترميز، وتوليد الواجهات الأمامية.
من المثير للاهتمام أنه على الرغم من أن الشركات الثلاث قد ركزت جميعها على هذا الجانب في شهر يونيو، إلا أن...حتى الآن، الشركة الوحيدة التي قدمت الواجبات بالفعل هي الشركة A.。
ظهر جهاز Gemini 3.5 Pro في مؤتمر Google I/O الذي عقد في 19 مايو، ويركز على معالجة سياقات تتكون من 2 مليون رمز (token) وعلى عمليات التفكير العميق (Deep Think).
لكن لم يتم إطلاقه رسميًا بعد، ومن المقرر أن يكون متاحًا للجمهور في يونيو.
GPT-5.6، تم الإعلان عن الرسالة أنها ستصدر في وقت لاحق من هذا الشهر.
هذا أيضًا يزيد من التوتر في وضع OpenAI: فقد نشر الخصم النتائج بالفعل، وقد لا يزالون يتناقشون داخليًا حول أي نسخة من RC يجب تقديمها.
لكن بخلاف عمليات قياس الأداء،التسعيروهو أيضًا عامل مهم.
سعر Fable 5.Mythos 5 هو Token10 بالدولار الأمريكي و Token50 بالدولار الأمريكي.
تقريبًا ضعف حجم تنسيق Opus الحالي.
إذاGPT-5.6من حيث القدرات، فهو مماثل لـ Mythos أو ربما يكون أقل قليلاً، لكن السعر أرخص بكثير، لذا لا يزال من الممكن أن يحقق استخدامًا عمليًا في مدينة واحدة على الأقل~
حتى الآن، لم تصدر شركة OpenAI أي إعلان رسمي، وسيتعين الانتظار حتى يتم إطلاق النسخة الرسمية من GPT-5.6 وعندما تقوم Fable بإجراء تقييمات مباشرة لها لمعرفة نتائج المنافسة الحقيقية.
من المحتمل جدًا أن تتضح الأمور هذا الشهر، ترقبوا بفارغ الصبر~
روابط مرجعية:
[1]https://x.com/mark_k/status/2063922897341567488?s=20
[2]https://x.com/AiBattle_/status/2064078302394917157?s=20
[3]https://x.com/pankajkumar_dev/status/2063272015214354908?s=20
[4]https://x.com/synthwavedd/status/2063245096951160865?s=20
[5]https://x.com/ChrissGPT/status/2063135842906808579?s=20
[6]https://x.com/koltregaskes/status/2062806155139912164?s=20
المؤلف من مجموعة “كيوانت بيت”، “تينغ يو”.
هل كان هذا مفيدًا؟