عودة الملك: GPT-5.6 يتفوق على Fable 5 وGrok 4.5
يتميز Fable 5 بالذكاء، وGrok 4.5 بالكفاءة، لكن GPT-5.6 هو نموذج الذكاء الاصطناعي المفضل لديّ الآن، خاصةً في برمجة Vibe.
عودة الملك: GPT-5.6 يتفوق على Fable 5 وGrok 4.5
بعد فترة وجيزة من رفع الحظر عن Fable 5، ظهر Grok 4.5 وGPT-5.6 أخيرًا. تأتي هذه النماذج مع قائمة طويلة من التحسينات، لكنها جميعًا تركز على تحسين تجربة برمجة الذكاء الاصطناعي. بصفتي هاويًا لبرمجة Vibe، جربت النماذج الثلاثة، مواصلًا تطوير تطبيق يحلل إعادة تشغيل مباريات Magic: The Gathering Arena وحاسبة بناء Warframe الخاصة بي. أهم ما استنتجته هو أن Fable 5 مخيب للآمال بسبب قيود الاستخدام المرهقة وبعض العيوب الأخرى، بينما يبهر Grok 4.5 بكفاءته وسرعته. مع ذلك، يخطف GPT-5.6 الأضواء بفضل ذكائه الفائق. تابع القراءة للاطلاع على انطباعاتي الكاملة.
ظهور GPT-5.6 وGrok 4.5 بالتزامن مع عودة لعبة Fable
لم تعد Fable 5 جديدة، لكنها عادت مؤخرًا بعد حظرها. لحسن الحظ، مددت Anthropic فترة استخدام Fable 5 باشتراك Claude المميز، بدلًا من شراء أرصدة الذكاء الاصطناعي المخصصة، حتى 19 يوليو.
في الوقت نفسه، يُعد كل من Grok 4.5 وGPT-5.6 نموذجين جديدين تمامًا. يوفر Grok حاليًا وصولًا مجانيًا لفترة محدودة إلى Grok 4.5 في Cursor وGrok Build، كما يمكنك استخدام Grok 4.5 في واجهة روبوت الدردشة الخاصة بـ Grok عبر خطته المجانية. علاوة على ذلك، يقدم Grok فترة تجريبية مجانية لخطة SuperGrok المميزة التي تدعم استخدامًا أوسع لـ Grok 4.5.
مع GPT-5.6، ستحصل على وصول محدود إلى باقة GPT-5.6 Terra on the Go (بسعر 8 دولارات شهريًا). إذا كنت ترغب في تجربة النسخة الرائدة والأكثر ذكاءً من GPT-5.6، وهي Sol، أو نسخة Luna الأكثر كفاءة، فستحتاج إلى الاشتراك في باقة Plus (بسعر 20 دولارًا شهريًا) أو باقة Pro (بسعر يبدأ من 100 دولار شهريًا). وإلا، فستستخدم في الغالب GPT-5.5، وليس GPT-5.6 الجديد.
يمكنك الاطلاع على المزيد من التفاصيل حول كل نموذج من خلال إعلاناته الرسمية، ولكن بشكل عام، تعد كل من Fable 5 وGrok 4.5 وGPT-5.6 بأن تكون أكثر ذكاءً وقدرة من سابقاتها، خاصةً في مهام البرمجة. تُعد الكفاءة أيضًا من أهم مميزات Grok 4.5 وGPT-5.6؛ حيث تهدف إلى تمكينك من إنجاز المزيد باستخدام عدد أقل من الرموز ودون تجاوز حدود الاستخدام بشكل متكرر.
قبل الخوض في تفاصيل الاختبار، ضع في اعتبارك أمرين. الأهم من ذلك، أنني لست مبرمجًا، فقد اختبرت هذه التطبيقات من منظور شخص عادي ملمّ بالجوانب التقنية، ويرغب فقط في ابتكار أشياء رائعة. إضافةً إلى ذلك، لم أقضِ سوى بضعة أيام مع Grok 4.5 وGPT-5.6، لذا فإن تجربتي محدودة نوعًا ما؛ كما أن القيود الصارمة المفروضة على استخدام Fable 5 قد تسببت في بعض الصعوبات.
سهولة الاستخدام والاستفسارات البسيطة: رقابة Fable وبنية Grok مخيبة للآمال
بغض النظر عن البرمجة، يُقدّم GPT-5.6 أفضل تجربة دردشة آلية. مع مجموعة كبيرة من الأوضاع والخيارات المختلفة التي تزيد من الذكاء على حساب السرعة، مهما كان سؤالك، يستطيع GPT-5.6 الإجابة عليه. سواءً طلبتُ تحليلًا معمقًا لموضوع معقد أو مجرد إجابات سريعة ودقيقة، فإن جودة استجابة GPT-5.6، تمامًا مثل GPT-5.5، عالية باستمرار. يتميز Fable 5 أيضًا بذكاء مثير للإعجاب، ولكنه يعاني من رقابة مُحبطة.
قد تتسبب أسئلة بسيطة تمامًا، مثل “ماذا حدث مع لعبة Fable 5 والحكومة الأمريكية؟” أو “ما الجديد في الكيمياء؟”، في تعطيل آليات الحماية، مما يؤدي إلى خفض مستوى أدائي إلى Opus 4.8. والأمر الأكثر إحباطًا هو تطبيق Fable 5 غير المتسق للرقابة. على سبيل المثال، أحيانًا يكون سؤال “ما الجديد في الكيمياء؟” مقبولًا للإجابة عليه، وأحيانًا أخرى لا. حتى لو كان سؤال الكيمياء مقبولًا، فإن سؤال “ما هي آخر التطورات في مجال التقنية الحيوية؟” يظل إشكاليًا. لا يعاني GPT-5.6 من هذه المشكلة. في الواقع، لم يخفض مستوى أدائي إلى نموذج مختلف أو يخبرني بأن استفساري ينتهك أي سياسة.
يتميز Grok 4.5 لأسباب مختلفة. مثل الإصدارات الأخرى من Grok، يمكنه البحث تلقائيًا في X لتقديم الإجابات، كما أنه لا يواجه أي مشكلة في تحليل المواقع الإلكترونية ذات المحتوى الصريح. هذه ميزة فريدة بين نماذج الذكاء الاصطناعي، ويستمر Grok 4.5 في التفوق في هذا المجال أكثر من Fable 5 أو GPT-5.6. مع ذلك، لا تتوقع عمومًا تحسينات كبيرة في جودة الاستجابة من أي من هذه النماذج مقارنةً بالأجيال السابقة.
تطبيق Grok Build
يعمل تطبيق Grok Build، لكنني أتمنى لو كان يوفر تطبيقًا لسطح المكتب كبديل لتجربة سطر الأوامر.
أما فيما يخص البرمجة، فإن تطبيقي Claude Code من Anthropic وChatGPT (المعروف سابقًا باسم Codex) من OpenAI سهلان الاستخدام، ويحتويان على العديد من الميزات، ويعملان بكفاءة عالية. يتكامل كلا التطبيقين مع متصفحات ممتازة.
تتيح لي هذه الميزة معاينة تطبيقات الويب أثناء العمل عليها. في المقابل، يقتصر خيار Grok Build، وهو الخيار الداخلي لـ Grok، على واجهة طرفية فقط، ما يجعله أقل سهولة في الاستخدام. مع ذلك، ونظرًا لاستحواذ SpaceX مؤخرًا على Cursor، فقد يصبح هذا الخيار قريبًا منصة البرمجة الافتراضية لـ Grok.
الذكاء والسرعة: Grok 4.5 وGPT-5.6 يتصدران القائمة
على الرغم من إمكانية استخدام أي من هذه النماذج للإجابة عن الأسئلة أو إجراء البحوث، إلا أنها مصممة لمهام أكثر تعقيدًا، مثل البرمجة. من حيث معايير الأداء، يحتل كل من Fable 5 وGrok 4.5 وGPT-5.6 مراكز متقدمة: عادةً ما يكون GPT-5.6 في الصدارة، يليه Fable 5 مباشرةً، بينما يحافظ Grok 4.5 على مستوى GPT-5.5 المذهل. تتوافق تجربتي عمومًا مع هذه المعايير، لكن Grok 4.5 وGPT-5.6 فاجأاني.
يُعدّ Grok 4.5 سريعًا بشكلٍ ملحوظ بالنظر إلى كفاءته. سرعة نموذج Gemini 3.5 Flash أكثر إثارة للإعجاب، لكن أداءه الرديء كان مخيبًا للآمال، إذ تركني باستمرار مع تطبيقات معطّلة ومهام غير مكتملة. Grok 4.5 هو ما كنت أتمناه من 3.5 Flash – نموذج ذكاء اصطناعي سريع الاستجابة قادر على تسخير قوة الوكلاء لإنجاز معظم المهام بسلاسة في غضون دقائق معدودة.
على سبيل المثال، أردت طريقة سهلة لعمل نسخة احتياطية من جميع البيانات التي يجمعها تطبيق Magic: The Gathering الخاص بي، وضغطها في ملف مضغوط، وتوفير خيار استيراد النسخ الاحتياطية. شرحت ذلك لـ Grok، فأضاف الميزة في غضون دقيقة تقريبًا. لم أكن مضطرًا حتى إلى عناء إعداد ملف ذاكرة لكي يتبع Grok قواعد أو ممارسات معينة. وعندما طلبت من Grok تشغيل تطبيقي دائمًا بعد تحديثه، نجح في بناء سير العمل هذا بسرعة أكبر بكثير من Fable 5 أو GPT-5.6.
مع ذلك، لا يزال GPT-5.6 Sol يتفوق عليه. يتميز هذا النظام بعمقه وذكائه الاستثنائيين، لا سيما في إنشاء وكلاء لتوزيع مهام العمل المعقدة. على سبيل المثال، يقوم أحد تطبيقاتي بتحليل بيانات سجلات لعبة Magic: The Gathering Arena، ثم يحولها إلى ملخصات تفصيلية لكل جولة. يتضمن جزء كبير من التطوير ضبط هذه الملخصات لتكون شاملة بما يكفي لتغطية جميع جوانب اللعبة المهمة دون تضمين آلاف الأسطر من البيانات غير الضرورية.
خلال هذه العملية، أردت مقارنة نسخة مُعدّلة من الملخص بنسخة أقدم. طلبت هذه الخاصية باستخدام عبارة قصيرة من جملة واحدة. مع ذلك، وبناءً على طلبي، أنشأ GPT-5.6 وكلاء لتحليل ملخص لعبة معينة. ثم أنشأ وكيل تقييم جديدًا لتقييم كل ملخص ومنحه درجة موضوعية وفقًا لمعايير محددة. لم يسمح لي هذا فقط بفهم نقاط القوة والضعف في الملخصات، وكيفية تحسينها، بل قام أيضًا بقياسها كميًا.
يُعدّ GPT-5.6 أفضل بكثير من GPT-5.5 في تصميم واجهات المستخدم. فبدون هندسة دقيقة عند استخدام GPT-5.5، قد ينتهي بك الأمر بواجهة مستخدم بدائية للغاية. في المقابل، يتميّز Fable 5 وجميع الإصدارات الحديثة من Opus بقدرتها على إنشاء واجهات مستخدم احترافية بتوجيهات بسيطة. ويتمتع GPT-5.6 بهذه القدرة نفسها. على سبيل المثال، فيما يلي واجهة المستخدم التي صممتها باستخدام Fable 5/Opus 4.8 لتطبيقي (الشريحة الأولى) إلى جانب واجهة المستخدم التي صممتها باستخدام GPT-5.6 (الشريحة الثانية).
يتمتع Fable 5 بذكاء عالٍ أيضًا. فعلى سبيل المثال، عندما كنت أعمل على تطبيق حاسبة بناء Warframe الخاص بي باستخدامه، تمكّن من اكتشاف مشكلة في استخراج البيانات متعلقة بإحصائيات الأسلحة، وهي مشكلة لم يكتشفها كل من GPT-5.5 وOpus 4.8. علاوة على ذلك، عندما أعطيت Fable 5 نفس التعليمات التي أعطيتها لـ GPT-5.6 أعلاه لمقارنة ملخصات إعادة التشغيل، خضع لعملية تقييم مماثلة تعتمد على الذكاء الاصطناعي. في المتوسط، أنجزت Fable 5 المهام بشكل أبطأ من GPT-5.6، لكن المشكلة الأكبر في Fable 5 تكمن في شيء واحد: الاستخدام.
Fable 5 تعود بشكل أسوأ: 4 طرق غيّر بها الحظر كل شيء
شركة Anthropic تتراجع عن رفع أسعار Fable 5 مؤقتًا: لو كان الأمر يستحق وقتك!
لقد صنعت تطبيقًا أفضل من موقع ويب شهير بمجرد توجيه Claude!
لم يكن Overframe كافيًا، لذا قمتُ ببرمجة تطبيق Warframe أفضل باستخدام Claude عبر Vibe Code
هل ترغب في إنشاء تطبيق باستخدام الذكاء الاصطناعي؟ أنت بحاجة إلى هذه النصائح السبع!
هل تستخدم الذكاء الاصطناعي لبناء تطبيق؟ جرّب نصائحي السبع الاحترافية للتوجيه!
قيود الاستخدام: لا تزال حدود Fable 5 الصارمة عائقًا كبيرًا!
تُعتبر الكفاءة وسهولة الاستخدام من أهم عناصر نموذج الذكاء الاصطناعي. لسوء الحظ، فإن قيود الاستخدام هي ما يجعل Fable 5 غير جديرة بالتوصية. أولًا، يُخصص نصف الاستخدام الأسبوعي المخصص لك في خطة Claude المميزة لخدمة Fable 5. ثانيًا، هذا متاح حتى 19 يوليو فقط، وبعدها سيتعين عليك شراء أرصدة ذكاء اصطناعي منفصلة لاستخدام Fable 5. والأهم من ذلك، أن الاستخدام المتاح خلال هذه الفترة المحدودة غير كافٍ.
أسعار واجهة برمجة التطبيقات البشرية
عندما يبدأ استخدام Fable 5 باعتماد أرصدة الذكاء الاصطناعي، لن يكون رخيصًا.
لأغراض الاختبار، استخدمتُ خطتي Claude وOpenAI بقيمة 100 دولار شهريًا (ChatGPT Pro 5x وClaude Max 5x) مع Fable 5 وGPT-5.6 على ثاني أعلى إعدادات الذكاء.
على سبيل المثال، استغرق برنامج Fable 5 ضعف الاستخدام الأسبوعي تقريبًا لإنجاز نفس المهام. كما أنني كنت أصل إلى حد استخدام كلود البالغ خمس ساعات باستمرار مع Fable 5، وغالبًا ما يحدث ذلك بعد بضع محاولات فقط. لم يحدث ذلك مع GPT-5.6 بنفس التكرار أو السرعة. صحيح أن GPT-5.6، خاصةً مع أعلى إعدادات الذكاء أو عند استخدام الوكلاء، يستهلك موارد النظام بشكل أسرع بكثير من GPT-5.5، إلا أنك ما زلت تحصل على وصول أكبر بكثير إليه مقارنةً بـ Fable 5.
والأكثر من ذلك، أن OpenAI أكثر سخاءً في استخدام موارد النظام من Anthropic بشكل عام. لا يقتصر الأمر على قيام OpenAI بإعادة ضبط الاستخدام بشكل متكرر، بل يمكنك أيضًا تجميع عمليات إعادة الضبط لاستخدامها حسب تقديرك، وهو ما لا يسمح به Anthropic. كما أن GPT-5.6 يواصل العمل ويستهلك من حد الاستخدام الأسبوعي إذا وصل إلى حد الخمس ساعات أثناء إحدى المهام. ومع ذلك، حتى هذا لا يمثل مشكلة في الوقت الحالي لأن OpenAI قد ألغت، مؤقتًا على الأقل، حدود الاستخدام البالغة خمس ساعات تمامًا.
يستحق Grok الإشادة بسياسة الاستخدام السخية التي يوفرها. حتى مع باقة SuperGrok الشهرية التي تبلغ تكلفتها 30 دولارًا، تمكنتُ من استخدام Grok 4.5 في Grok Build لعدة ساعات دون تجاوز حد الاستخدام أو حتى استهلاك نصف حصتي الأسبوعية المخصصة. كما أن Grok لا يفرض حدودًا على الاستخدام بالساعة، مما يقلل من المشاكل بشكل كبير.
لكن تذكر أن حدود الاستخدام تتغير باستمرار. فمع السياسات الجديدة والعروض الترويجية وإعادة ضبط الاستخدام بشكل عشوائي، بالإضافة إلى سرعة إطلاق النماذج الجديدة، قد لا يكون ما يناسبك اليوم مناسبًا غدًا، بغض النظر عن النموذج الذي تستخدمه. وإذا كنت تُبدّل باستمرار بين مستويات الذكاء المختلفة في النماذج، فإن معادلات القيمة هذه تصبح أكثر تعقيدًا.
أي من نماذج الذكاء الاصطناعي الجديدة هذه يجب عليك استخدامها؟
وبناءً على كل ما سبق، لا أنصح باستخدام Fable 5 لمعظم المستخدمين، وخاصةً مُبرمجي Vibe. مع ذلك، إذا كنت مشتركًا بالفعل في باقة Claude المميزة، ولا تستخدم Opus أو Sonnet بشكل منتظم، فلا مانع من تجربة Fable 5 حتى 19 يوليو، موعد التحول إلى نظام رصيد الذكاء الاصطناعي. إذا كان لديك المال الكافي، ولم يتعارض مشروعك مع رقابة Fable، فلن يكون أقل كفاءة بشكل ملحوظ من GPT-5.6، لذا يمكنك استخدامه بفعالية كبيرة إذا كنت تفضل بيئة Claude.
يُعد GPT-5.6 الخيار الأمثل حاليًا، ولكن قد يكون الاشتراك في SuperGrok مقابل 30 دولارًا شهريًا كافيًا للوصول إلى Grok 4.5. وبدلًا من دفع 100 دولار شهريًا لخطة باهظة الثمن من أي شركة، يمكنك إضافة اشتراك ChatGPT Plus إلى اشتراك SuperGrok، والذي يكلف 20 دولارًا فقط شهريًا، ليصبح المجموع 50 دولارًا شهريًا. يتيح لك هذا الاستفادة من ذكاء GPT-5.6 Sol الفائق للتخطيط الاستراتيجي والمهام المعقدة، مع الاعتماد على Grok 4.5 لمعظم المهام.
أحيانًا، كما هو الحال مع GPT-5.6، يكون الضجيج حوله حقيقيًا.
لقد كتبتُ سابقًا عن أهمية عدم التعامل مع نموذج ذكاء اصطناعي جديد كما لو كان موسمًا جديدًا من مسلسل مفضل ستشاهده تلقائيًا. مع ذلك، يُعدّ كل من GPT-5.6 وGrok 4.5، بدرجة أقل، نموذجين جديدين يستحقان اهتمامك. إنّ قيود الرقابة والاستخدام المفروضة على Fable 5 لا تجعله خيارًا جذابًا في الوقت الحالي. بالطبع، يتطور مجال الذكاء الاصطناعي باستمرار، لذا أعتزم مواصلة اختبار تطبيقاتي على Fable، بالإضافة إلى مجموعة نماذج Claude الأوسع، مع تطورها.
لا داعي لإعادة تثبيت ويندوز إذا كان جهاز الكمبيوتر بطيئاً. جرّب هذه الحيل البسيطة، وستلاحظ…
ثبّتت شاشات إل جي تطبيقًا بشكلٍ غير مُعلن، يعرض إعلانًا منبثقًا لبرنامج مكافي، ما يُعد…
تقنية الشاشة الجديدة المصنوعة من التيتانيوم تجعل شاشة Z Fold 8 أنحف، وتكاد تخلو من…
هاتفك هو الكاميرا التي تحملها دائمًا في جيبك، ولكن ليست كل كاميرات الهواتف متساوية. بعضها…
تُعدّ منصة أندرويد من جوجل نظام التشغيل العالمي المهيمن للهواتف المحمولة، وذلك لأسباب وجيهة. إليكم…
شهدت تطبيقات توليد الصور بالذكاء الاصطناعي رواجًا كبيرًا خلال السنوات القليلة الماضية. إذا كنت تستخدم…