← كل الأخبار
الذكاء الاصطناعي٣ أغسطس ٢٠٢٦

تجارب تقنية تقارن أداء نماذج الذكاء الاصطناعي في المهام المعقدة

شارك
تجارب تقنية تقارن أداء نماذج الذكاء الاصطناعي في المهام المعقدة

عرض حساب @SultanAlFardan تجربةً طُلب فيها من ثلاثة نماذج رسم الموناليزا داخل المتصفح، على أن يظهر العمل طبقةً بعد طبقة. وشملت المقارنة Claude Fable 5 وClaude Opus 5 وChatGPT 5.6 Sol، ويقول المنشور إن النماذج حاكت أسلوب الرسم إلى جانب تقليد الصورة. ويقترح حساب @bindureddy اختيار النموذج بحسب صعوبة المهمة، من DeepSeek Flash للمهام السهلة جدًا إلى Fable 5 للمهام شديدة الصعوبة، مع تحذير من كلفة استخدام نموذج أقوى لمهمة بسيطة.

الحقائق الأساسية

  • المهمة طُلِبت في ملف HTML واحد يعرض اللوحة على مراحل متتابعة.

    «أنشئ ملف HTML واحدًا يعرض رسم الموناليزا طبقة بعد طبقة،»
    عرض المصدر ←
  • المقارنة ضمّت Claude Fable 5 وClaude Opus 5 وChatGPT 5.6 Sol.

    «Claude Fable 5 Claude Opus 5 ChatGPT 5.6 Sol»
    عرض المصدر ←
  • يربط تصنيف آخر بين صعوبة المهمة والنموذج المقترح، ويحذّر من ارتفاع كلفة استخدام Fable 5 في مهمة سهلة.

    «If you use flash on a hard task, it will fail and a Fable 5 on an easy task will be 100x more expensive!»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر