← كل الأخبار

إطلاق نموذج Claude Sonnet 5 من أنثروبيك

شارك
إطلاق نموذج Claude Sonnet 5 من أنثروبيك

أطلقت أنثروبيك نموذج Claude Sonnet 5 الجديد الذي يركّز على تنفيذ المهام الذكية المستقلة (Agentic AI) بأداء يقارب نموذجها الأقوى Opus 4.8 لكن بتكلفة أقل بكثير، وذلك في خضم منافسة محتدمة مع OpenAI وجوجل اللتين أطلقتا مؤخرًا نماذج مشابهة بقدرات وكيلية. أصبح Sonnet 5 النموذج الافتراضي لمستخدمي الخطة المجانية وخطة Pro، ويتميز بقدرته على إنجاز مهام طويلة ومعقدة من البداية للنهاية دون تدخل بشري كبير، مع تحسينات أمنية تقلل من الهلوسة والسلوكيات غير المرغوبة. هذا الإطلاق يؤكد أن قدرات الوكلاء الأذكياء تحولت من ميزة تنافسية إلى معيار أساسي في السوق، وأن المنافسة الحقيقية الآن تدور حول خفض التكلفة وتحسين الاعتمادية عند العمل دون مراقبة بشرية مباشرة.

الحقائق الأساسية

  • النموذج الجديد يخطط وينفذ المهام باستقلالية عبر أدوات مثل متصفحات الويب والطرفيات، بقدرات كانت تتطلب سابقًا نماذج أكبر وأكثر تكلفة.

    «وأوضحت الشركة أن النموذج الجديد يستطيع التخطيط وتنفيذ المهام بنحو مستقل، مع استخدام أدوات مثل متصفحات الويب والطرفيات (Terminal)، بما يتيح له إتمام أعمال كانت تتطلب قبل أشهر نماذج أكبر وأكثر تكلفة.»
    عرض المصدر ←
  • تبلغ تكلفة الاستخدام حتى نهاية أغسطس دولارين لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج، على أن ترتفع تكلفة الإدخال إلى 3 دولارات بعد ذلك مع بقاء تكلفة الإخراج ثابتة.

    «وتبلغ تكلفة استخدام النموذج حتى نهاية أغسطس دولارين لكل مليون رمز إدخال (Input Tokens) و 10 دولارات لكل مليون رمز إخراج (Output Tokens)، قبل أن ترتفع تكلفة الإدخال إلى 3 دولارات مع بقاء تكلفة الإخراج دون تغيير.»
    عرض المصدر ←
  • بهذه الأسعار يصبح Sonnet 5 أرخص من Opus 4.8 وGPT-5.5 وGemini 3.1 Pro، لكنه يظل أعلى تكلفة من Gemini 3.5 Flash.

    «وبهذه الأسعار، يعد Claude Sonnet 5 أقل تكلفةً من Opus 4.8، وكذلك من GPT-5.5 و Gemini 3.1 Pro، في حين يظل أعلى سعرًا من Gemini 3.5 Flash.»
    عرض المصدر ←
  • حقق النموذج نسبة 63.2% في اختبار برمجة ذاتية مقارنة بـ58.1% للإصدار السابق Sonnet 4.6، مع تفوق طفيف على Opus 4.8 في اختبار للمهام المعرفية.

    «وحقق Claude Sonnet 5 نسبة قدرها 63.2% في أحد اختبارات البرمجة الذاتية، مقارنةً بـ 58.1% للإصدار السابق، في حين سجل Opus 4.8 نسبة قدرها 69.2%، كما تفوق النموذج الجديد بصورة طفيفة على Opus 4.8 في أحد اختبارات المهام المعرفية.»
    عرض المصدر ←
  • النموذج يتميز بمستوى أمان أعلى مع انخفاض في الهلوسة والسلوكيات غير المرغوبة، لكنه أقل قدرة من نماذج Opus في تنفيذ المهام السيبرانية الخطرة، وهو ما يعزز سلامته العملية.

    «ومع ذلك، أوضحت الشركة أن نماذج Opus 4.8 و Claude Mythos Preview ما زالت تتفوق في التعامل مع بعض سيناريوهات السلامة المعقدة، في حين يمتلك Claude Sonnet 5 قدرة أقل على تنفيذ المهام السيبرانية الخطرة، وهو ما يعد عاملًا إضافيًا لتعزيز سلامته عند استخدامه في التطبيقات العملية.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر