
دراسة: تصحيح أخطاء الوكلاء يبدأ بتحديد نقطة الفشل الأولى
تدعو ورقة من Scale AI إلى بدء تصحيح أخطاء وكلاء الذكاء الاصطناعي بتحديد أول فشل لم يُسترد، بدل افتراض أن النموذج هو المسؤول.
كل خبر اجتاز بوابة التحقق من المصادر — مصنّف وقابل للتصفية
ملخصات مولّدة بالذكاء الاصطناعي بإشراف بشري — كل خبر بمصادره

تدعو ورقة من Scale AI إلى بدء تصحيح أخطاء وكلاء الذكاء الاصطناعي بتحديد أول فشل لم يُسترد، بدل افتراض أن النموذج هو المسؤول.

تقارن ورقة بين استدعاء الأدوات بصيغة JSON ونهجٍ يكتب فيه النموذج شيفرةً لتنفيذها، في اختبارٍ قد يجعل الطريقة التقليدية عنق زجاجة للوكلاء الأحدث.

تبحث ورقة من مايكروسوفت في تقليل كلفة الاستدلال أثناء تشغيل النموذج، عبر استبدال جزء من التفكير المكلف بقواعد قليلة.

يرى أرفيند سرينيفاس أن النموذج لم يعد المنتج الوحيد، بل صار جزءًا من نظام ينسّق بين النموذج ووكيل ذكي.

انتقل فريق التطوير إلى بناء OpenClaw باستخدام OpenClaw نفسه، بحسب منشور @steipete على إكس.

تقول ورقة بحثية إن منح النموذج اللغوي محاولة مستقلة جديدة قد يكون أفضل من دفعه إلى نقد إجابته بنفسه.

أتاحت جوجل للمستخدمين اختيار إزالة العلامة المائية المرئية من الصور التي ينشئها مولد Nano Banana، عبر إعداد جديد في Gemini وFlow.

كشفت World Labs، الشركة الناشئة التي أسستها الباحثة في الذكاء الاصطناعي فاي-فاي لي، عن محرك محاكاة يدرّب أنظمة تحكم الروبوتات في بيئات افتراضية بدل الاختبارات المكلفة على العتاد الحقيقي.

يحذّر نولان لوفِت، من جامعة الناتو للعمليات الخاصة، في ورقة بحثية من أن استبدال الوظائف المبتدئة بالذكاء الاصطناعي قد يستنزف الخبرة المهنية التي تعتمد عليها المؤسسات جميعًا.

قدّمت Moonshot AI اختبارًا جديدًا باسم PerceptionBench لقياس الإدراك البصري في نماذج الذكاء الاصطناعي متعددة الوسائط، بعيدًا عن الاستدلال والمعرفة الخارجية.

أضافت Ollama دعم DeepSeek Harness إلى بيئتها المحلية، مع أمر تشغيل مباشر هو «ollama launch dsh».

أضافت منصة Hermes أمرًا جديدًا باسم /loop لإعادة تشغيل المطالبة تلقائيًا داخل الجلسة نفسها.

بعد شهر من إطلاق Fable 5، لم تتجاوز حصته ٦٪ من الرموز التي اشترتها الشركات من Anthropic، بحسب منشور @theneurondaily على إكس نقلًا عن Ramp.

فتحت fal Agent باب الانضمام إلى دفعة جديدة من الشركاء الإبداعيين.

شرح أنطون أوسيكا، الشريك المؤسس والرئيس التنفيذي لشركة Lovable، كيف تستخدم الشركات الذكاء الاصطناعي بدلًا من بعض البرمجيات التقليدية.

تطلق Compute Exchange عقودًا تتيح للشركات تثبيت أسعار رموز الذكاء الاصطناعي لمدة تصل إلى ٦ أشهر.

تجد شركات ناشئة تُغلق أبوابها أو تُستحوذ عليها أصلًا جديدًا في سجلاتها: سنوات من الاتصالات الداخلية وبيانات استخدام البرمجيات.

أطلقت DeepSeek نموذجها الرائد DeepSeek V4 Pro 0813، بحسب منشور على إكس.

لن تطرح أنثروبيك نموذجًا جديدًا للذكاء الاصطناعي، بحسب منشور على إكس.

وصف حساب @rohanpaul_ai على إكس إصدار GenSpark AI Workspace 6.0 بأنه خطوة طموحة نحو نظام واحد يتذكر ويعمل عبر مختلف المهام.

عرض @svpino على إكس مكتبةً لمحاكاة النماذج اللغوية وأدوات MCP والوكلاء وقواعد البيانات.

تحذر ورقة جديدة من ميتا من أن أخطر إخفاقات تحكيم نماذج الذكاء الاصطناعي قد لا يكون حكمًا خاطئًا، بل حكمًا صحيحًا يُقنعه النموذج الخاضع للتقييم بتغيير رأيه.

قدّم حساب @skirano على إكس إصدار Figma Connect 2.0، الذي يحوّل تصاميم Figma إلى شيفرة React عبر MagicPath.

يستخدم نظام إكس المفتوح المصدر نموذجًا سلوكيًا باسم TweetSpamBot لتحليل نشاط الحسابات ورصد مؤشرات المحتوى الآلي.