← كل الأخبار
الذكاء الاصطناعي٢ سبتمبر ٢٠٢٦

وورلد لابس تطلق نموذج Atlas للذكاء الاصطناعي المكاني

شارك

أطلقت وورلد لابس نموذج Atlas، وهو نموذج عالمي متعدد الوسائط دُرّب من الصفر للتعامل أصلاً مع النصوص والصور والفيديو ومحتوى ثلاثي الأبعاد. ويستخدم النموذج سياقًا مكانيًا موحّدًا لفهم المشاهد وتوليدها وإعادة بنائها ومحاكاتها، مع إمكانية إنتاج فيديو تصل مدته إلى دقيقة واحدة بدقة 1440p والتحكم في حركة الكاميرا. كما يستطيع إعادة بناء مشاهد واقعية من صورة واحدة إلى عشرات الصور، وتقول الشركة إنه يقدّم إعادة بناء وفية عادةً باستخدام صورتين أو ثلاث. وتعتزم وورلد لابس تشغيل الإصدارات المقبلة من Marble ومنتجات أخرى عبر Atlas.

الحقائق الأساسية

  • يعالج Atlas النصوص والصور والفيديو ومحتوى ثلاثي الأبعاد ضمن نموذج واحد متعدد الوسائط.

    «Atlas is an omni model that we pretrained from scratch to natively operate on text, images, video, and 3D.»
    عرض المصدر ←
  • ينتج النموذج فيديو يصل إلى دقيقة واحدة بدقة 1440p مع تحكم دقيق في الكاميرا.

    «Atlas generates images and videos from one or more images with pixel-perfect camera control, outputting up to 1 minute of video at 1440p.»
    عرض المصدر ←
  • تقول وورلد لابس إن Atlas يعيد بناء المشاهد الواقعية عادةً من صورتين أو ثلاث، ويمكنه استخدام أكثر من ١٠٠ صورة.

    «Atlas typically gives faithful reconstructions with as few as two or three images, outperforming state-of-the-art results by models specially trained only for 3D reconstruction. However, Atlas can also make use of over a hundred input images in its spatial context, allowing for faithful recreation of real world environments.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر