إنفيديا تطلق نموذج Cosmos3-Super-4Step المتخصص في تحويل النصوص والصور إلى فيديو

تصدّرت إنفيديا مشهد النماذج مفتوحة الأوزان بإطلاقها نموذج «كوزموس 3 سوبر» المخصص لتحويل الصور إلى مقاطع فيديو، متفوقة على كل المنافسين في هذا المسار. ويتعلق الأمر بنسخ مُقطّرة من نموذج الشركة الضخم الذي يضم 64 مليار معامل، صُممت لتوليد الفيديو من الصور والنصوص في أربع خطوات فقط. ولم يكتفِ النموذج بتصدر ترتيب تحويل الصور لفيديو، بل احتل المركز الثالث عالميًا في توليد الصور من النصوص ضمن ساحة «آرتيفيشال أنالسيس» التنافسية.
الحقائق الأساسية
احتلت نماذج إنفيديا المركز الأول عالميًا بين النماذج مفتوحة الأوزان في تحويل الصور إلى فيديو، والمركز الثالث في تحويل النصوص إلى صور.
«NVIDIA's Cosmos3-Super-4Step distills are the new #1 open weights model for Image to Video and #3 for Text to Image in the Artificial Analysis Arena»
عرض المصدر ←النماذج الجديدة هي نسخ مُقطّرة مستخلصة من نموذج إنفيديا الأساسي الذي يضم 64 مليار معامل.
«distilled variants of NVIDIA's 64B Cosmos3-Super world»
عرض المصدر ←تتضمن الإصدارات الجديدة نموذجين متخصصين أحدهما لتحويل النص إلى صورة والآخر لتحويل الصورة إلى فيديو بأربع خطوات.
«Cosmos3-Super-Text2Image-4Step and Cosmos3-Super-Image2Video-4Step are distilled variants»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر