← كل الأخبار
الذكاء الاصطناعي٢٩ أغسطس ٢٠٢٦

منظمة LAION تطلق مجموعة بيانات فيديو مفتوحة للبحث

شارك

أطلقت منظمة LAION مجموعة بيانات الفيديو المفتوحة Big Video Dataset، المخصصة لأبحاث الذكاء الاصطناعي. جمعت المجموعة ٨٠ مليون فيديو من أصل ١٫٣ مليار رابط، بإجمالي ١٠ ملايين ساعة، واستخرجت منها ٥٥ مليون مقطع و٣٠٠ مليون صورة ثابتة مع أوصاف مولّدة آليًا للفيديو والصوت. وتربط البيانات بين الصورة والصوت والنص، فيما تشير الورقة إلى تفوق النماذج المدربة عليها بما يصل إلى ٢٫١ نقطة مئوية على نماذج مدربة على InternVid في اختبارات تحويل الفيديو إلى نص. الإتاحة مجانية مع قصر الاستخدام على البحث، ودعوة المستخدمين إلى احترام حقوق أصحاب المحتوى.

الحقائق الأساسية

  • تعتمد المجموعة على ١٫٣ مليار رابط فيديو من CommonCrawl، نُزّل منها ٨٠ مليون فيديو.

    «It draws from 1.3 billion video URLs found in CommonCrawl. The team downloaded 80 million of those videos, totaling 10 million hours, and extracted 55 million clips with auto-generated video and audio descriptions plus 300 million still images.»
    عرض المصدر ←
  • تقول الورقة إن النماذج المدربة على BVD تفوقت بما يصل إلى ٢٫١ نقطة مئوية على نماذج InternVid في اختبارات شائعة لتحويل الفيديو إلى نص.

    «According to the paper, models trained on BVD outperform comparable models trained on InternVid by up to 2.1 percentage points on common video-to-text benchmarks.»
    عرض المصدر ←
  • البيانات والشفرة متاحتان مجانًا، لكن الاستخدام مقصور على الأبحاث.

    «LAION is releasing the dataset for research only.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر
منظمة LAION تطلق مجموعة بيانات فيديو مفتوحة للبحث — رادار