← كل الأخبار
الذكاء الاصطناعي١٠ سبتمبر ٢٠٢٦

أوبن أيه آي تطلق نموذج GPT-Live-1 للمحادثات الصوتية

شارك

أتاحت OpenAI واجهة GPT-Live-1 للمطورين، وهي نموذج صوتي يستطيع الاستماع والتحدث في الوقت نفسه، ويعمل أصلًا داخل ChatGPT. ويمكن للمطورين ربطه بنماذج خلفية مختلفة، لاختيار التوازن المناسب بين عمق التفكير والسرعة والتكلفة لكل استخدام. وتبلغ كلفة تشغيله ٠٫٠٥ دولار للدقيقة، بينما تُظهر اختبارات OpenAI تحسنًا في التفاعل الصوتي واستدعاء الأدوات مقارنةً بالنماذج السابقة. كما يأتي النموذج بـ١٢ صوتًا جديدًا، مع تفريغ الكلام إلى نص وإتاحة نص الاستجابة مباشرة.

الحقائق الأساسية

  • بلغت نتيجة GPT-Live-1 في اختبار التفاعل الصوتي ثنائي الاتجاه ٨٠٫١٪، مقابل ٤٥٫٤٪ لنموذج GPT-Realtime-2.1.

    «In full-duplex interactivity tests, it scores 80.1 percent compared to 45.4 percent for GPT-Realtime-2.1.»
    عرض المصدر ←
  • تراجعت مدة الانتقال بين أدوار الحديث إلى ٠٫٨ ثانية، بعد أن كانت ١٫٤ ثانية، وارتفعت دقة استدعاء الأدوات من ٦٠٪ إلى ٨٧٪.

    «Turn-taking latency drops to 0.8 seconds from 1.4 seconds. Tool-calling accuracy jumps to 87 percent from 60 percent.»
    عرض المصدر ←
  • تستخدم Yelp النموذج للحجوزات الهاتفية، وتقول إن أداء المكالمات تحسن.

    «Yelp is using the model for phone-based reservations and reports better call handling, according to CTO Alex Levy.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر
أوبن أيه آي تطلق نموذج GPT-Live-1 للمحادثات الصوتية — رادار