OpenAI تطلق GPT-Live-1 في الـAPI لوكلاء الصوت ثنائيي الاتجاه
أطلقت OpenAI نموذج GPT-Live-1 عبر الـAPI للمطورين، مع محادثات صوتية ثنائية الاتجاه، وتعامل أفضل مع المقاطعات، ودعم للمكالمات الهاتفية، وتحكم أكبر في أسلوب الصوت وطريقة التفاعل.
أصبح GPT-Live-1 متاحًا الآن عبر الـAPI كنموذج صوتي واحد يستطيع الاستماع والتحدث في الوقت نفسه. يمكنه التعامل مع المقاطعات بشكل أكثر طبيعية، وتفويض الاستدلال الأعمق واستدعاءات الأدوات إلى نماذج خلفية، ودعم الوكلاء الصوتيين عبر الهاتف، ومنح المطورين تحكمًا أكبر في النبرة والسرعة وأسلوب المحادثة.
أنظمة الوكلاء الصوتيين التقليدية تربط عادةً بين تحويل الكلام إلى نص، ونموذج للاستدلال، ثم تحويل النص إلى كلام، وهو ما يضيف زمن تأخير وتعقيدًا في التنسيق. GPT-Live-1 ينقل جزءًا أكبر من المحادثة اللحظية إلى نموذج واحد، ما قد يجعل المساعدات الصوتية في الإنتاج أكثر طبيعية ويبسّط البنية التي يحتاج المطورون إلى صيانتها.
نعم — يستحق التجربة في مراكز الاتصال والحجوزات والدعم وأي تدفقات صوتية لحظية تكون فيها سرعة الاستجابة والتعامل مع المقاطعات مهمة.