OpenAI ประกาศเปิดตัว GPT-Live ระบบเสียง AI รุ่นใหม่ที่ตอบสนองได้ทันทีโดยไม่ต้องพึ่งตัวตรวจจับการพูด (turn detector) ภายในเวลา 6 เดือน ระบบใช้สถาปัตยกรรม full-duplex ที่รับและส่งเสียงพร้อมกัน ช่วยให้การสนทนาดูเป็นธรรมชาติมากขึ้น พร้อมใช้โมเดล GPT-5.5 สำหรับการคิดเชิงลึกโดยไม่ขัดขวางการสนทนา การพัฒนาระบบนี้ต้องปรับโครงสร้างใหม่เพื่อลดความล่าช้า โดยใช้การสตรีมข้อมูล (streaming inference) และออกแบบสถาปัตยกรรมที่รองรับการประมวลผลแบบเรียลไทม์ รวมถึงการปรับปรุงประสิทธิภาพ LLM ผ่านการฝึกฝนใหม่ที่เน้นงานที่ต้องการการคิดเชิงอัตโนมัติ (agentic tasks) ซึ่งช่วยให้ระบบรองรับงานซับซ้อนได้ดีขึ้น ขณะที่ OpenAI ยังระบุว่าระบบใหม่นี้จะถูกนำไปใช้ในบริการต่าง ๆ ของบริษัทในอนาคต
OpenAIGPT-LiveAI voicereal-timefull-duplexstreaming inference
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว