OpenAI เปิดตัว GPT-Live-1 ผ่าน API ให้ผู้พัฒนาสร้างระบบเสียงพูดและฟังพร้อมกัน
OpenAI เปิดให้ผู้พัฒนาเข้าถึงโมเดล GPT-Live-1 ผ่าน API เพื่อสร้างประสบการณ์สนทนาด้วยเสียงที่เป็นธรรมชาติ รองรับการฟังและพูดพร้อมกัน
วันที่ 10 กันยายน 2026 OpenAI ประกาศเปิดตัว GPT-Live-1 ผ่าน API อย่างเป็นทางการ เพื่อให้นักพัฒนาสามารถนำความสามารถด้านการสนทนาด้วยเสียงที่สมจริงไปประยุกต์ใช้ในแอปพลิเคชันของตนเอง โดยจุดเด่นสำคัญคือการทำงานแบบ full-duplex (รับส่งข้อมูลสองทางพร้อมกัน) ทำให้ผู้ใช้งานสามารถพูดแทรกระหว่างที่AIกำลังพูดอยู่ได้ทันทีโดยไม่ต้องรอให้จบประโยค
ระบบดังกล่าวยังมาพร้อมความสามารถในการปฏิบัติตามคำสั่งที่แม่นยำขึ้น การรองรับเสียงเฉพาะตัว (custom voices) และการเชื่อมต่อกับระบบโทรศัพท์ (telephony support) สำหรับด้านราคา OpenAI กำหนดค่าบริการส่วนเสียงไว้ที่ 0.05 ดอลลาร์สหรัฐต่อนาที โดยจะมีค่าใช้จ่ายของโมเดลเบื้องหลัง (reasoning model) เพิ่มเติมตามการใช้งาน
สำหรับการนำไปใช้งานจริง ภาคธุรกิจอย่าง Yelp ได้ประกาศเตรียมนำ GPT-Live-1 ไปใช้ในระบบ Yelp Host และ Hatch เพื่อช่วยจัดการงานสนทนาทางโทรศัพท์สำหรับร้านอาหารและผู้ให้บริการ อย่างไรก็ตาม ในส่วนของตัวเลขประสิทธิภาพที่ระบุว่าช่วยลดการขัดจังหวะลงเกือบ 80% นั้น เป็นผลการประเมินเบื้องต้นจากบริษัท Speak ที่ทาง OpenAI นำมาอ้างอิง ซึ่งยังต้องรอการตรวจสอบยืนยันจากการใช้งานจริงในวงกว้างต่อไป
การเปิดตัว API นี้จะช่วยให้นักพัฒนาและภาคธุรกิจไทยสามารถนำระบบเสียงอัจฉริยะที่โต้ตอบได้อย่างเป็นธรรมชาติและพูดแทรกได้ มาพัฒนาบริการลูกค้าทางโทรศัพท์หรือแอปพลิเคชันได้อย่างสะดวกยิ่งขึ้น