โดย Thank Thanedpol | เผยแพร่ 9 กรกฎาคม 2569
สรุปสาระสำคัญ
OpenAI เปิดตัว GPT-Live โมเดลเสียงที่ฟังและพูดพร้อมกันได้จริงเป็นครั้งแรก ด้วยสถาปัตยกรรมแบบ full-duplex
เวลาเจอคำถามยากๆ มันจะแอบส่งงานให้ GPT-5.5 ไปคิดเบื้องหลัง แล้วเอาคำตอบมาต่อบทสนทนาแบบไม่มีสะดุด
GPT-Live-1 และ GPT-Live-1 mini เริ่มเปิดให้ผู้ใช้ ChatGPT ทั่วโลกแล้ววันนี้ ทั้ง iOS, Android และเว็บ
ผลทดสอบ GPQA และ BrowseComp ของ GPT-Live-1 สูงกว่า Advanced Voice Mode แบบทิ้งห่างชัดเจน
ลองนึกภาพคุยโทรศัพท์กับใครสักคน แล้วเขาพูดแทรกทุกครั้งที่คุณหยุดหายใจ หรือเงียบไปเฉยๆ ไม่ตอบสนองอะไรเลย นั่นคือ ปัญหาที่ Voice AI ทุกเจ้าเจอมาตลอด รวมถึง ChatGPT เวอร์ชันก่อนหน้าด้วย
8 กรกฎาคม 2569 OpenAI เปิดตัว GPT-Live-1
GPT-Live คือโมเดลเสียงรุ่นใหม่ของ OpenAI ที่ฟังและพูดพร้อมกันได้ในเวลาเดียวกัน ไม่ต้องรอให้อีกฝ่ายพูดจบก่อนถึงจะตอบเหมือนโมเดลรุ่นก่อน มันจะแทรกคำอย่าง "อืม" หรือ "เข้าใจแล้ว" ระหว่างที่เราพูดอยู่ หยุดรอตอนที่เราคิด และเลือกจังหวะพูดแทรกได้เองแบบที่ไม่รบกวน
จุดที่ทำให้ GPT-Live ต่างจากเดิมจริงๆ คือ มันแยกงานคุยเล่นออกจากงานคิดหนัก เวลาเราถามอะไรที่ต้องค้นเว็บหรือวิเคราะห์ลึกๆ มันจะส่งงานนั้นให้ GPT-5.5 ทำงานอยู่เบื้องหลัง แล้วเอาคำตอบกลับมาต่อบทสนทนาทันทีที่พร้อม เราจะรู้สึกแค่ว่ามันตอบได้ฉลาดขึ้นโดยไม่รู้เลยว่าข้างหลังทำงานหนักแค่ไหน
หน้าที่หลักๆ คือ
คุยโต้ตอบแบบเรียลไทม์ ตัดสินใจได้หลายครั้งต่อวินาทีว่าจะพูด ฟังต่อ หยุด พูดแทรก หรือเรียกใช้เครื่องมือ ทำให้จังหวะสนทนาลื่นไหลเหมือนคุยกับคนจริง
ส่งงานที่ต้องคิดหนักให้โมเดลอื่นทำแทน เวลาเจอคำถามที่ต้องค้นเว็บ คิดวิเคราะห์ลึกๆ หรืองานซับซ้อน มันจะส่งต่อให้ GPT-5.5 ทำงานอยู่เบื้องหลัง แล้วเอาคำตอบกลับมาต่อบทสนทนาแบบไม่มีสะดุด ระหว่างนั้นตัวมันเองก็ยังคุยกับเราต่อไปได้เรื่อยๆ
ฟังได้ดีขึ้น กรองเสียงรบกวนรอบข้างได้ดีขึ้น ไม่เข้าใจผิดว่าเราพูดจบแล้วทั้งที่แค่หยุดคิดสักครู่
แสดงคำตอบเป็นภาพได้ด้วย เช่น การ์ดข้อมูลสภาพอากาศ หุ้น กีฬา ระหว่างที่กำลังคุยด้วยเสียงอยู่
ผลทดสอบก็ยืนยันเรื่องนี้ชัดเจน
การทดสอบ | Advanced Voice Mode | GPT-Live-1 |
|---|---|---|
GPQA (คิดวิเคราะห์เชิงวิทยาศาสตร์) | 45.3% | สูงสุด 84.2% |
BrowseComp (ค้นหาข้อมูลยากๆ) | 0.7% | สูงสุด 75.2% |
OpenAI เริ่มเปิดให้ใช้งาน GPT-Live-1 แล้วตั้งแต่วันนี้ ผู้ใช้แพ็กเกจ Go, Plus และ Pro จะได้ GPT-Live-1 เป็นค่าเริ่มต้นของ ChatGPT Voice ส่วนผู้ใช้ฟรีจะได้ GPT-Live-1 mini ใช้ได้ทั้งบนมือถือและเว็บ
ถ้าใครใช้ ChatGPT Voice บ่อยๆ อยู่แล้ว ลองกดเข้าไปคุยดูรอบนี้เลยครับ ความต่างจะรู้สึกได้ตั้งแต่ประโยคแรกที่มันตอบกลับมา
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
Q: ต้องเสียเงินเพิ่มไหม
A: ไม่ต้อง GPT-Live กลายเป็นค่าเริ่มต้นใหม่ของ ChatGPT Voice ตามแพ็กเกจที่ใช้อยู่แล้ว
Q: รองรับภาษาไทยไหม
A: รองรับแล้ว แต่บางภาษารวมถึงบางฟีเจอร์อาจยังมีสำเนียงหรือความคล่องไม่เนียน 100% ทาง OpenAI บอกว่ากำลังปรับปรุงต่อเนื่อง
ใช้พร้อมวิดีโอหรือแชร์หน้าจอได้ไหม
ยังไม่ได้ในตอนเปิดตัวนี้ ถ้าอยากใช้ฟีเจอร์นั้นต้องกลับไปใช้ Standard หรือ Advanced Voice Mode แบบเดิมไปก่อน
Source:
OpenAI: https://openai.com/index/introducing-gpt-live/?ref=testingcatalog.com
Youtube: https://youtu.be/EAN5Cj347PY
// อ่านต่อ


OpenAI กำลังซุ่มทดสอบฟีเจอร์ Realtime Voice Mode สำหรับ Codex ที่ไม่ใช่แค่ผู้ช่วยเขียนโค้ดอีกต่อไป แต่กำลังกลายเป็นเลขาส่วนตัวที่สั่งผ่านเสียงได้หมด ตั้งแต่เช็ก Slack, เปิดปฏิทิน, ควบคุม Spotify ไปจนถึงสแกนหาเมนูอาหารเย็นใน Uber Eats
อ่าน →