Microsoft AI เปิดตัว MAI-Transcribe-2-Streaming โมเดลถอดเสียงเรียลไทม์ 60 ภาษา ขึ้นอันดับ 1 บน Artificial Analysis พร้อม MAI-Voice-2.1 และรุ่น Flash ที่ให้เสียงเดียวพูดได้ 23 ภาษา ...
Google เปิดตัว Gemini 3.8 Live และ 3.8 Live Extended Thinking โมเดลเสียงที่คิดไปคุยไปพร้อมกัน รองรับ 97 ภาษา สลับได้เองกลางบทสนทนา เรียกใช้เครื่องมือเบื้องหลังโดยไม่ทำให้บทสนทนาสะด...
OpenAI เปิดตัว 3 โมเดลเสียงใหม่ใน Realtime API ได้แก่ GPT-Realtime-2 ที่ใช้เหตุผลระดับ GPT-5, GPT-Realtime-Translate แปลสด 70+ ภาษา และ GPT-Realtime-Whisper ถอดเสียงเรียลไทม์ พร้อม...
OpenAI เปิดตัว GPT-Realtime โมเดล Voice AI ที่ล้ำที่สุด ตอบสนองเร็ว เสียงเป็นธรรมชาติเหมือนมนุษย์ เข้าใจคำสั่งซับซ้อนและราคาถูกลง พร้อม Realtime API ที่จะปฏิวัติวงการผู้ช่วยเสียงอั...