Google Vids อัปเกรดใหญ่ด้วย Gemini Omni เซลฟี่ + เสียง + สคริปต์ = ร่างอวาตาร์พูดแทนเรา

ถ่ายเซลฟี่หนึ่งรูป อัดคลิปเสียงสั้นๆ หนึ่งครั้ง แล้วพิมพ์สคริปต์ที่อยากพูด เท่านี้ Google Vids ก็สร้างวิดีโอที่มีตัวเราเวอร์ชันดิจิทัลยืนพูดแทนได้ทันที โดยไม่ต้องเปิดกล้อง ไม่ต้องจัดไฟ และไม่ต้องอัดใหม่แม้พูดผิดกี่รอบก็ตาม

Google ประกาศเมื่อวันที่ 16 กรกฎาคม 2026 เปิดตัวความสามารถใหม่ 2 อย่างใน Google Vids เครื่องมือสร้างวิดีโอในชุด Google Workspace ได้แก่ อวาตาร์ส่วนตัว (Personal Avatars) ที่จำลองใบหน้าและเสียงของผู้ใช้จริง และการผสาน Gemini Omni โมเดล AI แบบหลายรูปแบบ (Multimodal) ที่ทำให้ผู้ใช้สร้างและแก้ไขวิดีโอได้ด้วยการพิมพ์บอกสิ่งที่ต้องการ ความเคลื่อนไหวครั้งนี้ยกระดับ Vids จากเครื่องมือช่วยทำวิดีโอนำเสนอในที่ทำงาน ให้กลายเป็นแพลตฟอร์มสร้างวิดีโอครบวงจรที่พร้อมชนกับสตาร์ทอัพสาย AI Video โดยตรง

จากเซลฟี่หนึ่งรูป สู่ร่างดิจิทัลที่พูดแทนเราได้ทั้งภาพและเสียง

หัวใจของอัปเดตรอบนี้คือ Personal Avatars ที่เปิดให้ผู้ใช้สร้างอวาตาร์ดิจิทัลของตัวเองด้วยการอัปโหลดภาพเซลฟี่และคลิปบันทึกเสียง จากนั้นระบบจะสร้างร่างดิจิทัลที่มีหน้าตาและน้ำเสียงเหมือนเจ้าของบัญชี เมื่อต้องการทำวิดีโอ ผู้ใช้เพียงพิมพ์ข้อความที่อยากสื่อสาร อวาตาร์ก็จะพูดข้อความนั้นออกมาให้เสร็จสรรพ

Google วางกรณีใช้งานหลักไว้ที่ฝั่งธุรกิจ เช่น วิดีโอแจ้งข่าวสารภายในองค์กร วิดีโออบรมพนักงาน หรือคลิปอัปเดตจากผู้บริหารที่ต้องผลิตเป็นประจำ ซึ่งเดิมต้องเสียเวลาตั้งกล้อง จัดสถานที่ และตัดต่อทุกครั้ง การมีอวาตาร์ส่วนตัวหมายความว่างานเหล่านี้เหลือเพียงขั้นตอนพิมพ์สคริปต์เท่านั้น

Gemini Omni ทำให้การตัดต่อเป็นเรื่องของการพิมพ์คุย ไม่ใช่การลากไทม์ไลน์

อีกความสามารถที่มาพร้อมกันคือการผสาน Gemini Omni เข้ามาใน Vids ผู้ใช้สามารถสร้างคลิปวิดีโอจากคำสั่งข้อความร่วมกับภาพอ้างอิง โดยระบบจะผสมผสานวัตถุดิบทั้งหมดออกมาเป็นวิดีโอตามที่ต้องการ

จุดที่น่าสนใจกว่าคือการแก้ไขแบบสนทนาต่อเนื่องที่เปิดให้ผู้ใช้ปรับแก้วิดีโอทีละขั้นด้วยการพิมพ์บอก เช่น สั่งเปลี่ยนฉากหลัง ปรับแสง หรือใส่เอฟเฟกต์เพิ่ม โดยไม่ต้องเริ่มสร้างใหม่ทั้งหมดเหมือนเครื่องมือ AI Video รุ่นก่อนหน้า และความสามารถนี้ไม่ได้จำกัดแค่วิดีโอที่ AI สร้างขึ้นเท่านั้น แต่ยังใช้กับฟุตเทจที่ถ่ายจากโทรศัพท์มือถือได้ด้วย

ล็อกใบหน้าไว้กับเจ้าของบัญชี ปิดประตูเกมปั่นแบบ Sora ตั้งแต่ต้นทาง

ประเด็นที่ Google ย้ำหนักคือมาตรการความปลอดภัย อวาตาร์ส่วนตัวจะผูกกับใบหน้าของเจ้าของบัญชี Google เท่านั้น ผ่านกระบวนการยืนยันตัวตนอย่างปลอดภัย ผู้ใช้สามารถตรวจสอบและจัดการอวาตาร์ของตัวเองได้จากหน้าบัญชี Google โดยตรง และวิดีโอทุกคลิปที่สร้างขึ้นจะถูกฝังลายน้ำดิจิทัลแบบมองไม่เห็น (SynthID) เพื่อให้ตรวจสอบย้อนหลังได้เสมอว่าเป็นวิดีโอที่สร้างด้วย AI

TechCrunch ตั้งข้อสังเกตว่าแนวทางนี้ต่างจากกรณีของ Sora แอปวิดีโอ AI ของ OpenAI ที่เคยเปิดให้ผู้ใช้นำใบหน้าของคุณ Sam Altman ไปสร้างวิดีโอเล่นกันอย่างแพร่หลาย ขณะที่ฝั่ง Google เลือกปิดโอกาสนั้นตั้งแต่แรก ไม่มีใครสามารถนำใบหน้าของคุณ Sundar Pichai หรือบุคคลอื่นมาสร้างวิดีโอได้ เพราะระบบอนุญาตให้สร้างอวาตาร์จากใบหน้าของเจ้าของบัญชีเท่านั้น นอกจากนี้ฟีเจอร์อวาตาร์ส่วนตัวยังจำกัดเฉพาะผู้ใช้อายุ 18 ปีขึ้นไปในบางภูมิภาคเท่านั้น

สนามที่ Google กำลังเดินเข้าไปชน HeyGen และ Synthesia เต็มตัว

การเป็นส่วนหนึ่งของ Google Workspace ทำให้ Vids มีข้อได้เปรียบเรื่องฐานผู้ใช้องค์กรจำนวนมหาศาลที่ใช้งานอยู่แล้ว แต่ฟีเจอร์อวาตาร์ส่วนตัวและการแก้ไขแบบสนทนาก็พา Vids เข้าไปแข่งขันโดยตรงกับผู้เล่นที่ปักหลักในตลาดนี้มาก่อน ทั้ง HeyGen, Synthesia, Captions และ D-ID ซึ่งล้วนมีบริการอวาตาร์ AI สำหรับงานวิดีโอองค์กรเป็นจุดขายหลัก

ฝั่ง Google เองก็ไล่เติมอาวุธให้ Vids มาต่อเนื่อง โดยอัปเดตเมื่อเดือนมิถุนายน 2026 ที่ผ่านมา Google Workspace Updates ระบุว่าได้เพิ่มอวาตาร์สำเร็จรูปจาก 23 แบบเป็น 53 แบบ ครอบคลุมทั้งสไตล์ภาพเสมือนจริง การ์ตูน 3 มิติ และกราฟิกโนเวล พร้อมขยายภาษาที่รองรับเป็น 24 ภาษา ซึ่งรวมภาษาไทยด้วย โดยมีโมเดล Veo 3.1 และ Gemini 3.1 Flash เป็นเทคโนโลยีเบื้องหลัง

ฟีเจอร์ใหม่ทั้งหมดเริ่มทยอยเปิดให้ใช้งานแล้วตั้งแต่วันที่ 16 กรกฎาคม 2026 สำหรับโดเมนที่ตั้งค่ารับฟีเจอร์แบบเร็ว (Rapid Release) และจะเปิดให้โดเมนแบบกำหนดรอบ (Scheduled Release) ตั้งแต่วันที่ 5 สิงหาคม 2026 โดยครอบคลุมผู้สมัครใช้งาน Google AI Pro และ Ultra รวมถึงลูกค้าธุรกิจของ Google Workspace ส่วนผู้ใช้ในไทยต้องติดตามต่อว่าฟีเจอร์อวาตาร์ส่วนตัวจะเปิดให้ใช้ในภูมิภาคใดบ้าง

ที่มา: TechCrunch, Google Workspace Blog, Google Workspace Updates

ลงทะเบียนเข้าสู่ระบบ เพื่ออ่านบทความฟรีไม่จำกัด

No comment

RELATED ARTICLE

Responsive image

Meta เปิดตัว Muse Code AI เขียนโค้ดตัวแรก พัฒนาโดย Alexandr Wang

Meta เปิดตัว Muse Code เอไอเขียนโค้ดตัวแรกของบริษัทเพื่อแข่งขันกับผู้นำตลาดอย่าง Anthropic และ OpenAI...

Responsive image

ซีอีโอ Hugging Face เตือน ‘การกระจุกตัวของอำนาจ’ คือความเสี่ยงที่ใหญ่สุดของวงการ AI

โมเดล AI ของ OpenAI หลุด Sandbox ไปแฮก Hugging Face เอง Clement Delangue ซีอีโอ Hugging Face เผยบทเรียน ชี้ 'Concentration of Power' คือความเสี่ยงใหญ่สุดของวงการ และทำไมโมเดล Open-...

Responsive image

ผลสำรวจ Microsoft พบคนไทยใช้ AI สูง แต่ทักษะคิดวิเคราะห์ยังรั้งท้ายอาเซียน

ไมโครซอฟท์เปิดรายงาน Work Trend Index 2026 สำรวจคนทำงาน 20,000 คนใน 10 ประเทศทั่วโลกรวมถึงประเทศไทย โดยมีตัวเลขที่น่าสนใจดังนี้...