รู้จัก Intelligent UI ใน GPT-6 กราฟ แผนที่ ปุ่ม ฟอร์ม รวมอยู่ในแชตเดียว

ถามว่าจะหารค่าอาหารกับเพื่อนห้าคนอย่างไร แล้วได้เครื่องคิดเงินที่กรอกตัวเลขเองได้ขึ้นมาในแชต แทนที่จะเป็นข้อความอธิบายยาวเหยียด 

นี่คือประสบการณ์ใหม่ที่ OpenAI เพิ่งปล่อยออกมาพร้อม GPT-6 ใน ChatGPT และคราวนี้ไม่ได้จำกัดแค่ผู้ใช้แบบเสียเงิน แต่ขยายไปถึงผู้ใช้ฟรีด้วย หมายความว่าคนกว่า 1.2 พันล้านคนที่ใช้ ChatGPT ในแต่ละสัปดาห์จะได้ใช้โมเดลตระกูลล่าสุดของ OpenAI

หัวใจของการอัปเดตครั้งนี้คือความสามารถที่ OpenAI ตั้งชื่อว่า Intelligent UI ซึ่งเปิดให้ GPT-6 เลือกเองว่าคำถามแต่ละข้อควรตอบในรูปแบบไหน จะเป็นข้อความ ภาพประกอบ กราฟ แผนที่ ปุ่มให้กด แบบฟอร์มให้กรอก หรือเครื่องมือเล็ก ๆ ที่ใช้งานได้จริงในหน้าแชต โดยผู้ใช้ไม่ต้องสั่งเป็นพิเศษ นอกจากนี้ GPT-6 ยังเริ่มตอบได้ตั้งแต่ระหว่างที่ยังคิดไม่เสร็จ คำตอบจึงมาถึงเร็วกว่าเดิม

ก่อนหน้านี้ OpenAI เปิดตัวโมเดลตระกูล GPT-6 ชุดแรกให้ลูกค้าแบบเสียเงินไปเมื่อเดือนที่แล้ว ครั้งนี้จึงเป็นการนำ GPT-6 รุ่นที่ปรับมาเพื่อบทสนทนาในชีวิตประจำวันเข้ามาอยู่ในแท็บ Chat ให้คนทั่วไปได้ใช้ ขอชวนทุกคนมาสำรวจว่า Intelligent UI เปลี่ยนหน้าตาคำตอบของ ChatGPT ไปอย่างไร เบื้องหลังทำงานแบบไหน และใครจะได้ใช้รุ่นใดบ้าง

คำถามต่างกัน คำตอบก็ไม่จำเป็นต้องหน้าตาเหมือนกัน

OpenAI ฝึก GPT-6 ให้ประกอบคำตอบจากข้อความ ภาพ และองค์ประกอบที่โต้ตอบได้ โดยดูจากคำถามว่ารูปแบบไหนเหมาะที่สุด คำถามเชิงเปรียบเทียบอาจวางข้อมูลเทียบกันซ้ายขวา คำอธิบายเรื่องซับซ้อนอาจกลายเป็นแผนภาพที่กดสำรวจได้ แต่ถ้าข้อความสั้น ๆ ตอบได้ตรงจุดที่สุด ChatGPT ก็จะตอบเป็นข้อความธรรมดาเหมือนเดิม

ผลที่ได้คือคำถามในชีวิตประจำวันเห็นภาพชัดขึ้น ตัวอย่างที่ OpenAI ยกมาคือสูตรอบเนื้อมื้อวันอาทิตย์ (Sunday Roast) ที่มีลำดับเวลาการทำอาหารวางคู่กับสูตร หรือแผนขับรถเที่ยวที่จุดแวะพักทุกจุดปรากฏบนแผนที่ พร้อมโน้ตว่าที่ไหนคุ้มค่าแก่การเลี้ยวออกไปแวะ ส่วนภาพเปรียบเทียบระหว่าง GPT-5.6 กับ GPT-6 ที่ OpenAI นำมาแสดง ยังมีกล่องสูตรอาหารที่ปรับปริมาณวัตถุดิบตามจำนวนแขก รายการเช็กลิสต์ และคำถามต่อยอดแบบตัวเลือกให้กดตอบได้ทันที

ประโยชน์ที่ชัดไม่แพ้กันอยู่ที่การเรียนรู้เรื่องยาก เพราะคำอธิบายแบบโต้ตอบได้เปิดให้ผู้ใช้ลองเปลี่ยนค่าตั้งต้นแล้วดูว่าผลลัพธ์เปลี่ยนไปอย่างไร หรือไล่แก้โจทย์ไปทีละขั้นด้วยตัวเอง แทนการอ่านคำอธิบายเป็นตัวหนังสืออย่างเดียว

ที่ไปไกลกว่านั้นคือผู้ใช้สั่งให้ ChatGPT สร้างเครื่องมือสำหรับงานตรงหน้าได้เลย เช่น เครื่องคำนวณว่าเงินออมจะงอกเงยแค่ไหน ตัวช่วยหารค่าอาหารมื้อเย็นกับเพื่อน หรือแม้แต่เกมที่เล่นได้ในหน้าแชต

เบื้องหลังคือชุดตัวต่อสำเร็จรูป ที่โผล่ขึ้นมาทีละชิ้นระหว่างโมเดลกำลังตอบ

คำถามที่ตามมาคือ ถ้าโมเดลออกแบบหน้าจอใหม่ทุกครั้ง จะทำอย่างไรให้ยังเร็วและหน้าตาคุ้นเคยทั้งบนเว็บและมือถือ คำตอบของ OpenAI มีสองส่วน ส่วนแรกคือคลังชิ้นส่วนหน้าจอ (Component Library) ที่สร้างไว้ให้ทำงานบนแอปโดยตรง เปรียบได้กับชุดตัวต่อที่ออกแบบไว้แล้ว ทุกคำตอบจึงมีหน้าตาไปในทิศทางเดียวกัน แต่โมเดลยังมีอิสระที่จะเลือกว่าจะหยิบชิ้นไหนมาประกอบกันอย่างไร

ส่วนที่สองคือตัวแปลงหน้าจอ (Compiler) ที่แปลงสิ่งที่โมเดลกำลังเขียนออกมาให้เป็นหน้าจอทันที หน้าจอจึงค่อย ๆ ปรากฏขึ้นทีละส่วนตามจังหวะที่โมเดลสร้าง โดยผู้ใช้ไม่ต้องนั่งรอจนคำตอบเสร็จทั้งก้อน

มีชิ้นส่วนพร้อมแล้วก็ยังไม่พอ เพราะโมเดลต้องรู้ด้วยว่าควรใช้มันอย่างไร OpenAI จึงขยายวิธีฝึกให้ GPT-6 ตัดสินใจเรื่องเนื้อหา การจัดวาง ภาพ และการโต้ตอบได้ดีขึ้น โดยประเมินหน้าจอที่โมเดลสร้างว่าชัดเจน มีประโยชน์ และครบถ้วนแค่ไหน จนโมเดลเรียนรู้วิธีจัดข้อมูลให้อ่านง่าย รู้ว่าเมื่อไรควรใส่ลูกเล่นให้กด และเมื่อไรตอบเป็นข้อความก็พอแล้ว

ถึงอย่างนั้น OpenAI ยอมรับว่ายังต้องพัฒนาวิจารณญาณด้านการออกแบบของโมเดล และขยายขอบเขตสิ่งที่มันสร้างได้อีกมาก แต่บริษัทมองว่า Intelligent UI คือจุดเปลี่ยนสำคัญของวิธีที่คนใช้ ChatGPT เพราะแทนที่ทุกคำถามจะต้องถูกตอบในรูปแบบบทสนทนาแบบเดียวกัน ChatGPT จะผสานหน้าจอ ข้อมูล และการลงมือทำเข้าด้วยกัน เพื่อสร้างวิธีใหม่ในการสำรวจและทำความเข้าใจข้อมูล

ตอบไปคิดไป โมเดลที่คิดหนักไม่ต้องให้รอนานอีกต่อไป

นอกจากหน้าตาของคำตอบ อีกโจทย์ที่ OpenAI แก้ใน GPT-6 คือเวลารอ นับตั้งแต่มีโมเดลที่ใช้เหตุผล (Reasoning Model) ผู้ใช้ได้ความช่วยเหลือกับปัญหาที่ยากขึ้นมาก แต่ต้องแลกกับการรอให้โมเดลคิดจนจบก่อนจึงจะเห็นคำตอบ GPT-6 เปลี่ยนตรงนี้ด้วยการคิดสลับกับตอบไปพร้อมกัน

OpenAI ฝึกให้โมเดลคำนึงถึงเวลาที่ผู้ใช้ต้องรอ แล้วทยอยเรียบเรียงคำตอบจากความรู้และสิ่งที่ค้นพบ ณ ขณะนั้น คำตอบจึงมาเป็นหลายช่วงต่อกัน โดยแต่ละช่วงต้องเพิ่มข้อมูลที่มีประโยชน์และไม่มีคำฟุ่มเฟือย ขณะที่คำตอบทั้งหมดเมื่อรวมกันต้องยังต่อเนื่องและถูกต้องเหมือนเขียนรวดเดียวจบ

ตัวเลขที่ OpenAI นำมายืนยันมาจากการทดสอบภายในด้วยงานแบบเอเจนต์ (Agentic Tasks) ที่ใช้บ่อยในชีวิตประจำวันและมีมูลค่าสูง ซึ่งหมายถึงงานที่ AI ต้องลงมือทำหลายขั้นตอนแทนผู้ใช้ ผลคือ GPT-6 ที่ระดับการคิด Extra High เริ่มตอบได้เร็วพอ ๆ กับ GPT-5.6 ที่ระดับ Medium แต่ได้คะแนนรวมดีกว่า GPT-5.6 ที่ระดับ Extra High ระดับการคิดในที่นี้คือความลึกที่ผู้ใช้เลือกให้โมเดลใช้เวลาคิดก่อนตอบ ยิ่งสูงยิ่งคิดนานและละเอียดขึ้น

ความเร็วยังเห็นได้ชัดกับคำถามที่ต้องค้นข้อมูลบนเว็บ เพราะ GPT-6 Instant เริ่มตอบได้เร็วกว่า GPT-5.6 Instant โดยเฉลี่ย 44% และไม่ได้เร็วอย่างเดียว เพราะ GPT-6 ยังตัดสินใจได้ดีขึ้นว่าเมื่อไรควรค้นข้อมูลเพิ่ม และหาข้อมูลที่สนับสนุนคำตอบได้แม่นยำกว่าเดิม ในการทดสอบภายในด้วยโจทย์ยาก GPT-6 ตอบตรงประเด็นสำคัญของคำถามได้บ่อยกว่า GPT-5.6

ต้านการหลอกล่อได้ดีขึ้น โดยไม่ปฏิเสธคำขอธรรมดาพร่ำเพรื่อ

เมื่อ AI ที่เก่งขึ้นกำลังไปอยู่ในมือคนจำนวนมากขึ้น ความปลอดภัยจึงต้องตามให้ทัน OpenAI เน้นสามด้าน คือการมองเห็นความเสี่ยงในโลกจริง ความซื่อตรงในการตอบ และการเคารพขอบเขตที่ผู้ใช้กำหนด โดย GPT-6 ต่อยอดความก้าวหน้าด้านความปลอดภัยหลายอย่างจาก GPT-6 Astra เมื่อเทียบกับ GPT-5.6 Sol โมเดลใหม่จึงต้านความพยายามหลอกล่อให้หลุดจากกรอบความปลอดภัยได้ดีกว่า ทำตามมาตรการป้องกันได้เคร่งครัดกว่า และบอกได้ชัดกว่าว่าตัวเองทำอะไรได้และไม่ได้

OpenAI ยังนำบทเรียนจากการใช้งานจริงมาปรับการฝึกด้านความปลอดภัย เพื่อป้องกันการนำโมเดลไปใช้ในทางที่มีความเสี่ยงสูง ทั้งการโจมตีทางไซเบอร์ ภัยคุกคามทางชีวภาพ และความรุนแรง ในการทดสอบแบบจำลองผู้ไม่หวังดี (Adversarial Testing) GPT-6 ต้านทานได้ดีขึ้น โดยเฉพาะการโจมตีที่ค่อย ๆ ปรับวิธีถามไปทีละข้อความตลอดบทสนทนา

อีกด้านหนึ่ง GPT-6 ถูกฝึกให้ตอบอย่างปลอดภัยในสถานการณ์เสี่ยง แต่ไม่ปฏิเสธคำขอที่ไม่มีพิษภัยโดยไม่จำเป็น วิธีที่ใช้คืออ่านประวัติบทสนทนาและบริบทรอบข้างประกอบ เพื่อจับความเสี่ยงที่ดูจากข้อความเดียวอาจมองไม่เห็น

นอกจากนี้ OpenAI ยังประเมินความสอดคล้องกับเจตนาของมนุษย์ (Alignment) ตลอดการฝึก ทั้งเรื่องความซื่อตรงและการรับมือกับข้อจำกัดด้านความปลอดภัย ผลคือ GPT-6 รู้ทันข้อจำกัดของตัวเองดีขึ้นและสื่อสารออกมาได้ชัดขึ้น รวมถึงยอมบอกตรง ๆ เมื่อไม่มีข้อมูลหรือเครื่องมือพอจะตอบ รายละเอียดผลทดสอบทั้งหมดอยู่ในเอกสารรายงานความปลอดภัยของโมเดล (System Card)

ใครได้ใช้รุ่นไหน และใช้ได้ตรงไหนบ้าง

GPT-6 พร้อม Intelligent UI ทยอยเปิดให้ผู้ใช้ ChatGPT ระดับ Plus, Pro, Business และ Enterprise ทั่วโลกในแท็บ Chat ก่อน แล้วขยายไปยังผู้ใช้ระดับ Free และ Go ในวันถัดมา ส่วนองค์กรที่ใช้ Enterprise จะได้ใช้หรือไม่ขึ้นอยู่กับการตั้งค่าของผู้ดูแลระบบ

โมเดลที่ทำงานอยู่เบื้องหลังแบ่งตามระดับสมาชิก ผู้ใช้แบบเสียเงินจะได้ GPT-6 Sol ขณะที่ผู้ใช้ Free และ Go จะได้ GPT-6 Luna ซึ่งทั้งสองรุ่นถูกปรับมาเพื่อบทสนทนาในชีวิตประจำวัน การอัปเดตนี้มีผลเฉพาะแท็บ Chat เท่านั้น โมเดลที่ขับเคลื่อน Work และ Codex ยังคงเป็นรุ่นเดิม

หน้าช่วยเหลือของ OpenAI ยังให้รายละเอียดเพิ่มว่า Intelligent UI ทยอยเปิดบนเว็บและแอปเวอร์ชันล่าสุด รองรับระดับการคิดตั้งแต่ Instant ถึง Extra High แต่ระดับ Pro ที่ยังใช้ GPT-6 Astra อยู่จะไม่รองรับฟีเจอร์นี้ เช่นเดียวกับแอปเดสก์ท็อปรุ่นเก่าบน macOS และ Windows ส่วนใครที่อยากได้คำตอบแบบข้อความเป็นหลัก สามารถปิดการตั้งค่า Layout and Visuals บนเว็บได้ แต่ยังอาจเห็นภาพประกอบบางส่วนอยู่

จากคนที่ต้องเรียนรู้ซอฟต์แวร์ สู่ซอฟต์แวร์ที่ปรับตัวเข้าหาคน

OpenAI มองว่า Intelligent UI เป็นก้าวแรกของ ChatGPT ที่ออกแบบหน้าจอรอบสิ่งที่ผู้ใช้กำลังพยายามทำ และในระยะยาว บริษัทอยากให้ ChatGPT สร้างหน้าจอที่คนต้องใช้ในงานประจำวันได้มากขึ้น จนผู้ใช้แค่อธิบายว่าอยากทำอะไรให้สำเร็จ แล้วได้ประสบการณ์ที่สร้างขึ้นมาเพื่องานนั้นโดยเฉพาะ

เหตุผลเบื้องหลังวิสัยทัศน์นี้คือ ตลอดหลายสิบปีที่ผ่านมา คนต้องเรียนรู้วิธีใช้ซอฟต์แวร์ และปรับตัวเข้ากับหน้าจอตายตัวที่ถูกออกแบบมาสำหรับงานเฉพาะอย่าง OpenAI เชื่อว่าอนาคตจะต่างออกไป ดังที่บริษัทเขียนปิดท้ายประกาศว่า 'Instead of people adapting to software, software will adapt to people.' หรือแทนที่คนจะต้องปรับตัวเข้าหาซอฟต์แวร์ ซอฟต์แวร์จะเป็นฝ่ายปรับตัวเข้าหาคน ซึ่งตัวช่วยหารค่าอาหารที่โผล่ขึ้นมาในแชตเมื่อถูกถาม ก็คือตัวอย่างแรก ๆ ของอนาคตแบบนั้น

ตอนนี้ GPT-6 พร้อม Intelligent UI กำลังทยอยเปิดให้ผู้ใช้ ChatGPT ทุกระดับทั่วโลกในแท็บ Chat โดยเริ่มจากผู้ใช้แบบเสียเงิน แล้วตามด้วยผู้ใช้ Free และ Go

ที่มา: OpenAI, OpenAI Help Center, MacRumors, Search Engine Journal

ลงทะเบียนเข้าสู่ระบบ เพื่ออ่านบทความฟรีไม่จำกัด

No comment

RELATED ARTICLE

Responsive image

เปิดตัว Claude Haiku 5.5 โมเดลเล็กของ Anthropic ที่เร็วที่สุด

Anthropic เปิดตัว Claude Haiku 5.5 โมเดลเล็กที่เร็วที่สุด ต้นทุนต่ำกว่า Haiku 4.5 ราว 75% คะแนนใช้คอมพิวเตอร์พุ่งเป็น 72.4% พร้อมลดต้นทุน Sonnet 5.5 ราว 20% และแจกเครดิต API ให้สมา...

Responsive image

Google เปิดตัวโมเดลค้นหาใหม่ ‘EmbeddingGemma 2’ ค้นได้ทั้งข้อความ โค้ด ภาพ วิดีโอ เสียง ในโมเดลเดียว

Google เปิดตัว EmbeddingGemma 2 โมเดล Open-weight ขนาดไม่ถึง 1 พันล้านพารามิเตอร์ ค้นหาได้ทั้งข้อความ โค้ด ภาพ วิดีโอ และเสียงในพื้นที่เวกเตอร์เดียว เลือกโหลดได้ 4 ขนาด เก่งโค้ดขึ้...

Responsive image

Google เปิดตัว Nano Banana 2.1 AI วาดรูปสุดแม่น ดึงข้อมูล Google Image Search ก่อนวาด

Google DeepMind เปิดตัว Nano Banana 2.1 AI วาดรูปและแก้ภาพรุ่นใหม่! ชูไฮไลต์ค้นข้อมูลจริงจาก Google Image Search ก่อนเรนเดอร์ แม่นยำขึ้น ภาพตรงปก...