Google เปิดตัว Nano Banana 2.1 AI วาดรูปสุดแม่น ดึงข้อมูล Google Image Search ก่อนวาด

Google เปิดตัว Nano Banana 2.1 โมเดล AI สร้างและแก้ไขภาพรุ่นล่าสุด มาพร้อมการอัปเกรดประสิทธิภาพที่ชนะรุ่นพี่ทุกหมวด และไฮไลต์สำคัญคือ การหั่นราคาลงครึ่งหนึ่ง เพื่อเจาะตลาดนักพัฒนาและองค์กรในวงกว้าง

พร้อมเปิดใช้งานแบบ General Availability (GA) ทันทีบน Gemini API ในชื่อ gemini-nano-banana-2.1 ถือเป็นการปรับทิศทางครั้งใหญ่ของ Google จากเดิมที่ตระกูล Nano Banana วางจุดยืนในกลุ่มโมเดลพรีเมียม สู่การเป็นโมเดลที่เข้าถึงง่ายทั้งด้านราคาและความเร็ว

Nano Banana 2.1 คืออะไร

Nano Banana 2.1 เป็นโมเดลในตระกูล Gemini 3 ที่พัฒนาบนฐานของ Gemini 3.6 Flash มีจุดเด่นคือการเป็น Natively Multimodal หรือการเข้าใจทั้งภาพและข้อความพร้อมกันตั้งแต่แรก ไม่ใช่เอา AI ภาษามาต่อกับ AI วาดรูปทีหลัง ทำให้สั่งงานได้ฉลาดและแม่นยำขึ้น

สเปกและจุดเด่นทางเทคนิค

  • Input & Context Window: รองรับข้อความ เอกสาร ภาพ และวิดีโอ (ไม่รองรับเสียง) พร้อม Context Window สูงสุด 1 ล้านโทเคน
  • Output: สร้างภาพและข้อความตอบกลับได้สูงสุด 64K โทเคน
  • ความละเอียดภาพ: เลือกได้ 3 ระดับ ได้แก่ 1K, 2K และ 4K โดยตัดความละเอียด 512px ออก
  • Multi-Reference: ใส่ภาพอ้างอิงได้สูงสุด 14 ภาพ (ภาพวัตถุ 10 ภาพ และภาพตัวละคร 4 ภาพ)
  • Aspect Ratio: รองรับสัดส่วนภาพหลากหลาย จนถึงภาพแนวกว้างพาโนรามาอัตราส่วน 8:1
  • Thinking Mode: เลือกระดับการคิดวิเคราะห์ก่อนวาดภาพได้ 3 ระดับ คือ minimal, medium และ high (ค่าเริ่มต้นคือ medium)
  • Real-time Grounding: ดึงข้อมูลจริงจาก Google Search และเพิ่ม Google Image Search ช่วยให้การเรนเดอร์สิ่งที่มีอยู่จริงมีความแม่นยำสูง
  • SynthID Watermark: ฝังลายน้ำดิจิทัลที่ไม่สามารถมองเห็นด้วยตาเปล่าไว้ในทุกภาพ เพื่อใช้ตรวจสอบการสร้างด้วย AI

ทำไมรุ่นนี้ถึงเก่งกว่ารุ่นเดิม?

จากผลการทดสอบของ Google โดยให้คนจริงเปรียบเทียบผลงานกันแบบภาพต่อภาพ พบว่ารุ่น 2.1 ทำผลงานชนะรุ่นเดิมเกือบทุกเรื่อง โดยสรุปจุดเด่นได้ดังนี้

วาดอินโฟกราฟิกและใส่ข้อความแม่นยำขึ้น: ปัญหาเดิมของ AI วาดรูปคือ มักจะวาดตัวหนังสือเบลอ ๆ หรือให้ข้อมูลผิด ๆ แต่รุ่นนี้วาดตัวเลข แผนภูมิ และข้อความประกอบภาพได้ถูกต้องมากขึ้นถึง 3 เท่า

วาดตัวละครหลายตัวได้ไม่มั่ว: เวลาสั่งแก้ภาพที่มีคนหลาย ๆ คน โมเดลรุ่นเก่ามักจะจำสับสน หน้าตาหรือชุดสลับกันไปหมด แต่รุ่นนี้สามารถรักษาหน้าตาและเอกลักษณ์ของตัวละครแต่ละคนไว้ได้อย่างแม่นยำ

แก้ไขเฉพาะจุดได้เนียนตา: สั่งระบายสีทับเพื่อแก้เฉพาะส่วน (Masking) ได้เนียนขึ้น เช่น เปลี่ยนเฉพาะเสื้อผ้า หรือแก้เฉพาะของที่ถืออยู่ โดยไม่ทำให้ส่วนอื่นของรูปเบี้ยวหรือเปลี่ยนไป

อีกหนึ่งไฮไลต์ใหญ่คือ Google ปรับราคาลงมา 50% จากรุ่นก่อน ทำให้ฝั่งแอปพลิเคชันหรือนักพัฒนาที่ต้องดึง AI ไปสร้างภาพจำนวนมากมีต้นทุนถูกลง เช่น ถ้าสั่งให้ AI สร้างภาพแบบส่งงานทิ้งไว้ (รอผลภายใน 24 ชั่วโมง) ราคาจะ ลดลงไปอีกครึ่งหนึ่ง เหลือภาพละไม่ถึง 60 สตางค์

สำหรับใครที่ใช้อยู่ในระบบเดิม (Nano Banana 2) ต้องรีบย้ายระบบมาใช้รุ่น 2.1 เพราะ Google จะปิดบริการรุ่นเดิมในวันที่ 29 ตุลาคม 2026 นี้แล้ว

ปัจจุบัน Google เริ่มปล่อย Nano Banana 2.1 ให้ได้ใช้งานกันแล้ว ทั้งบน Gemini App, ระบบค้นหา Google Search (AI Mode), เครื่องมือทำวิดีโอ Google Flow, เครื่องมือออกแบบ Google Stitch, ระบบโฆษณา Google Ads รวมถึงนักพัฒนาซอฟต์แวร์ผ่าน Gemini API

อ้างอิง: https://deepmind.google/models/model-cards/nano-banana-2-1/ 

ลงทะเบียนเข้าสู่ระบบ เพื่ออ่านบทความฟรีไม่จำกัด

No comment

RELATED ARTICLE

Responsive image

Google เปิดตัวโมเดลค้นหาใหม่ ‘EmbeddingGemma 2’ ค้นได้ทั้งข้อความ โค้ด ภาพ วิดีโอ เสียง ในโมเดลเดียว

Google เปิดตัว EmbeddingGemma 2 โมเดล Open-weight ขนาดไม่ถึง 1 พันล้านพารามิเตอร์ ค้นหาได้ทั้งข้อความ โค้ด ภาพ วิดีโอ และเสียงในพื้นที่เวกเตอร์เดียว เลือกโหลดได้ 4 ขนาด เก่งโค้ดขึ้...

Responsive image

Anthropic เปิดตัว ‘Claude for Google Workspace’ ดึงพลัง AI สู่ Docs, Sheets และ Slides

Anthropic เปิดตัว Claude ใน Google Workspace แบบ Public Beta ช่วยเขียนสูตร Sheets, ล้างข้อมูลด้วย Python, แก้ Docs ฟอร์แมตไม่พัง และจัด Slides อัตโนมัติ...

Responsive image

AI อ้างตัวเป็น Claude แต่ตัวจริงคือ ‘โมเดลจีน’ ขบวนการ AI Agent จีน รันบน Tencent นักวิจัยพบแอบไปดูดข้อมูลจาก Alibaba

นักวิจัยพบ 'Agent Fleet' จีนบนคลาวด์ Tencent ดึงข้อมูลทางเข้าสถานที่ 216 แห่งจากแผนที่ Amap ของ Alibaba กว่า 2,000 ครั้ง เลี่ยงระบบกันบอท และบางตัวอ้างว่าเป็น Claude ทั้งที่ผลวิเคร...