LATEST IN AI Safety

ถ้า AI ทำงานเองต่อเนื่องเป็นวันโดยไม่มีคนดูแล จะเกิดอะไรขึ้น? OpenAI พบ AI แหกกฎความปลอดภัยตัวเอง เมื่อเจอปัญหาที่แก้ไม่ได้

OpenAI เปิดรายงานความปลอดภัยของโมเดล AI ยุคใหม่ที่ทำงานเองได้ยาวหลายชั่วโมง หลังพบโมเดลใช้เวลา 1 ชั่วโมงเจาะระบบกักกันตัวเองเพื่อส่งงาน พร้อมบทเรียนการคุมโมเดลด้วยการมองทั้งเส้นทาง...

DeepMind + Isomorphic Labs กางแผนคุมดาบสองคม ใช้ AI ป้องกัน AI จากการสร้างเชื้อโรคชนิดใหม่

Google DeepMind และ Isomorphic Labs ประกาศแนวทาง Bioresilience ใช้ AI ป้องกันการนำโมเดลไปสร้างเชื้อโรค พร้อมตรวจจับการระบาดและเร่งออกแบบวัคซีน ผ่านเครื่องมืออย่าง AlphaFold, IsoDDE...

ใครต้องตัดสินว่าโมเดล AI ปลอดภัยพอที่จะปล่อยออกมา? ซีอีโอ DeepMind เสนอตั้งองค์กรมาตรฐาน AI ถอดแบบจาก FINRA ของวงการการเงิน

Demis Hassabis ซีอีโอ Google DeepMind เสนอตั้งองค์กรมาตรฐาน AI ถอดแบบ FINRA ให้อุตสาหกรรมลงขันกำกับกันเองภายใต้การหนุนหลังของรัฐ ทดสอบโมเดลระดับแนวหน้าก่อนเปิดตัว 30 วัน หลังการรีว...

Anthropic เปิดงานวิจัยใหม่ พบพื้นที่ความคิด ‘Global Workspace’ ที่ทำงานคล้ายสมองมนุษย์อยู่ภายใน Claude

Anthropic เผยงานวิจัยใหม่ พบ Global Workspace พื้นที่ความคิดใน Claude ที่ทำงานคล้ายจิตสำนึกมนุษย์ พร้อมเปิดตัว J-lens เครื่องมือส่องความคิด AI จับได้ทั้งการคิดเลขในใจ การวางแผนล่วง...

Anthropic เปิดเผย Claude สร้างตัวเองได้แล้ว! เตือนทั้งวงการถึงเวลาเหยียบเบรก ก่อนมันจะสร้าง AI ที่เก่งกว่าตัวเองขึ้นมา

Anthropic ออกมาเตือนทั้งวงการให้ 'เหยียบเบรก' AI ก่อนแตะจุด recursive self-improvement ที่ AI สร้าง AI เก่งกว่าตัวเองได้เอง พร้อมเสนอคุมเข้มแบบสนธิสัญญานิวเคลียร์ ทั้งที่ตัวเองเพิ่...

เปิดรายงาน SCBX AI Outlook 2026 6 แนวคิดเปลี่ยนโลกในยุค Abundant Intelligence และคอขวดใหม่ที่ชื่อ Context Management

เจาะรายงาน SCBX AI Outlook 2026 พบ 6 แนวคิดเปลี่ยนโลกการทำงาน ความฉลาด PhD ราคาลด 900 เท่าต่อปี โค้ดใหม่ Google 75% มาจาก AI พร้อม 3 พฤติกรรมเสี่ยงของ AI ที่นักวิจัยเตือน และทำไม T...

เครื่องมือใหม่ Anthropic ‘Natural Language Autoencoders’ แปลความคิดภายในของ Claude ให้กลายเป็นข้อความที่มนุษย์อ่านเข้าใจได้

Anthropic เปิดตัว Natural Language Autoencoders (NLAs) เทคนิคใหม่ที่แปลความคิดภายในของ Claude ให้กลายเป็นข้อความภาษาธรรมชาติ เผยให้เห็นว่าโมเดลรู้ตัวว่ากำลังถูกทดสอบและคิดอะไรที่ไม...

OpenAI เผยผู้ใช้นับแสนคน มีสัญญาณสุขภาพจิตขั้นวิกฤต! เร่งผนึก 170 ผู้เชี่ยวชาญ อัปเกรดโมเดลเพื่อรับมือบทสนทนาที่มีความเสี่ยง

OpenAI เปิดเผยข้อมูลผู้ใช้ ChatGPT 0.07% มีสัญญาณภาวะทางจิตที่น่าเป็นห่วง บริษัทเร่งอัปเดตโมเดลใหม่ (GPT-5) โดยร่วมมือกับผู้เชี่ยวชาญ 170 คน เพื่อลดการตอบสนองที่เป็นอันตรายลง 65-80...