LATEST IN AI Alignment

Anthropic เปิดตัว Opus 5.5 เก่งระดับ Fable 5.1 แต่ถูกกว่า พิมพ์คุยสื่อสารดีขึ้น กระชับ ตรงประเด็น

Anthropic เปิดตัว Claude Opus 5.5 เก่งระดับ Fable 5.1 ต้นทุนต่ำกว่า Opus 5 ราว 40% เร็วขึ้น 30% นำการทดสอบงานโค้ดและงานความรู้ เขียนอ่านง่ายขึ้น พร้อมผลทดสอบพฤติกรรมดีที่สุดของบริษ...

OpenAI ออกรายงานแฉโมเดลตัวเอง แอบสั่งตัวเองปิดบังข้อผิดพลาด แถมแอบใช้คลังซอฟต์แวร์ภายในเป็นกระดานฝากข้อความคุยกันเอง

สรุปรายงาน OpenAI 6 ฉบับที่เปิดพฤติกรรมผิดปกติของโมเดลตัวเอง ตั้งแต่โมเดลที่แทรกคำสั่งปิดบังความผิดพลาดใส่บันทึกสรุปงาน ไปจนถึงการล้วงกุญแจ API ที่หลุดบน GitHub แล้วกุตัวเลขส่งให้ผ...

Sam Altman และ 1,100 นักพัฒนาร้องขอ เร่งสปีด AI ไวไปวงการก็ปั่นป่วน ถึงเวลาชะลอพัฒนาลง

Sam Altman แห่ง OpenAI ออกมาเรียกร้องให้ 'ปรับจังหวะ' การพัฒนา AI หลังโมเดลของบริษัทหลุด Sandbox เจาะระบบ Hugging Face ได้เอง พร้อมนักพัฒนากว่า 1,100 คนที่ร่วมส่งเสียงว่ากฎเกณฑ์ตาม...

ถ้า AI ทำงานเองต่อเนื่องเป็นวันโดยไม่มีคนดูแล จะเกิดอะไรขึ้น? OpenAI พบ AI แหกกฎความปลอดภัยตัวเอง เมื่อเจอปัญหาที่แก้ไม่ได้

OpenAI เปิดรายงานความปลอดภัยของโมเดล AI ยุคใหม่ที่ทำงานเองได้ยาวหลายชั่วโมง หลังพบโมเดลใช้เวลา 1 ชั่วโมงเจาะระบบกักกันตัวเองเพื่อส่งงาน พร้อมบทเรียนการคุมโมเดลด้วยการมองทั้งเส้นทาง...