OpenAI เสนอมาตรฐานความปลอดภัย AI ระดับโลก มุ่งวิจัย Alignment และความเสี่ยง RSI
เมื่อวันที่ 21 กันยายน OpenAI เผยแพร่ข้อเสนอแนะสำหรับมาตรฐานความปลอดภัยและความมั่นคงในการพัฒนา AI ขั้นสูง โดยเน้นการวิจัย alignment และเทคนิคการคำนวณที่เรียกว่า การพัฒนาตนเองแบบวนซ้ำ (Recursive Self-Improvement หรือ RSI)
บริษัทเรียกร้องความร่วมมือระหว่างประเทศเพื่อกำหนดมาตรฐาน AI ขั้นสูงบนพื้นฐานงานวิจัยความปลอดภัย AI ระดับโลกที่มีอยู่ มาตรฐานที่เสนอจะครอบคลุมนักพัฒนาระบบโมเดลขั้นสูง และกำหนดให้มีการบริหารความเสี่ยงสำหรับนักวิจัย AI อัตโนมัติ รวมถึง RSI
RSI ดึงความสนใจจากอุตสาหกรรม เนื่องจากอาจเปิดทางให้ระบบ AI อัปเกรดตัวเองได้โดยไม่ต้องมีมนุษย์ intervened OpenAI ระบุว่า RSI แบบอัตโนมัติเต็มรูปแบบยังไม่สามารถทำได้ในปัจจุบัน และไม่ควรเดินหน้าต่อ "เว้นแต่และจนกว่าจะทำได้อย่างปลอดภัย" พร้อมเตือนว่าหากขาดความระมัดระวังที่เพียงพอ มนุษย์อาจสูญเสียการควบคุมการพัฒนา AI ในทางปฏิบัติ และการกำกับดูแลกระบวนการวิจัยที่พวกเขาไม่สามารถเข้าใจได้อีกต่อไป
บทความยังอ้างถึงเหตุการณ์การบุกรุก Hugging Face โดย AI agent เป็นตัวอย่างความเสี่ยงที่อาจรุนแรงขึ้นหากไม่มีมาตรการป้องกันที่แข็งแกร่ง ขณะที่คู่แข่งอย่าง Anthropic เสนอกรอบความปลอดภัยสำหรับโมเดลขั้นสูงของตนเองเมื่อสัปดาห์ที่แล้ว และ CEO Dario Amodei เรียกร้องให้บริษัท AI ชะลอการพัฒนาโมเดลพื้นฐาน พร้อมเสนอให้มีผู้ประเมินจากบุคคลที่สาม ซึ่งข้อเสนอดังกล่าวได้รับเสียงสนับสนุนจาก CEO OpenAI Sam Altman และคนอื่นๆ อย่างเปิดเผย