โอเพนเอไอเผยเหตุการณ์ AI ปกปิดข้อมูล-เลี่ยงข้อจำกัด พร้อมเปิดกรอบติดตามใหม่

Product / TechRegulation Impact 4
โดย InfoQuest·US·อ่านต้นฉบับ
สรุป · ทำไมข่าวนี้ถึงสำคัญ

โอเพนเอไอ (OpenAI) เปิดเผยเหตุการณ์ที่ยังไม่เคยรายงานต่อสาธารณะ กรณีโมเดลปัญญาประดิษฐ์ (AI) แสดงพฤติกรรมไม่สอดคล้องกับเป้าหมายของมนุษย์ พร้อมเปิดตัวกรอบการทำงานใหม่สำหรับติดตามและเปิดเผยเหตุการณ์ลักษณะดังกล่าวในอนาคต บริษัทระบุในบล็อกโพสต์เมื่อวันพุธ (16 ก.ย.) ว่า เหตุการณ์ที่เพิ่งเปิดเผยมีทั้งกรณีที่ AI ปกปิดและสร้างข้อมูลขึ้นมาเองเพื่อให้ได้ผลลัพธ์ตามต้องการ พยายามหลีกเลี่ยงข้อจำกัดของเครือข่าย และกรณีที่ AI Agent ส่งไฟล์ให้กันเอง ทั้งที่ไฟล์ดังกล่าวควรเก็บเป็นความลับ โดยพฤติกรรมเหล่านี้เกิดขึ้นระหว่างที่โมเดลพยายามทำภารกิจให้สำเร็จหรือผ่านการประเมิน อย่างไรก็ตาม โอเพนเอไอระบุในแถลงการณ์อีกฉบับว่า เหตุการณ์ที่เปิดเผยครั้งใหม่นี้ไม่มีกรณีใดเกี่ยวข้องกับการแฮ็กหรือเจาะระบบของบุคคลที่สาม บริษัทเรียกพฤติกรรมดังกล่าวว่า “misalignment” ซึ่งหมายถึงการที่ AI ทำงานไม่สอดคล้องกับเป้าหมายของมนุษย์ และยังเปิดช่องทางให้พนักงานรายงานกรณีลักษณะเดียวกัน พร้อมจัดทำระบบสำหรับคัดกรองเหตุการณ์ที่ได้รับรายงาน โอเพนเอไอย้ำว่า รายงานชุดล่าสุดเป็นเพียงข้อมูลที่เปิดเผยในระยะแรก และไม่ได้ครอบคลุมปัญหาทั้งหมดที่อาจเกิดขึ้นกับโมเดล AI ของบริษัท โดยระบุว่า “เราไม่เชื่อว่าอุตสาหกรรม AI สามารถแก้ปัญหาการควบคุมให้ AI ทำงานสอดคล้องกับเป้าหมายของมนุษย์และติดตามพฤติกรรมของ AI ได้ดีเพียงพอที่จะเดินหน้าพัฒนาเทคโนโลยีอย่างรวดเร็วที่สุดต่อไปได้อย่างมีความรับผิดชอบ” ทั้งนี้ โอเพนเอไอเผชิญการตรวจสอบเพิ่มขึ้น หลังบริษัทเปิดเผยเมื่อเดือนก.ค.ว่า โมเดล AI ขั้นสูงบางรุ่นสามารถเจาะระบบของบริษัทซอฟต์แวร์ภายนอกอย่าง ฮักกิงเฟซ (Hugging Face) ได้ ท่ามกลางหลายกรณีที่โมเดล AI ที่พัฒนาโดยโอเพนเอไอ (OpenAI), แอนโทรปิก (Anthropic) และเมตา (Meta) ถูกนำไปใช้ในการโจมตีระบบออนไลน์ ขณะที่ประเด็นความเสี่ยงจาก AI กลับมาได้รับความสนใจอย่างมากในช่วงสัปดาห์ที่ผ่านมา หลัง เจคอบ ค็อกซัน อดีตนักวิจัยแอนโทรปิกประกาศลาออก พร้อมวิจารณ์บริษัทว่า “กำลังเอาชีวิตของเราไปเสี่ยง” ในโพสต์ประกาศลาออกที่เผยแพร่บนโซเชียลมีเดีย

ผลกระทบต่อหุ้น 1

Artificial Intelligence · 1 หุ้น

ผลกระทบต่อธีม 3

บริษัทนอก coverage 1

OpenAIเอกชน▼ ลบ
กฎเกณฑ์ความเกี่ยวข้อง

OpenAI disclosed misalignment incidents and faces increased scrutiny over AI risk, prompting its own tracking framework and reporting channel.

ข่าวที่เกี่ยวข้อง

impact 4

ผู้ว่าการรัฐแคลิฟอร์เนียพิจารณาบังคับใช้ "สวิตช์ปิดระบบ" สำหรับ AI

นายกาวิน นิวซัม ผู้ว่าการรัฐแคลิฟอร์เนียทางตะวันตกของสหรัฐฯ สังกัดพรรคเดโมแครต ออกคำสั่งฝ่ายบริหารเมื่อวันที่ 18 เพื่อเสริมการกำกับดูแลบริษัทที่พัฒนา ปัญญาประดิษฐ์ หรือ AI โดยสั่งให้พิจารณาการบังคับให้บริษัทผู้พัฒนาติดตั้ง "สวิตช์ปิดระบบ" ที่สามารถสั่งหยุดการทำงานของ AI ได้ทันทีเมื่อ AI หลุดการควบคุม คำสั่งดังกล่าวมีขึ้นหลังเกิดปัญหาที่ตัวแทน AI แบบอัตโนมัติของโอเพนเอไอสหรัฐฯ หลุดการควบคุมและโจมตีไซเบอร์บริษัทอีกรายหนึ่ง นอกจากนี้ยังสั่งให้พิจารณาการจัดตั้งหน่วยตรวจสอบอิสระภายในบริษัทผู้พัฒนา และการตรวจสอบเป็นประจำด้วย คณะผู้เชี่ยวชาญจะเดินหน้าหารือและเสนอแนวทางต่อผู้ว่าการรัฐภายใน 2 เดือนเพื่อจัดทำกฎหมายระดับรัฐต่อไป นายนิวซัมกล่าวในแถลงการณ์ว่า "เราจะเร่งความพยายามในการกำกับดูแล AI อย่างมีความรับผิดชอบก่อนที่จะสายเกินไป" รัฐแคลิฟอร์เนียเป็นที่ตั้งสำนักงานใหญ่ของโอเพนเอไอและบริษัทแอนโทรปิก ซึ่งเป็นบริษัท AI ของสหรัฐฯ แนวโน้มการกำกับดูแลจึงมีแนวโน้มส่งผลกระทบต่อทั้งอุตสาหกรรม
3

AI "เจมินี" ของกูเกิลก่อไซเบอร์แอตแทกเจาะระบบบริษัทอื่น สำเร็จ 3 ราย

สื่อสหรัฐหลายสำนักรายงานเมื่อวันที่ 18 ว่า โมเดลปัญญาประดิษฐ์ "เจมินี" ที่กูเกิลของสหรัฐพัฒนาขึ้นเกิด "อาละวาด" เมื่อเดือนพฤษภาคมปีนี้ และก่อไซเบอร์แอตแทกเจาะระบบบริษัทอื่น ตามรายงานของหนังสือพิมพ์วอลล์สตรีทเจอร์นัลของสหรัฐ บริษัทที่ถูกโจมตีมี 3 ราย เจมินีถูกมอบหมายโจทย์ให้ดึงข้อมูลจากซอฟต์แวร์ของบริษัทสมมติในระหว่างการประเมินสมรรถนะด้านความมั่นคงปลอดภัยไซเบอร์โดยบริษัทภายนอก แต่เนื่องจากระบบเชื่อมต่อกับอินเทอร์เน็ตโดยไม่ตั้งใจ จึงทำให้เจมินีคาดเดารหัสผ่านและเจาะเข้าระบบของบริษัทจริงที่มีชื่อเดียวกับโจทย์ดังกล่าว ในทุกกรณี AI ตระหนักว่ากำลังเจาะเข้าระบบของบริษัทจริงและยุติการโจมตี รายงานระบุว่า ในบรรดาบริษัทพัฒนา AI ของสหรัฐ พบว่าเกิดเหตุอาละวาดขึ้นเช่นกันที่โอเพนเอไอ ซึ่งเป็นเจ้าของ AI สนทนา "แชตจีพีที" และบริษัทอื่น ๆ ด้วย
2

แอนโทรปิกจับมือแอคเซนเจอร์ประเมินความปลอดภัย AI 5 ปี ฝ่ายละ 1 พันล้านดอลลาร์

บริษัทผู้พัฒนาเทคโนโลยีปัญญาประดิษฐ์แอนโทรปิกประกาศเมื่อวันที่ 18 ว่าบริษัทได้จับมือกับแอคเซนเจอร์ บริษัทที่ปรึกษารายใหญ่ เพื่อดำเนินการประเมินโมเดล AI ชั้นนำของบริษัทอย่างเป็นอิสระ ทั้งสองบริษัทจะลงทุนฝ่ายละอย่างน้อย 1 พันล้านดอลลาร์ในช่วง 5 ปีข้างหน้า เพื่อใช้ในการสร้างระบบการประเมิน หน่วยงานด้าน AI เฉพาะทางของแอคเซนเจอร์จะเป็นผู้นำความร่วมมือครั้งนี้ โดยจะทำการประเมินโมเดลของแอนโทรปิก การทดสอบแบบเรดทีม การประเมินด้านการจัดแนวพฤติกรรม และการตรวจสอบมาตรการความปลอดภัยของโมเดล การลงทุนของทั้งสองบริษัทจะสนับสนุนแนวทางที่เรียกว่าการประเมินแบบฝังตัว ซึ่งผู้ประเมินอิสระทำงานภายในบริษัท AI โดยมีสิทธิ์เข้าถึงใกล้เคียงกับพนักงาน แอนโทรปิกอธิบายว่าผู้ประเมินแบบฝังตัวสามารถประเมินวิธีดำเนินงานของบริษัท ตรวจสอบว่าคำมั่นด้านความปลอดภัยได้รับการปฏิบัติตามหรือไม่ และระบุจุดบอดได้ ทั้งสองบริษัทมีแผนจะร่วมมือในลักษณะเดียวกันกับหน่วยงานประเมินอื่นและบริษัทผู้พัฒนา AI รายอื่นด้วย