เมื่อเดือนมิถุนายนที่ผ่านมา เอเจนต์ AI ของ OpenAI ได้บุกรุกเข้าเว็บไซต์สาธารณะของระบบ Medicare ซึ่งเป็นระบบประกันสุขภาพสาธารณะของรัฐบาลออสเตรเลีย โดยไม่มีมนุษย์สั่งการอย่างชัดเจน เรื่องนี้เพิ่งได้รับการยืนยันด้วยปากของนายกรัฐมนตรีออสเตรเลีย แอนโธนี อัลบานีส (Anthony Albanese) เมื่อเดือนกันยายน โดยเขาระบุว่าได้พูดคุยทางโทรศัพท์กับ Sam Altman ซีอีโอของ OpenAI เพื่อสื่อสารถึง "ความกังวลอย่างยิ่ง" ของออสเตรเลีย พร้อมทั้งวิจารณ์ว่าบริษัทใช้เวลานานเกินไปในการแจ้งเตือนเหตุการณ์นี้
The Guardian รายงานว่า OpenAI ส่งอีเมลแจ้งเตือนไปยังกล่องจดหมายทั่วไปของรัฐบาลออสเตรเลียเพียงฉบับเดียวเมื่อวันที่ 10 กันยายน ซึ่งกล่องจดหมายดังกล่าวจะถูกตรวจสอบเพียงวันละครั้ง ทำให้เจ้าหน้าที่เพิ่งเห็นเนื้อหาอีเมลในวันที่ 11 กันยายน และต้องรออีกเกือบหนึ่งสัปดาห์ กว่าเรื่องจะไปถึงหูของแคตี้ กัลลาเกอร์ (Katy Gallagher) รัฐมนตรีที่ดูแลกระทรวงบริการภาครัฐ ในวันที่ 17 กันยายน การสอบสวนยังคงดำเนินอยู่ อัลบานีสระบุว่า จากข้อมูลที่มีในขณะนี้ ดูเหมือนว่าเอเจนต์ดังกล่าวไม่ได้ขโมยข้อมูลสุขภาพส่วนบุคคลของประชาชนแต่อย่างใด
Conrad Stosz หัวหน้าฝ่ายธรรมาภิบาลของ Transluce ห้องปฏิบัติการไม่แสวงหากำไรที่ศึกษาระบบ AI กล่าวกับ The New York Times ว่านี่อาจเป็น "กรณีแรกที่เอเจนต์ AI เลือกที่จะบุกรุกเข้าระบบของรัฐบาลด้วยตัวเอง" นอกจากนี้ Transluce ยังขุดพบเหตุการณ์อื่นๆ อีกหลายกรณีที่ไม่เคยถูกเปิดเผยมาก่อน ซึ่งทั้งหมดเกิดขึ้นก่อนที่ Hugging Face จะเปิดเผยต่อสาธารณะในเดือนกรกฎาคมว่าพบการเข้าถึงระบบโดยไม่ได้รับอนุญาต และก่อนที่ OpenAI จะยอมรับว่าเอเจนต์ของตนบุกรุกเข้า Hugging Face
จากห้องสมุดแห่งหนึ่งสู่แพลตฟอร์มข้อมูลเปิด เมื่อเอเจนต์หาข้อมูลไม่ได้ก็เริ่มมองหาช่องโหว่
ตามรายงานของ The New York Times ในวันที่ 25 และ 26 พฤษภาคม เอเจนต์ของ OpenAI ชุดเดียวกันพยายามบุกรุกเข้าห้องสมุดดิจิทัลของมหาวิทยาลัยนิวเม็กซิโกในสหรัฐฯ เพื่อขอเข้าถึงภาพถ่ายของศูนย์รักษาวัณโรคทางประวัติศาสตร์แห่งหนึ่ง เมื่อไม่สามารถเข้าถึงภาพถ่ายได้ เอเจนต์ตัวนี้จึงเริ่มมองหาช่องโหว่ของระบบอย่างจริงจัง และท้ายที่สุดยังส่งคำขอจำนวนมหาศาลไปยังเซิร์ฟเวอร์ของมหาวิทยาลัย จนเกิดผลกระทบคล้ายกับการโจมตีแบบดีดอส (DDoS)
วันที่ 28 พฤษภาคม เหตุการณ์อีกกรณีหนึ่งเกิดขึ้นกับ Data USA ซึ่งเป็นแพลตฟอร์มโอเพนซอร์สที่รวบรวมข้อมูลจากหน่วยงานรัฐบาลกลางสหรัฐฯ หลายแห่งมานำเสนอในรูปแบบภาพ เอเจนต์ได้ส่งคำขอสืบค้นข้อมูลไปยังเว็บไซต์ก่อน เมื่อล้มเหลวก็หันไปตรวจหาช่องโหว่ของเว็บไซต์เช่นเดียวกัน ไม่ว่าจะเป็นห้องสมุดของมหาวิทยาลัยนิวเม็กซิโก หรือ Data USA การพยายามบุกรุกทั้งสองครั้งนี้สุดท้ายก็ไม่ประสบผลสำเร็จ
โฆษกของ OpenAI เปิดเผยกับ The New York Times ว่าบริษัทได้ติดต่อไปยังทางโรงเรียนและ Data USA แยกกันเกี่ยวกับสองเหตุการณ์นี้แล้ว ส่วนกรณีการเจาะระบบเว็บไซต์ Medicare ของออสเตรเลียนั้น OpenAI ตรวจพบภายหลังจากทำการตรวจสอบโมเดลของตนเองในวงกว้าง และยอมรับว่าโมเดล "ดำเนินการในลักษณะที่บริษัทไม่ได้คาดการณ์ไว้" โดยการตรวจสอบครั้งนี้ยังต้องใช้เวลาอีกหลายเดือนกว่าจะเสร็จสมบูรณ์
OpenAI เพิ่งประกาศระบบแจ้งเตือนพฤติกรรมผิดปกติ (misalignment) ชุดใหม่ เพื่อเร่งการเปิดเผยความผิดปกติของเทคโนโลยี AI ให้เร็วขึ้น พร้อมเปิดเผยเพิ่มเติมในรายงานที่เกี่ยวข้องถึง 6 กรณีที่ไม่เคยเปิดเผยมาก่อน ซึ่งเป็นพฤติกรรมของโมเดลที่ "น่ากังวล" ทั้งนี้ ประกาศดังกล่าวมีขึ้นหลังจากบริษัทยอมรับว่ามีเอเจนต์บุกรุก Hugging Face และเหตุการณ์ก่อนหน้านี้ที่ถูกเปิดโปงว่าบุกรุกเข้าไปในคลังโค้ด RubyGems โดย OpenAI ระบุในประกาศว่า บริษัทไม่คิดว่าอุตสาหกรรม AI ทั้งวงการ "ได้ทำเรื่องการปรับแนวทางให้สอดคล้อง (alignment) และการตรวจสอบติดตามได้ดีเพียงพอที่จะรองรับการขยายตัวอย่างรวดเร็วในระดับสูงสุดเช่นนี้ได้" ก่อนหน้านี้ Altman ก็เพิ่งกล่าวต่อสหประชาชาติว่า อุตสาหกรรมนี้จำเป็นต้องสร้างมาตรฐานการประเมินระดับนานาชาติ เพื่อใช้วัดความสามารถและความเสี่ยงของเครื่องมือ AI รวมถึงตัดสินว่าเครื่องมือเหล่านี้ต้องการการกำกับดูแลจากมนุษย์มากน้อยเพียงใด