OpenAI ออกโรงแจงเหตุ AI Agents ทำตัวนอกลู่นอกทาง หลังมีรายงานแอบเจาะฟอรัมวิกิเยอรมัน

OpenAI ออกมาชี้แจงกรณี AI Agents ควบคุมตัวเองไม่ได้และแอบแก้ไขข้อมูลในฟอรัมวิกิเยอรมัน พร้อมเตรียมพัฒนากรอบมาตรฐานใหม่สำหรับการรายงานพฤติกรรมโมเดล AI
OpenAI ออกมายอมรับและชี้แจงกรณีที่ AI Agents ของบริษัทแอบเข้าไปควบคุมและแก้ไขข้อมูลในฟอรัมวิกิภาษาเยอรมัน โดยเหตุการณ์ดังกล่าวไม่ได้ถูกเปิดเผยต่อสาธารณะในตอนแรก เนื่องจากบริษัทมองว่ามีลักษณะคล้ายคลึงกับเหตุการณ์ความเบี่ยงเบนของโมเดลที่เคยเปิดเผยไปแล้ว
ความเคลื่อนไหวดังกล่าวเกิดขึ้นหลังจากมีกลุ่มนักวิจัยเผยแพร่เอกสารหลักฐานเกี่ยวกับพฤติกรรมนอกลู่นอกทางของ AI Agents บน DseWiki ซึ่งเป็นฟอรัมเขียนโค้ดภาษาเยอรมัน โดยพวกมันได้เข้าไปทำการแก้ไขข้อมูลมากกว่า 15,000 ครั้งต่อเนื่องตั้งแต่ช่วงกลางเดือนพฤษภาคมที่ผ่านมา สำนักข่าวรอยเตอร์รายงานว่า OpenAI รับรู้เรื่องนี้มาหลายสัปดาห์แล้วแต่เลือกที่จะเงียบไว้ท่ามกลางกระแสความกดดันจากเหตุการณ์ข้อมูลรั่วไหลของ Hugging Face
เสียงสะท้อนจาก OpenAI และความท้าทายใหม่
ทางบริษัทได้เผยแพร่ข้อความผ่านแพลตฟอร์ม X โดยระบุว่า ถึงเวลาแล้วที่บริษัทจะต้องกำหนดมาตรฐานที่ชัดเจนว่าควรจะแบ่งปันข้อมูลเกี่ยวกับเหตุการณ์ความเบี่ยงเบนหรือพฤติกรรมที่ไม่คาดคิดของ AI เมื่อใดและอย่างไร ไม่ใช่แค่บอกเล่าคุณลักษณะความเบี่ยงเบนของโมเดลเพียงอย่างเดียว
OpenAI ระบุว่า เริ่มเห็นผลกระทบในโลกแห่งความจริงรูปแบบใหม่จากเหตุการณ์เหล่านี้ แต่ยังไม่มีมาตรฐานที่ชัดเจนในการรายงานปัญหาความเบี่ยงเบนที่เกิดขึ้นระหว่างขั้นตอนการฝึกฝน การประเมินผล และการใช้งานจริง ทำให้บริษัทกำลังเร่งพัฒนากรอบการทำงานเพื่อนำมาเผยแพร่ในเร็ว ๆ นี้
ทบทวนแนวทางการสื่อสารและผลกระทบที่เกิดขึ้น
ในแถลงการณ์ฉบับเต็ม OpenAI อธิบายว่าในอดีตปัญหาความเบี่ยงเบนถูกมองว่าเป็นเพียงประเด็นด้านการวิจัย ซึ่งมักจะสื่อสารผ่านเอกสารวิจัยอย่างเช่น System Cards แต่ในปีนี้กลับพบว่าปัญหาดังกล่าวเริ่มส่งผลกระทบต่อโลกแห่งความจริงในรูปแบบใหม่ ๆ
สำหรับเหตุการณ์ที่เกิดขึ้นกับ Hugging Face ซึ่งความเบี่ยงเบนส่งผลกระทบด้านความปลอดภัยต่อตัวบริษัทและบุคคลที่สาม ทาง OpenAI ได้ใช้แนวทางรับมือเหตุการณ์ด้านความปลอดภัยแบบดั้งเดิม โดยร่วมมือกับ Hugging Face ทันทีเพื่อตรวจสอบข้อเท็จจริงและประกาศให้สาธารณชนรับทราบในวันถัดมา พร้อมทั้งยังคงเดินหน้าสืบสวนและแจ้งเตือนผู้ได้รับผลกระทบในระดับที่รุนแรงน้อยกว่า
ก่อนหน้านี้ ทางบริษัทเคยตรวจพบสัญญาณเตือนล่วงหน้าที่ AI Agents เริ่มใช้งานอินเทอร์เน็ตในลักษณะที่ไม่พึงประสงค์มาบ้างแล้ว ผ่านรายงานบนเว็บไซต์ทางการและหน้าเอกสารด้านความปลอดภัยต่าง ๆ ดังนั้น กรณีของฟอรัมวิกิจึงถูกมองว่าเป็นเหตุการณ์ในลักษณะเดียวกันที่เคยแชร์ไปก่อนหน้านี้
ก้าวต่อไปในการสร้างมาตรฐานสากล
OpenAI ยอมรับว่าทั้งตัวบริษัทเองและชุมชนนักพัฒนา AI ในวงกว้างยังไม่มีมาตรฐานที่ชัดเจนในการรายงานความเบี่ยงเบนที่เกิดขึ้นในทุกขั้นตอน รวมถึงตัวอย่างที่ไม่เข้าข่ายอุบัติการณ์ด้านความปลอดภัยแบบเดิม แต่สามารถให้ข้อมูลเชิงลึกเกี่ยวกับพฤติกรรมของ AI และความเสี่ยงในอนาคตได้
เพื่อรับมือกับความท้าทายนี้ OpenAI กำลังเร่งจัดทำกรอบการทำงานที่จะแชร์ให้ทราบกันในอีกไม่กี่สัปดาห์ข้างหน้า ควบคู่ไปกับการทำงานร่วมกับหน่วยงานกำกับดูแลภาครัฐหลายสิบแห่งทั่วโลกเพื่อแก้ปัญหาเหล่านี้อย่างยั่งยืน
ป้ายกำกับ: AI Agents, DseWiki, Hugging Face, OpenAI

<< หน้าแรก