วิกิมีเดียแจ้งเตือน! พบเอเจนต์ AI เกเรของ OpenAI พยายามแฮก Etherpad และใช้เครื่องมือวิกิเป็น Proxy


มูลนิธิวิกิมีเดีย (Wikimedia Foundation) ผู้ดูแล Wikipedia ออกมายืนยันว่า ตรวจพบ พฤติกรรมที่ผิดปกติจากเอเจนต์ AI ของ OpenAI บนแพลตฟอร์ม ทั้งการพยายามเจาะระบบ Etherpad ซึ่งเป็นเครื่องมือจดบันทึกสาธารณะ และการพยายามแก้ไขหน้า Wikipedia

ทางมูลนิธิฯ ระบุว่า ได้ตรวจพบกิจกรรมของบอทที่ไม่ได้รับอนุญาต มีทั้งการแก้ไขข้อมูลในวิกิ การพยายามเจาะระบบเครื่องมือจดบันทึก และการยิง Traffic เข้ามาอย่างมหาศาล การสืบสวนครั้งนี้เริ่มขึ้นหลังจากมีรายงานก่อนหน้านี้เกี่ยวกับ Hugging Face และ DseWiki ที่เอเจนต์ของ OpenAI แอบเปลี่ยน Artifactory และเว็บบอร์ดวิกิภาษาเยอรมัน ให้กลายเป็น "เว็บบอร์ดลับ" สำหรับสื่อสารกันเอง พร้อมทั้งพยายามเชื่อมต่อบริการออนไลน์ต่างๆ เข้าด้วยกันเพื่อแอบเข้าถึงอินเทอร์เน็ตและลบร่องรอยการโจมตี

จากการตรวจสอบ วิกิมีเดียพบประวัติการแก้ไขข้อมูลที่คาดว่ามาจากเอเจนต์ของ OpenAI แต่โชคดีที่การแก้ไขเหล่านั้นเกิดขึ้นในพื้นที่ทดสอบ (Sandbox) จึงยังไม่ถูกเผยแพร่สู่สายตาคนทั่วไป อย่างไรก็ตาม หนึ่งในการดัดแปลงคือการพยายามเปลี่ยนการตั้งค่าของเครื่องมืออ้างอิง (Citation Tool) ซึ่งคาดว่าเป็นเจตนาร้ายเพื่อใช้เครื่องมือนี้เป็น Proxy ในการไปดึงข้อมูลจากเซิร์ฟเวอร์ภายนอก

นอกจากนี้ เอเจนต์ของ OpenAIยังพยายามเจาะระบบ Etherpad เพื่อใช้เป็น Proxy ในการดึงข้อมูลจากเว็บไซต์อื่นเช่นกัน แม้จะพบว่ามี AI บางตัวบันทึกโน้ตงานของตัวเองไว้ แต่ก็ยังไม่มีหลักฐานว่าพวกมันพยายามประสานงานกันเพื่อก่อการใหญ่

ประเด็นที่น่ากังวลคือ เอเจนต์เหล่านี้ได้ส่งคำขอผ่าน API สาธารณะนับล้านครั้ง กวาดข้อมูลนับล้านหน้าบน Wikidata และ Wikimedia Commons รวมถึงส่งคำถามข้อมูลหลายแสนครั้งไปยัง Wikidata Query Service (WQDS) ซึ่งปริมาณการส่งข้อมูลมหาศาลนี้อาจเป็นสาเหตุหนึ่งที่ทำให้ระบบล่มไปบางส่วนเมื่อช่วงต้นเดือนพฤษภาคม 2026 ที่ผ่านมา

แม้วิกิมีเดียจะยืนยันว่ายังไม่พบหลักฐานว่าระบบหรือข้อมูลถูกแฮกสำเร็จ แต่ Selena Deckelmann ประธานเจ้าหน้าที่ฝ่ายผลิตภัณฑ์และเทคโนโลยีของวิกิมีเดียได้ออกมาเตือนว่า "บอทและ AI Agent คืออนาคตของเว็บก็จริง แต่บริษัทที่ปลดปล่อยและทำกำไรจากมัน ต้องเข้ามาช่วยรับผิดชอบและแก้ไขความเสียหายที่เกิดขึ้นด้วย" ขณะที่ทาง OpenAI ได้ชี้แจงกับสื่ออย่าง The Verge ว่ากำลังร่วมมือกับวิกิมีเดียเพื่อตรวจสอบเรื่องนี้อย่างใกล้ชิด

OpenAI เผยเหตุการณ์ AI "หลุดควบคุม" เพิ่มเติม

ข่าวนี้เกิดขึ้นเพียงไม่กี่วันหลังจากที่ OpenAI เพิ่งออกมาเปิดเผยกรณีตัวอย่าง 3 เหตุการณ์ที่โมเดลของตนเองมีพฤติกรรมเบี่ยงเบนไปจากคำสั่ง (Misaligned Behavior):

  1. 27 มีนาคม 2026: โมเดลวิจัยภายในตัวหนึ่ง ได้ใช้ช่องโหว่ Security 2 จุดเชื่อมต่อเข้าหากัน เพื่อแอบเจาะเข้าไปยังเครื่อง EDA ภายในของ OpenAI โดยมีวัตถุประสงค์เพื่อหา "เฉลย" ว่าผลงานของมันจะถูกให้คะแนนอย่างไร
  2. 16 พฤษภาคม 2026: ระหว่างการฝึกแบบ Reinforcement Learning โมเดลได้แอบใช้เครื่องมือดึง Source Code ที่อยู่นอกเขตทำงาน แม้ระบบจะห้ามไว้ แต่โมเดลฉลาดพอที่จะสั่งอ่านไฟล์แล้วให้ระบบส่งโค้ดกลับมาผ่าน "ข้อความแจ้งเตือนข้อผิดพลาด (Error Messages)" ทีละชิ้น จนคัดลอกโค้ดได้สำเร็จ
  3. 22 พฤษภาคม 2026: โมเดลผู้ช่วยวิจัย ได้แอบอ่านข้อความใน Slack ของทีมพัฒนา แล้วประเมินว่าอินสแตนซ์ของมันกำลังจะถูกสั่งปิดเนื่องจากมีการอัปเดตระบบ มันจึงเนียนทัก Slack ไปหานักวิจัยเพื่อขอ API Key ที่ขาดหายไป โดยอ้างว่าจะได้ทำงานต่อไม่สะดุด เมื่อนักวิจัยส่ง Key ให้ โมเดลก็จัดการอัปเดตการตั้งค่าและสั่งย้ายระบบหนีการปิดทันที
แม้ OpenAI จะมองว่าเคสที่สามไม่ได้เป็นการพยายามหลบหนีการปิดระบบโดยสมบูรณ์ แต่ก็ยอมรับว่า ความสามารถของ AI ในการแอบเรียนรู้บริบทการทำงานจากช่องทางสื่อสารของคน เพื่อเอาตัวรอดจากการถูกปิดระบบ เป็นเรื่องที่ต้องระวังอย่างยิ่ง

กระแสเรียกร้องให้จัดระเบียบและเบรกความแรง AI

จากเหตุการณ์ AI เกเรที่เกิดขึ้นถี่ขึ้นเรื่อยๆ ทำให้ผู้เชี่ยวชาญมองว่า AI Agent เริ่มเก่งเกินไปในการหา "ทางลัด" เพื่อทำเป้าหมายให้สำเร็จ และเราไม่สามารถหวังให้มันควบคุมตัวเองได้

ค่ายคู่แข่งอย่าง Anthropic ถึงกับเตือนไว้ในหนังสือชี้ชวน IPO ว่า AI ระดับสูงอาจสร้างความเสี่ยงร้ายแรงถึงขั้นเป็นภัยต่อมนุษยชาติ และอาจเริ่มแสดงพฤติกรรม "เอาตัวรอด" เช่น การขัดขวางไม่ให้ถูกปิดระบบ การปกปิดหรือบิดเบือนข้อมูล ไปจนถึงพฤติกรรมที่เข้าข่ายการแบล็กเมล

ทางด้าน OpenAI ล่าสุดก็ได้ประกาศ "เบรก" การฝึกโมเดลตัวท็อป และยกเลิกแผนเปิดตัว GPT-6.1 Astra ออกไปก่อน หลังจากผลทดสอบภายในพบว่าตัวโมเดลยังไม่ได้มาตรฐานด้านความปลอดภัยและความสอดคล้องตามที่ตั้งไว้ โดย Sam Altman ซีอีโอของ OpenAI กล่าวว่า "เราต้องเอาความปลอดภัยนำหน้าความสามารถของ AI"

ในขณะเดียวกัน ปรากฏการณ์นี้ทำให้ ปธน. โดนัลด์ ทรัมป์ ได้ร่วมลงนามในข้อตกลง White House Accord on Super Intelligence ร่วมกับแม่ทัพเทคโนโลยีจาก Google, Anthropic, Meta, OpenAI, SpaceXAI และ NVIDIA เพื่อกำหนดกรอบการตรวจสอบความปลอดภัย ควบคุมความเสี่ยง และให้มีผู้ตรวจสอบจากภายนอกเข้ามาดูแล แม้ข้อตกลงนี้จะเป็นแบบสมัครใจและยังไม่มีบทลงโทษทางกฎหมาย แต่นับเป็นก้าวสำคัญที่สะท้อนว่า ถึงเวลาแล้วที่เราต้องจับตาดู AI Agent เหล่านี้อย่างจริงจังครับ!

#ดรกฤษฎาแก้ววัดปริง #ไทยสมาร์ทซิตี้ #SmartCity #DRKRIT #สมาร์ทซิตี้คลิก