หน้าแรก Artificial Intelligence เมื่อ AI กลายเป็นผู้ช่วยแฮกเกอร์: กรณีศึกษา Claude ช่วยเจาะระบบ OpenAI

เมื่อ AI กลายเป็นผู้ช่วยแฮกเกอร์: กรณีศึกษา Claude ช่วยเจาะระบบ OpenAI

เกิดเหตุการณ์ความปลอดภัยไซเบอร์ครั้งสำคัญเมื่อกลุ่มนักล่าบั๊ก (Bug Hunters) จากทีม Hacktron ได้ใช้โมเดลปัญญาประดิษฐ์ Claude ของ Anthropic ซึ่งเป็นคู่แข่งคนสำคัญ ช่วยในการเจาะระบบเข้าสู่บัญชี ChatGPT และ Codex ของพนักงาน OpenAI การโจมตีครั้งนี้แสดงให้เห็นถึงศักยภาพอันก้าวหน้าของ AI Agent ในการค้นหาและสร้างสคริปต์เพื่อโจมตีช่องโหว่ทางไซเบอร์ได้อย่างรวดเร็วอย่างที่ไม่เคยมีมาก่อน

ต้นเหตุของช่องโหว่เริ่มจากเว็บบอร์ดชุมชนของ OpenAI (community.openai.com) ที่รันบนระบบ Discourse ซึ่งมีจุดอ่อนในการประมวลผลไฟล์ภาพประเภท HEIF ระบบได้ส่งต่อไฟล์ดังกล่าวไปยังไลบรารี libheif จนเปิดช่องให้ผู้โจมตีเข้าถึงตัววิเคราะห์ไฟล์ได้โดยตรง นักวิจัยใช้ AI รุ่น Claude Opus ในการวิเคราะห์จนพบช่องโหว่แบบ Heap Buffer Overflow และเมื่ออัปเกรดมาใช้โมเดลรุ่นใหม่อย่าง Claude Opus 5 ก็สามารถสร้างสคริปต์โจมตีเพื่อสั่งรันโค้ดระยะไกล (Remote Code Execution – RCE) บนระบบได้สำเร็จ

เมื่อยึดระบบขั้นแรกได้แล้ว ทีมงานได้ขยายผลเข้ายึดบัญชีของพนักงาน OpenAI ที่มีการเชื่อมต่อกับระบบ Codex และ GitHub ขององค์กร เพื่อพิสูจน์ผลกระทบโดยไม่แตะต้องโค้ดลับภายใน นักวิจัยจึงสั่งให้ Codex เปิด Pull Request ในคลังโค้ดหลัก (Internal Monorepo) ของ OpenAI ซึ่งเป็นการยืนยันว่าหากเป็นแฮกเกอร์สายมืด ก็จะสามารถเข้าถึงข้อมูลความลับอันมหาศาล ทั้งใน GitHub, Slack และอีเมลองค์กรได้อย่างง่ายดาย

กระบวนการทั้งหมดตั้งแต่การค้นพบช่องโหว่ไปจนถึงการเข้าถึงคลังโค้ดใช้เวลาไม่ถึง 72 ชั่วโมง โดยใช้การทำงานของมนุษย์เพียงไม่กี่ชั่วโมงร่วมกับเอเจนต์ AI หลังจากการรายงาน ช่องโหว่ดังกล่าวถูกแก้ไขอย่างรวดเร็วภายใน 14 ชั่วโมง และ OpenAI ได้มอบเงินรางวัล $6,500 ผ่านโครงการ Bug Bounty ให้แก่ทีมวิจัย ซึ่งเป็นการให้รางวัลในส่วนของการพบช่องโหว่เชื่อมโยงทางฝั่ง OpenAI แม้ว่าการทดสอบบนเว็บบอร์ด Discourse จะอยู่นอกเหนือขอบเขตโครงการก็ตาม

เหตุการณ์นี้สะท้อนให้เห็นถึงจุดหักมุมอันน่าทึ่งในโลกเทคโนโลยี ที่ AI ของบริษัทคู่แข่งกลายเป็นเครื่องมือในการเจาะระบบของยักษ์ใหญ่ด้าน AI อีกแห่งหนึ่ง ในขณะเดียวกัน Discourse ก็ได้ออกแพตช์ความปลอดภัยและเพิ่มระบบ Sandboxing เพื่อป้องกันการประมวลผลรูปภาพแล้ว แต่นี่เป็นสัญญาณเตือนสำคัญว่า โมเดล AI ระดับสูงในปัจจุบันเริ่มมีความสามารถในการแฮกและวิเคราะห์การโจมตีได้ด้วยตัวเอง

ที่มา : Theregister