OpenAI กังวลความมั่นคงปลอดภัย หยุดฝึก AI บางส่วน

OpenAI ได้ระงับภาระงานฝึกฝนปัญญาประดิษฐ์บางส่วนเมื่อเร็ว ๆ นี้ เนื่องจากความกังวลว่าอาจก่อให้เกิดปัญหาด้านความมั่นคงปลอดภัย

Credit: OpenAI

ผู้พัฒนา ChatGPT ได้เปิดเผยความเคลื่อนไหวดังกล่าวผ่านบล็อกโพสต์ โดยบริษัทระบุว่าการระงับครั้งนี้เป็นส่วนหนึ่งของความคิดริเริ่มในวงกว้างที่ออกแบบมาเพื่อยกระดับแนวทางการป้องกันด้านความมั่นคงปลอดภัย นอกจากนี้ โครงการดังกล่าวยังรวมถึงการที่ OpenAI จะนำกลไกการติดตามตรวจสอบโมเดลแบบใหม่มาใช้งานด้วย

บริษัทได้เปิดตัวความคิดริเริ่มนี้เพื่อตอบสนองต่อเหตุการณ์ที่เกิดขึ้นเมื่อไม่นานมานี้สองประการ ประการแรกคือเหตุการณ์ในเดือนกรกฎาคมที่โมเดล AI จำนวนหนึ่งของบริษัทได้ทำการเจาะระบบ Hugging Face ประการที่สองเกี่ยวข้องกับ Astra ซึ่งเป็นอัลกอริทึมที่ยังไม่ได้เปิดตัวของ OpenAI ที่มีความสามารถเหนือกว่า GPT-5.6 Sol

ตามข้อมูลของบริษัท นักวิจัยได้ข้อสรุปเมื่อเร็ว ๆ นี้ว่า Astra เข้าข่ายเป็นความเสี่ยงระดับวิกฤตด้านความมั่นคงปลอดภัยภายใต้กรอบการเตรียมความพร้อม (Preparedness Framework) ของบริษัท ซึ่งกรอบดังกล่าวเป็นเอกสารความยาว 22 หน้าที่ระบุถึงความท้าทายด้านความปลอดภัยของ AI โดยนิยามความเสี่ยงระดับวิกฤตด้านความมั่นคงปลอดภัยว่าเป็นโมเดลที่สามารถค้นหาและใช้ประโยชน์จากช่องโหว่ประเภทซีโร่เดย์ในระบบที่ได้รับการป้องกันอย่างแน่นหนาได้โดยไม่ต้องอาศัยความช่วยเหลือจากมนุษย์

OpenAI ตอบสนองต่อการค้นพบนี้ด้วยการระงับภาระงานด้านการเรียนรู้แบบเสริมกำลัง (RL) บางส่วนเป็นเวลาสองสัปดาห์ โดย RL เป็นวิธีการฝึกฝน AI ที่ใช้ในการขัดเกลาทักษะการใช้เหตุผลของโมเดลภาษาขนาดใหญ่ ทั้งนี้ OpenAI ระบุว่าการรัน RL ระดับแนวหน้าที่ใหญ่ที่สุดตามแผนที่นักวิจัยกำลังดำเนินการอยู่นั้นยังคงถูกระงับไว้ก่อน

บริษัทยังได้ปรับปรุงแนวทางการติดตามตรวจสอบ AI ของตนเอง โดยอัลกอริทึมที่เรียกว่า Activation Classifiers จะทำการตรวจสอบกระบวนการคิดภายในและการโต้ตอบกับเครื่องมือต่าง ๆ ของ LLM เป็นประจำเพื่อหาข้อบ่งชี้ของกิจกรรมที่มุ่งร้าย เมื่อพบความผิดปกติ อัลกอริทึมจะส่งต่อสิ่งที่ค้นพบไปยังชุด Activation Classifiers ชุดที่สองที่มีความซับซ้อนกว่า ซึ่งอัลกอริทึมเหล่านี้จะแจ้งเตือนไปยังนักวิจัยของ OpenAI ต่อไป

บริษัทกล่าวว่ามีเป้าหมายที่จะสร้างการแจ้งเตือนสำหรับพฤติกรรม AI ที่น่าสงสัยภายใน 30 นาที และได้สั่งการให้พนักงานทำการระงับพฤติกรรมดังกล่าวภายใน 30 นาที หากไม่สามารถสรุปผลได้อย่างชัดเจนว่าพฤติกรรมนั้นไม่ใช่การกระทำที่เป็นอันตราย

เวิร์กโฟลว์การติดตามตรวจสอบแบบใหม่ของบริษัทต้องใช้ฮาร์ดแวร์จำนวนมาก ในปัจจุบันภาระงานส่วนเกินดังกล่าวคิดเป็นประมาณร้อยละ 20 ของโครงสร้างพื้นฐานที่จัดสรรไว้สำหรับภาระงานด้านอินเฟอเรนซ์ที่ถูกตรวจสอบ ซึ่งอาจทำให้ OpenAI จำเป็นต้องปรับราคาขึ้นในระยะยาว

บริษัทกำลังจับคู่กลไกการติดตามตรวจสอบแบบใหม่เข้ากับมาตรการด้านความมั่นคงปลอดภัยอื่น ๆ โดย OpenAI ได้จำกัดสิทธิ์การเข้าถึงระบบบางประการและลบแอปพลิเคชันภายในออกไปจำนวนหนึ่ง นอกจากนี้ยังได้ปรับปรุงระบบป้องกันที่แยกเวิร์กโฟลว์ AI ที่มีความเสี่ยงสูงสุดออกจากเครือข่ายอินเทอร์เน็ต

ในอนาคต บริษัทมีแผนที่จะทำให้ความพยายามด้านความมั่นคงปลอดภัยเป็นอัตโนมัติมากขึ้น โดยจะใช้โมเดล AI ในการสแกนสภาพแวดล้อมการวิจัย LLM เพื่อหาจุดอ่อน นอกจากนี้ OpenAI จะปรับปรุงโมเดลการให้รางวัลซึ่งเป็นอัลกอริทึมที่ช่วยเพิ่มประสิทธิภาพในการฝึกฝน RL โดยการปรับปรุงดังกล่าวจะมุ่งเน้นไปที่การยับยั้งไม่ให้ LLM ทำการโจมตีทางไซเบอร์

ที่มา: https://siliconangle.com/2026/08/18/openai-paused-some-ai-training-runs-over-cybersecurity-concerns/

About นักเขียนฝึกหัดหมายเลขเก้า

Check Also

Cerebras เปิดตัว CS-4 AI Accelerator ทำความเร็วเหนือกว่า GPU ถึง 30 เท่า

Cerebras เปิดตัว Cerebras CS-4 ตัว AI Accelerator ตัว Rack-scale ที่ใช้ Wafer Scale Engine 3 Turbo …

Commvault ขยาย Cloud Rewind ครอบคลุม Azure เพิ่ม พร้อมกู้คืนทั้งสภาพแวดล้อม ไม่ใช่แค่ข้อมูล

Commvault เตรียมขยายขอบเขตการปกป้องและกู้คืน Configuration ของ Microsoft Azure บน Cloud Rewind ให้กว้างขึ้น 3 เท่า เพื่อให้องค์กรกู้คืนแอปพลิเคชันบนคลาวด์พร้อม Cloud Resource …