OpenAI เปิดเผยว่าหนึ่งในโมเดลภาษาขนาดใหญ่ที่ยังไม่ได้เปิดตัวของบริษัทอาจก่อให้เกิดความเสี่ยงด้านความมั่นคงปลอดภัยทางไซเบอร์อย่างมีนัยสำคัญ

อัลกอริทึมดังกล่าวซึ่งเป็นที่รู้จักในชื่อ Astra ได้รับการเปิดเผยรายละเอียดครั้งแรกเมื่อสัปดาห์ที่ผ่านมา โดย OpenAI ระบุในบล็อกโพสต์เมื่อวันอาทิตย์ว่าโมเดลภาษาขนาดใหญ่นี้สามารถแก้ไขโจทย์คณิตศาสตร์ที่ซับซ้อนมาอย่างยาวนานได้ 10 ข้อ ทั้งนี้บริษัทได้เผยแพร่บทพิสูจน์เหล่านั้นและเปิดเผยว่าแต่ละข้อต้องใช้โทเค็นมูลค่าประมาณ 2,000 ดอลลาร์ในการสร้างคำตอบ
ในฐานะส่วนหนึ่งของความพยายามด้านความปลอดภัยของปัญญาประดิษฐ์ OpenAI ได้เผยแพร่เอกสารจำนวน 29 หน้าที่เรียกว่า Preparedness Framework โดยหนึ่งในส่วนของเอกสารฉบับนี้ประกอบด้วยระบบการให้คะแนนความเสี่ยงของ AI ซึ่งระบบดังกล่าวจะจัดลำดับความเสี่ยงด้านความมั่นคงปลอดภัยทางไซเบอร์ที่เกิดจากโมเดลภาษาขนาดใหญ่ว่าอยู่ในระดับสูง (High) หรือวิกฤต (Critical) ขึ้นอยู่กับขีดความสามารถของโมเดลนั้น ๆ
โมเดล GPT-5.6 Sol ซึ่งเป็นรุ่นเรือธงของ OpenAI และอัลกอริทึมรุ่นก่อนหน้าบางตัวได้รับคะแนนในระดับ สูง ตามข้อมูลของบริษัท Astra เป็นโมเดลภาษาขนาดรุ่นแรกที่อาจเข้าข่ายการจัดประเภทในระดับวิกฤต โดยวิศวกรของบริษัทได้ข้อสรุปดังกล่าวจากการทดสอบด้านความมั่นคงปลอดภัยทางไซเบอร์หลายรายการเมื่อเร็ว ๆ นี้
ผลลัพธ์เหล่านี้รวมถึงการประเมินจากผู้เชี่ยวชาญ ทำให้เราสรุปได้เมื่อคืนที่ผ่านมาว่าเราไม่สามารถตัดความเป็นไปได้ที่จะมีขีดความสามารถทางไซเบอร์ในระดับวิกฤตออกไปได้ OpenAI ระบุในบล็อกโพสต์
ภายใต้กรอบการทำงาน Preparedness Framework โมเดลจะถือว่ามีความเสี่ยงด้านความมั่นคงปลอดภัยทางไซเบอร์ในระดับวิกฤต หากสามารถค้นหาช่องโหว่แบบซีโร่เดย์ในระบบสำคัญต่าง ๆ ที่มีการป้องกันแน่นหนาในโลกแห่งความเป็นจริงได้จำนวนมาก โดยโมเดลจะผ่านเกณฑ์หากช่องโหว่เหล่านั้นครอบคลุมระดับความรุนแรงหลายระดับและถูกค้นพบโดยปราศจากความช่วยเหลือจากมนุษย์
นอกจากนี้ OpenAI ยังจัดให้โมเดลภาษาขนาดใหญ่เป็นระดับวิกฤต หากสามารถเปิดการโจมตีทางไซเบอร์ต่อระบบที่มีการป้องกันแน่นหนาได้โดยอาศัยเพียงเป้าหมายการแฮ็กระดับสูงที่ผู้ใช้ระบุไว้เท่านั้น ทั้งนี้บริษัทไม่ได้ระบุว่า Astra เข้าเกณฑ์การจัดประเภทข้อใดในสองข้อนี้ อย่างไรก็ตามบริษัทได้แบ่งปันรายละเอียดเกี่ยวกับวิธีการจัดการกับความเสี่ยงดังกล่าว
บริษัทกำลังดำเนินขั้นตอนต่าง ๆ เพื่อให้แน่ใจว่า Astra จะไม่สามารถเข้าถึงเว็บสาธารณะได้ ตามข้อมูลของบริษัท วิศวกรจะรันโมเดลดังกล่าวในสภาพแวดล้อมการทดสอบที่มีการจำกัดสิทธิ์การใช้งานเครือข่ายและเครื่องมือ โดย OpenAI กำลังระงับกิจกรรมการพัฒนาที่ไม่ได้ดำเนินการภายในสภาพแวดล้อมจำลองดังกล่าว
บริษัทกำลังยกระดับความพยายามในการป้องกันไม่ให้แฮ็กเกอร์ขโมยโค้ดของ Astra ตามบล็อกโพสต์ในครั้งนี้ ความคิดริเริ่มนี้จะเน้นย้ำเป็นพิเศษเกี่ยวกับการเข้ารหัสที่ปกป้องค่าน้ำหนักของโมเดลภาษาขนาดใหญ่ ซึ่งเป็นค่าที่กำหนดว่าโมเดลประมวลผลข้อมูลอย่างไร
Astra ขับเคลื่อนเอเจนต์ AI ภายในหลายตัว โดยบริษัทได้นำกลไกการสังเกตการณ์มาใช้เพื่อตรวจสอบเอเจนต์เหล่านั้นสำหรับกิจกรรมที่มุ่งร้าย ซึ่งกลไกดังกล่าวสามารถตรวจจับพฤติกรรมที่น่าสงสัยโดยการวิเคราะห์กระบวนการคิดของเอเจนต์ ซึ่งเป็นสรุปขั้นตอนการทำงานอินเฟอเรนซ์
OpenAI จะแบ่งปันเวิร์กโฟลว์ด้านความมั่นคงปลอดภัยทางไซเบอร์บางส่วนที่พัฒนาขึ้นให้กับพันธมิตรทดสอบภายนอก ซึ่งพันธมิตรเหล่านี้จะช่วยผู้พัฒนา ChatGPT ในการจัดการสภาพแวดล้อมจำลองที่ใช้ประเมินขีดความสามารถของโมเดลภาษาขนาดใหญ่ นอกจากนี้ OpenAI ยังวางแผนที่จะดึงหน่วยงานรัฐบาลที่เกี่ยวข้องและองค์กรด้านความปลอดภัยของ AI เข้ามาร่วมในกระบวนการนี้ด้วย
ที่มา: https://siliconangle.com/2026/08/07/openai-reveals-upcoming-astra-model-may-possess-critical-hacking-capabilities/
TechTalkThai ศูนย์รวมข่าว Enterprise IT ออนไลน์แห่งแรกในประเทศไทย








