OpenAI เผยโมเดล Astra ใหม่อาจมาพร้อมความสามารถแฮ็กระดับวิกฤต

OpenAI เปิดเผยว่าหนึ่งในโมเดลภาษาขนาดใหญ่ที่ยังไม่ได้เปิดตัวของบริษัทอาจก่อให้เกิดความเสี่ยงด้านความมั่นคงปลอดภัยทางไซเบอร์อย่างมีนัยสำคัญ

Credit: OpenAI

อัลกอริทึมดังกล่าวซึ่งเป็นที่รู้จักในชื่อ Astra ได้รับการเปิดเผยรายละเอียดครั้งแรกเมื่อสัปดาห์ที่ผ่านมา โดย OpenAI ระบุในบล็อกโพสต์เมื่อวันอาทิตย์ว่าโมเดลภาษาขนาดใหญ่นี้สามารถแก้ไขโจทย์คณิตศาสตร์ที่ซับซ้อนมาอย่างยาวนานได้ 10 ข้อ ทั้งนี้บริษัทได้เผยแพร่บทพิสูจน์เหล่านั้นและเปิดเผยว่าแต่ละข้อต้องใช้โทเค็นมูลค่าประมาณ 2,000 ดอลลาร์ในการสร้างคำตอบ

ในฐานะส่วนหนึ่งของความพยายามด้านความปลอดภัยของปัญญาประดิษฐ์ OpenAI ได้เผยแพร่เอกสารจำนวน 29 หน้าที่เรียกว่า Preparedness Framework โดยหนึ่งในส่วนของเอกสารฉบับนี้ประกอบด้วยระบบการให้คะแนนความเสี่ยงของ AI ซึ่งระบบดังกล่าวจะจัดลำดับความเสี่ยงด้านความมั่นคงปลอดภัยทางไซเบอร์ที่เกิดจากโมเดลภาษาขนาดใหญ่ว่าอยู่ในระดับสูง (High) หรือวิกฤต (Critical) ขึ้นอยู่กับขีดความสามารถของโมเดลนั้น ๆ

โมเดล GPT-5.6 Sol ซึ่งเป็นรุ่นเรือธงของ OpenAI และอัลกอริทึมรุ่นก่อนหน้าบางตัวได้รับคะแนนในระดับ สูง ตามข้อมูลของบริษัท Astra เป็นโมเดลภาษาขนาดรุ่นแรกที่อาจเข้าข่ายการจัดประเภทในระดับวิกฤต โดยวิศวกรของบริษัทได้ข้อสรุปดังกล่าวจากการทดสอบด้านความมั่นคงปลอดภัยทางไซเบอร์หลายรายการเมื่อเร็ว ๆ นี้

ผลลัพธ์เหล่านี้รวมถึงการประเมินจากผู้เชี่ยวชาญ ทำให้เราสรุปได้เมื่อคืนที่ผ่านมาว่าเราไม่สามารถตัดความเป็นไปได้ที่จะมีขีดความสามารถทางไซเบอร์ในระดับวิกฤตออกไปได้ OpenAI ระบุในบล็อกโพสต์

ภายใต้กรอบการทำงาน Preparedness Framework โมเดลจะถือว่ามีความเสี่ยงด้านความมั่นคงปลอดภัยทางไซเบอร์ในระดับวิกฤต หากสามารถค้นหาช่องโหว่แบบซีโร่เดย์ในระบบสำคัญต่าง ๆ ที่มีการป้องกันแน่นหนาในโลกแห่งความเป็นจริงได้จำนวนมาก โดยโมเดลจะผ่านเกณฑ์หากช่องโหว่เหล่านั้นครอบคลุมระดับความรุนแรงหลายระดับและถูกค้นพบโดยปราศจากความช่วยเหลือจากมนุษย์

นอกจากนี้ OpenAI ยังจัดให้โมเดลภาษาขนาดใหญ่เป็นระดับวิกฤต หากสามารถเปิดการโจมตีทางไซเบอร์ต่อระบบที่มีการป้องกันแน่นหนาได้โดยอาศัยเพียงเป้าหมายการแฮ็กระดับสูงที่ผู้ใช้ระบุไว้เท่านั้น ทั้งนี้บริษัทไม่ได้ระบุว่า Astra เข้าเกณฑ์การจัดประเภทข้อใดในสองข้อนี้ อย่างไรก็ตามบริษัทได้แบ่งปันรายละเอียดเกี่ยวกับวิธีการจัดการกับความเสี่ยงดังกล่าว

บริษัทกำลังดำเนินขั้นตอนต่าง ๆ เพื่อให้แน่ใจว่า Astra จะไม่สามารถเข้าถึงเว็บสาธารณะได้ ตามข้อมูลของบริษัท วิศวกรจะรันโมเดลดังกล่าวในสภาพแวดล้อมการทดสอบที่มีการจำกัดสิทธิ์การใช้งานเครือข่ายและเครื่องมือ โดย OpenAI กำลังระงับกิจกรรมการพัฒนาที่ไม่ได้ดำเนินการภายในสภาพแวดล้อมจำลองดังกล่าว

บริษัทกำลังยกระดับความพยายามในการป้องกันไม่ให้แฮ็กเกอร์ขโมยโค้ดของ Astra ตามบล็อกโพสต์ในครั้งนี้ ความคิดริเริ่มนี้จะเน้นย้ำเป็นพิเศษเกี่ยวกับการเข้ารหัสที่ปกป้องค่าน้ำหนักของโมเดลภาษาขนาดใหญ่ ซึ่งเป็นค่าที่กำหนดว่าโมเดลประมวลผลข้อมูลอย่างไร

Astra ขับเคลื่อนเอเจนต์ AI ภายในหลายตัว โดยบริษัทได้นำกลไกการสังเกตการณ์มาใช้เพื่อตรวจสอบเอเจนต์เหล่านั้นสำหรับกิจกรรมที่มุ่งร้าย ซึ่งกลไกดังกล่าวสามารถตรวจจับพฤติกรรมที่น่าสงสัยโดยการวิเคราะห์กระบวนการคิดของเอเจนต์ ซึ่งเป็นสรุปขั้นตอนการทำงานอินเฟอเรนซ์

OpenAI จะแบ่งปันเวิร์กโฟลว์ด้านความมั่นคงปลอดภัยทางไซเบอร์บางส่วนที่พัฒนาขึ้นให้กับพันธมิตรทดสอบภายนอก ซึ่งพันธมิตรเหล่านี้จะช่วยผู้พัฒนา ChatGPT ในการจัดการสภาพแวดล้อมจำลองที่ใช้ประเมินขีดความสามารถของโมเดลภาษาขนาดใหญ่ นอกจากนี้ OpenAI ยังวางแผนที่จะดึงหน่วยงานรัฐบาลที่เกี่ยวข้องและองค์กรด้านความปลอดภัยของ AI เข้ามาร่วมในกระบวนการนี้ด้วย

ที่มา: https://siliconangle.com/2026/08/07/openai-reveals-upcoming-astra-model-may-possess-critical-hacking-capabilities/

About นักเขียนฝึกหัดหมายเลขเก้า

Check Also

Salesforce และ Anthropic ประกาศเปิดตัว Claudeforce ผสาน AI อันดับ 1 กับ CRM AI อันดับ 1 [PR]

Salesforce และ Anthropic ประกาศขยายความร่วมมือเชิงกลยุทธ์ พร้อมเปิดตัว Claudeforce ซึ่งผสานความสามารถด้านการให้เหตุผลของ Claude เข้ากับข้อมูล เวิร์กโฟลว์ กฎทางธุรกิจ การดำเนินงาน และระบบกำกับดูแลของ Salesforce เพื่อให้ …

OpenAI และองค์กรชั้นนำกว่า 100 แห่ง เตือนภัยไซเบอร์จาก AI เตรียมปะทุหนักในอีกไม่กี่เดือน

OpenAI เผยแพร่จดหมายเปิดผนึกที่ลงนามโดยบริษัทเทคโนโลยี ธนาคาร บริษัทประกัน และผู้ให้บริการด้านความมั่นคงปลอดภัยกว่า 100 แห่ง แจ้งเตือนถึงการโจมตีทางไซเบอร์ที่ขับเคลื่อนด้วย AI ซึ่งกำลังจะขยายตัวอย่างรุนแรงในอีกไม่กี่เดือนข้างหน้า โดยระบุชัดเจนว่าองค์กรต่าง ๆ เหลือหน้าต่างแห่งโอกาสเพียงจำกัดในการยกระดับแนวป้องกันทางไซเบอร์