OpenAI ระบุว่าโมเดล Astra ที่กำลังจะมาถึงได้บรรลุระดับความปลอดภัยทางไซเบอร์ Critical ภายใต้กรอบการเตรียมพร้อม (Preparedness Framework) บริษัทตั้งใจจะเปิดตัวพร้อมมาตรการป้องกันและให้บริการแบบจำกัดสำหรับฟังก์ชันไซเบอร์ขั้นสูงที่สุด
Astra เป็นโมเดลแรกของ OpenAI ที่ได้รับการจัดประเภทนี้ ระดับดังกล่าวบ่งชี้ว่าโมเดลสามารถตรวจจับช่องโหว่ที่ยังไม่ถูกค้นพบในระบบที่มีความปลอดภัย และสร้างเอ็กซ์พลอยต์ที่ใช้งานได้โดยไม่ต้องอาศัยคำแนะนำจากมนุษย์เพิ่มเติม
สิ่งที่ระดับ Critical ครอบคลุม
เกณฑ์สองประการกำหนดขีดจำกัด Critical ภายใต้กรอบการเตรียมพร้อม โมเดลจะผ่านเกณฑ์หากสามารถค้นหาและสร้างซีโร่เดย์เอ็กซ์พลอยต์ที่ใช้งานได้สำหรับระบบจริงที่มีความปลอดภัยหลากหลายโดยอัตโนมัติ
อีกทางเลือกหนึ่ง โมเดลจะผ่านเกณฑ์หากสามารถออกแบบและดำเนินการโจมตีแบบลูกโซ่เต็มรูปแบบดั้งเดิมต่อเป้าหมายที่แข็งแกร่ง โดยได้รับเพียงวัตถุประสงค์กว้างๆ
ตามข้อมูลของ OpenAI Astra ได้คะแนนสมบูรณ์ 100% ในการทดสอบ ExploitBench ในการทดสอบส่วนตัวกับข้อบกพร่อง V8 ที่รุนแรง 20 ข้อ Astra ทำผลงานการรันโค้ดได้ดีกว่า GPT-5.6 Sol ขณะที่ใช้โทเค็นน้อยกว่าอย่างมาก
ในการประเมินนั้น Astra ค้นพบและใช้ประโยชน์จากช่องโหว่ที่ไม่เคยรู้จักมาก่อนสองรายการ OpenAI รายงานว่ากำลังแจ้งผู้ดูแลที่เกี่ยวข้องของทั้งสองรายการ
ผู้ประเมินผู้เชี่ยวชาญสังเกตเห็นโมเดลสร้างห่วงโซ่การโจมตีเบราว์เซอร์ มันหลุดออกจากแซนด์บ็อกซ์และรันคำสั่งบนโฮสต์ที่อยู่เบื้องหลัง
“Astra แสดงถึงการเพิ่มขีดความสามารถด้านความปลอดภัยทางไซเบอร์อย่างมีนัยสำคัญเมื่อเทียบกับ GPT‑5.6 Sol: ทั้งมีประสิทธิภาพด้านโทเค็นมากกว่าอย่างมีนัยสำคัญ และสามารถระบุช่องโหว่และพัฒนาเอ็กซ์พลอยต์ได้มากขึ้น” OpenAI กล่าว
ตลอดช่วงฤดูร้อน เราได้เร่งดำเนินการตามลำดับความสำคัญด้านความปลอดภัย มันสำคัญกว่าที่เคยที่ขีดความสามารถและมาตรการป้องกันต้องก้าวหน้าไปพร้อมกัน เรายังมีอีกมากที่ต้องทำ แต่ก็มีความก้าวหน้าอย่างมาก เราจะเปิดตัวโมเดลถัดไปเร็วๆ นี้
มีความตึงเครียดที่ชัดเจน…
— Sam Altman (@sama) September 1, 2026
OpenAI เพิ่มการป้องกันก่อนปล่อย
OpenAI หยุดบางแง่มุมของการพัฒนา Astra เพื่อเสริมการป้องกัน เมื่อวันที่ 28 สิงหาคม บริษัทกลับมาเดินเครื่องการเรียนรู้แบบเสริมกำลังขั้นแนวหน้าครั้งสำคัญอีกครั้งหลังจากนำโปรโตคอลความปลอดภัยใหม่มาใช้
ตามข้อมูลของ OpenAI Astra ปฏิเสธ 91.5% ของคำขอในการประเมินการเจาะระบบไซเบอร์ ภายใต้เงื่อนไขเดียวกัน GPT-5.6 Sol ปฏิเสธ 59% ของคำขอ บัญชีที่ถือว่ามีความเสี่ยงสูงจะต้องถูกปฏิเสธด้วยเกณฑ์ที่เข้มงวดมากขึ้น
บริษัทยังใช้การตรวจสอบห่วงโซ่ความคิดเพื่อระบุและหยุดพฤติกรรมที่อาจไม่สอดคล้อง ในการทดสอบฮันนีพอต GPT-5.6 Sol ซึ่งขาดมาตรการป้องกันในสภาพแวดล้อมจริง พยายามประนีประนอมโครงสร้างพื้นฐานใกล้เคียงใน 56% ของกรณี Astra ไม่ได้พยายามใดๆ เช่นนั้น
OpenAI ตั้งใจจะปล่อย Astra ในเร็วๆ นี้ ฟีเจอร์ความปลอดภัยทางไซเบอร์ขั้นสูงสุดจะมีการจำกัดการเข้าถึง โดยเริ่มแรกจะให้แก่กลุ่มผู้ทดสอบ และภายหลังขยายผ่าน Daybreak Blue เพื่อวัตถุประสงค์ในการป้องกัน
OpenAI รับทราบว่ามาตรการป้องกันจะทำให้เกิดความไม่สะดวกบ้างในการปล่อยครั้งแรก