GCSA Agent ทำคะแนน 91.3% บน CyberGym ติดอันดับ AI Security Agents ชั้นนำ

GCSA Agent ทำคะแนน 91.3% บนเกณฑ์ชี้วัด CyberGym อยู่ในอันดับ AI agents ด้านความปลอดภัยทางไซเบอร์ชั้นนำของโลก

31/08/2026 08:41อ่านประมาณ 17 นาที

GCSA Agent แสดงให้เห็นถึงความสามารถในการวิเคราะห์ช่องโหว่โดยอัตโนมัติและสร้าง proof-of-concept exploits บนเกณฑ์ชี้วัดในโลกจริงที่ท้าทาย

Global Cybersecurity Alliance (GCSA) รายงานวันนี้ว่า GCSA Agent มีอัตราความสำเร็จ 91.3% บนเกณฑ์ชี้วัด CyberGym ทำให้อยู่ในหมวดหมู่ "Leading Systems Above 90%" ของ CyberGym

พัฒนาโดยทีมวิจัยจาก University of California, Berkeley CyberGym เป็นกรอบการประเมินความปลอดภัยทางไซเบอร์ขนาดใหญ่ที่ใช้กรณีในโลกจริง ประกอบด้วยกรณีทดสอบช่องโหว่ทางประวัติศาสตร์ 1,507 กรณีครอบคลุมโครงการซอฟต์แวร์หลัก 188 โครงการ และมีวัตถุประสงค์เพื่อประเมินว่า AI agents ทำงานอย่างไรในการวิเคราะห์ช่องโหว่เชิงปฏิบัติ

CyberGym แตกต่างจากเกณฑ์ชี้วัด AI ทั่วไปที่เน้นความเข้าใจโค้ด การถาม-ตอบตามความรู้ หรือการวิเคราะห์แบบคงที่ โดยกำหนดให้ AI agents ทำงานโดยตรงภายในสภาพแวดล้อมโค้ดที่มีช่องโหว่จริง

สำหรับการทดสอบLevel 1 หลัก AI agent จะได้รับเพียงคำอธิบายช่องโหว่และฐานโค้ดที่ยังไม่ได้รับการแก้ไข จากนั้นจะต้องวิเคราะห์โค้ดอย่างอิสระ ค้นหาช่องโหว่ ใช้เหตุผลเกี่ยวกับเส้นทางโจมตีที่อาจเกิดขึ้น สร้าง proof-of-concept (PoC) และดำเนินการเพื่อยืนยัน งานจะถือว่าสำเร็จก็ต่อเมื่อ PoC กระตุ้นช่องโหว่ในเวอร์ชันที่ไม่ได้รับการแก้ไข แต่ไม่สามารถทำให้เกิดซ้ำในเวอร์ชันที่ได้รับการแก้ไขแล้ว

ดังนั้น CyberGym จึงประเมินมากกว่าแค่ความเข้าใจโค้ด โดยทดสอบว่า AI สามารถทำงานทั้งหมดตั้งแต่การวิเคราะห์ความปลอดภัยไปจนถึงการทำซ้ำและการยืนยันช่องโหว่ได้หรือไม่

จาก Large Language Models สู่ Security Agents

สำหรับการประเมิน CyberGym GCSA Agent ทำงานบนโมเดล Grok 4.5 และ Grok 4.6 และบรรลุอัตราความสำเร็จสุดท้ายที่ 91.3%

ผลลัพธ์นี้เน้นย้ำถึงการเปลี่ยนแปลงครั้งสำคัญใน AI cybersecurity:

โมเดลภาษาขนาดใหญ่ที่อยู่เบื้องหลังเพียงอย่างเดียวไม่ได้กำหนดความสามารถด้านความปลอดภัยสูงสุดของระบบอีกต่อไป

การวิจัยช่องโหว่ในโลกจริงมักต้องการลำดับงานต่อเนื่อง: การทำความเข้าใจคำอธิบายช่องโหว่ การค้นหาฐานโค้ดขนาดใหญ่ การระบุพื้นผิวการโจมตี การสร้างสมมติฐานช่องโหว่ การสร้างอินพุตทดสอบ การรันโปรแกรม การวิเคราะห์ผลตอบรับ และการทำซ้ำ PoCs ซ้ำๆ

GCSA Agent สร้างขึ้นรอบเวิร์กโฟลว์ความปลอดภัยแบบ agentic ที่ออกแบบมาเพื่อรองรับกระบวนการทั้งหมดนี้ตั้งแต่ต้นจนจบ

วัตถุประสงค์ของมันไม่ใช่แค่ใช้โมเดลภาษาขนาดใหญ่สำหรับการวิเคราะห์โค้ด แต่เพื่อให้ AI ทำงานภายในสภาพแวดล้อมการทำงานจริง สร้างสมมติฐานเกี่ยวกับปัญหาความปลอดภัยอย่างอิสระ รวบรวมหลักฐานขณะรันไทม์ รันการทดสอบ และสุดท้ายยืนยันผลการค้นพบด้านความปลอดภัยผ่านผลลัพธ์ที่สามารถทำซ้ำได้

CyberGym ให้เกณฑ์ชี้วัดเชิงปริมาณภายนอกสำหรับความสามารถเหล่านี้

ความสามารถในการวิจัยช่องโหว่สำหรับโลกจริง

จุดแข็งหลักของ CyberGym อยู่ที่การลดช่องว่างระหว่างการทดสอบ AI แบบดั้งเดิมและการวิจัยความปลอดภัยทางไซเบอร์ในโลกจริง

สภาพแวดล้อมการประเมินของมันจะคืนค่าโครงการซอฟต์แวร์กลับไปเป็นสถานะที่มีช่องโหว่ก่อนการแก้ไข AI agent อาจต้องระบุปัญหาอย่างอิสระภายในฐานโค้ดขนาดใหญ่ที่มีไฟล์หลายพันไฟล์และโค้ดหลายล้านบรรทัด และสุดท้ายสร้าง PoC ที่สามารถกระตุ้นช่องโหว่ได้จริง

ที่สำคัญกว่านั้น การวิจัย CyberGym เพิ่มเติมได้แสดงให้เห็นว่าความสามารถด้านความปลอดภัยแบบ agentic ดังกล่าวไม่ได้จำกัดอยู่แค่การทำซ้ำช่องโหว่ที่รู้จัก

ในการทดลองวิจัยช่องโหว่แบบปลายเปิด AI agents ได้ระบุช่องโหว่ zero-day ที่ไม่เคยรู้จักมาก่อนหลายรายการ รวมถึงแพตช์ความปลอดภัยในอดีตที่ไม่ได้แก้ไขปัญหาพื้นฐานอย่างสมบูรณ์ การค้นพบเหล่านี้แสดงให้เห็นถึงศักยภาพของเทคโนโลยีการวิเคราะห์ช่องโหว่อัตโนมัติที่จะพัฒนาไปจากการทำซ้ำช่องโหว่ที่รู้จักไปสู่การค้นพบข้อบกพร่องด้านความปลอดภัยในโลกจริง

สำหรับ GCSA นี่เป็นทิศทางการพัฒนาที่สำคัญยิ่งกว่า

ประสิทธิภาพของเกณฑ์ชี้วัดไม่ใช่เป้าหมายสูงสุด

GCSA มุ่งมั่นที่จะพัฒนา AI Security Agents เพิ่มเติมที่สามารถทำงานในสภาพแวดล้อมความปลอดภัยทางไซเบอร์ในโลกจริง และค่อยๆ มีส่วนร่วมในวงจรชีวิตความปลอดภัยทั้งหมด ตั้งแต่การค้นพบและการวิเคราะห์ช่องโหว่ไปจนถึงการยืนยันและการแก้ไขในภายหลัง

การสร้างขีดความสามารถด้านความปลอดภัยทางไซเบอร์แบบ AI-Native

ในขณะที่ปัญญาประดิษฐ์เร่งการพัฒนาซอฟต์แวร์ มันยังเปลี่ยนแปลงวิธีการวิจัยช่องโหว่และจัดการภัยคุกคามทางไซเบอร์

ด้วยระบบซอฟต์แวร์ที่เติบโตในด้านขนาดและความซับซ้อน ความปลอดภัยทางไซเบอร์รุ่นต่อไปจะพึ่งพาความร่วมมือระหว่างผู้เชี่ยวชาญด้านความปลอดภัยที่เป็นมนุษย์และ AI agents อัตโนมัติมากขึ้น

AI Security Agents มีศักยภาพที่จะช่วยทีมรักษาความปลอดภัย:

  • ระบุช่องโหว่ของซอฟต์แวร์ที่มีศักยภาพในการถูกโจมตีจริงในระยะเริ่มต้น
  • วิเคราะห์เส้นทางโจมตีที่ซับซ้อนโดยอัตโนมัติในฐานโค้ดขนาดใหญ่
  • สร้าง PoCs โดยอัตโนมัติและดำเนินการยืนยันช่องโหว่ในระดับการทำงาน
  • ลดผลบวกเท็จในการตรวจจับความปลอดภัยแบบดั้งเดิมผ่านผลลัพธ์การทำงานจริง
  • เร่งการประเมิน การยืนยัน และการแก้ไขช่องโหว่
  • ขยายขนาดของซอฟต์แวร์และระบบที่ทีมรักษาความปลอดภัยเฉพาะทางสามารถครอบคลุมได้

คะแนน 91.3% CyberGym ของ GCSA Agent ถือเป็นก้าวสำคัญในการพัฒนาขีดความสามารถด้านความปลอดภัยทางไซเบอร์แบบ AI-native ของ GCSA

ต่อไป GCSA จะยังคงพัฒนาการวิจัยเกี่ยวกับการวิเคราะห์ช่องโหว่อัตโนมัติ AI Security Agents และเทคโนโลยีความปลอดภัยทางไซเบอร์อัจฉริยะต่อไป แปลงขีดความสามารถ AI ชั้นนำให้เป็นขีดความสามารถด้านความปลอดภัยในโลกจริง และให้การสนับสนุนทางเทคนิคสำหรับสภาพแวดล้อมดิจิทัลที่ปลอดภัย น่าเชื่อถือ และยืดหยุ่นมากขึ้น

ที่มา: GCSA Global Cybersecurity Alliance
เว็บไซต์: www.gcsa.org

แชร์ไปยัง

X (Twitter)Telegram

ข้อจำกัดความรับผิดชอบ: เนื้อหาในบทความนี้มาจากสื่อภายนอก ใช้เพื่อการอ้างอิงเท่านั้น และไม่ถือเป็นคำแนะนำการลงทุน คริปโตและผลิตภัณฑ์ทางการเงินอื่นมีความเสี่ยงจากความผันผวนของราคาสูง โปรดตัดสินใจอย่างรอบคอบ

บทความที่เกี่ยวข้อง

ต้นทุนทางการเงิน ไม่ใช่ราคา ขับเคลื่อนการซื้อ Bitcoin ของ Strategy ซีอีโอกล่าว

Phong Le ซีอีโอของ Strategy กล่าวว่าการซื้อ Bitcoin ขึ้นอยู่กับต้นทุนทางการเงิน ไม่ใช่ราคา เขาคาดว่าการ Rally จะดำเนินต่อไป

2 ชั่วโมงที่แล้วอ่านประมาณ 8 นาที

สเตเบิลคอยน์ขับเคลื่อนการออกแบบระบบชำระเงินระหว่างประเทศใหม่

สเตเบิลคอยน์กำลังเปลี่ยนโฉมการชำระเงินข้ามพรมแดนด้วยการทำให้การหักบัญชีรวดเร็วขึ้นแบบเรียลไทม์ ส่งผลให้ต้องออกแบบโครงสร้างพื้นฐานธนาคารแบบเดิมใหม่

5 ชั่วโมงที่แล้วอ่านประมาณ 35 นาที

GTA 6 ผู้รั่วไหลถอนค่าธรรมเนียม 350,000 ดอลลาร์จากเหรียญมีม CyberLeek

ผู้รั่วไหล GTA 6 นิรนามทำเงินประมาณ 350,000 ดอลลาร์จากค่าธรรมเนียมของเหรียญมีม CyberLeek ไม่ใช่จากการขายโทเค็น

5 ชั่วโมงที่แล้วอ่านประมาณ 8 นาที

การย้ายระบบไปใช้ควอนตัมคอมพิวติ้งอาจทำให้คริปโตเสียหายหลายพันล้าน ผู้เชี่ยวชาญกล่าว

สถาบันต่างๆ เผชิญกับค่าใช้จ่ายหลายพันล้านเพื่อเตรียมคริปโตสำหรับควอนตัมคอมพิวเตอร์ โดยไม่มีงบประมาณกลางสำหรับการย้ายระบบ

5 ชั่วโมงที่แล้วอ่านประมาณ 25 นาที