
OpenAI ประกาศหยุดพัฒนาโมเดล AI รุ่นใหม่ล่าสุดอย่าง Astra ชั่วคราว หลังการประเมินภายในพบว่าโมเดลนี้มีศักยภาพด้านความมั่นคงทางไซเบอร์สูงจนอาจก่อให้เกิดความเสี่ยงร้ายแรงต่อโลกออนไลน์ได้
การประเมินล่าสุดของ OpenAI ชี้ให้เห็นว่า Astra มีความก้าวหน้าอย่างมีนัยสำคัญทั้งในด้าน Agentic Coding หรือการเขียนโปรแกรมแบบอัตโนมัติด้วย AI และด้านความมั่นคงทางไซเบอร์ โดยบริษัทไม่สามารถตัดความเป็นไปได้ที่โมเดลนี้จะถึงระดับ “Critical” ในกรอบการทำงาน Preparedness Framework ที่ OpenAI ใช้ประเมินความเสี่ยงของโมเดล AI รุ่นต่างๆ ได้ โมเดลก่อนหน้าอย่าง GPT-5.6 Sol เคยถูกจัดระดับไว้ที่ “High” เท่านั้น
ระดับ “Critical” ตามนิยามของ OpenAI หมายถึงความสามารถในการระบุและพัฒนา Zero-day Exploits หรือช่องโหว่ที่ยังไม่เคยถูกค้นพบมาก่อน ในระบบสำคัญหลายรูปแบบโดยไม่ต้องอาศัยการควบคุมจากมนุษย์ รวมถึงความสามารถในการวางแผนและดำเนินการโจมตีทางไซเบอร์แบบครบวงจรด้วยตัวเอง ซึ่งถือเป็นภัยคุกคามที่ไม่เคยเกิดขึ้นมาก่อนในโลก AI
เพื่อรับมือกับความเสี่ยงนี้ OpenAI ได้ประกาศมาตรการป้องกันหลายชั้น ได้แก่ การจำกัดการทำงานกับโมเดล Astra จนกว่าจะมีการนำระบบป้องกันใหม่มาใช้ รวมถึงการทดสอบในสภาพแวดล้อมแบบ Isolated ที่ถูกตัดการเชื่อมต่อจากเครือข่ายภายนอก การเพิ่ม Sandboxed Execution เพื่อกักกันการทำงานของโมเดล ตลอดจนการขยายระบบติดตามและตรวจสอบความปลอดภัย นอกจากนี้ OpenAI ยังประกาศแผนร่วมมือกับหน่วยงานรัฐบาลที่เกี่ยวข้องและองค์กรความปลอดภัย AI เพื่อร่วมทดสอบโมเดลก่อนเผยแพร่
“เรามุ่งมั่นที่จะทำงานร่วมกับรัฐบาล สถาบันด้านความปลอดภัย และภาคประชาสังคม เพื่อให้มั่นใจว่าความสามารถขั้นสูงสุดของโมเดลอย่าง Astra และโมเดลที่จะตามมา จะถูกนำไปใช้อย่างรับผิดชอบและเป็นประโยชน์ต่อมนุษยชาติโดยรวม” OpenAI ระบุในแถลงการณ์
แม้ Astra จะยังไม่มีการประกาศอย่างเป็นทางการ แต่ก่อนหน้านี้ OpenAI ได้เปิดเผยรายละเอียดของโมเดลนี้ผ่านโพสต์เกี่ยวกับความก้าวหน้าด้านคณิตศาสตร์ โดย Astra สามารถแก้ปัญหาทางคณิตศาสตร์และวิทยาการคอมพิวเตอร์เชิงทฤษฎีที่ยังไม่มีคำตอบถึง 10 ข้อ ด้วยต้นทุนเพียงประมาณ 2,000 ดอลลาร์สหรัฐ โดยคิดในอัตรา Sol API
ความก้าวหน้าของ AI ยังส่งผลกระทบต่อภูมิทัศน์ด้านความปลอดภัยของบริษัทเทคโนโลยีรายใหญ่อย่าง Apple ด้วย โดยการค้นพบช่องโหว่ซอฟต์แวร์ด้วย AI เพิ่มขึ้นในอัตราที่ไม่เคยเห็นมาก่อน จนทำให้ Apple ต้องจำกัดการรับรายงานจากโปรแกรม Bug Bounty หรือโครงการชวนนักวิจัยภายนอกช่วยหาช่องโหว่ เนื่องจากรับมือกับปริมาณรายงานที่เข้ามาไม่ทัน
โมเดลอย่าง Claude Mythos ของ Anthropic ก็ถูกพิสูจน์แล้วว่าสามารถค้นพบช่องโหว่สำคัญในระบบได้ และ Apple คือหนึ่งในพันธมิตรที่เข้าร่วมโครงการ Mythos ของ Anthropic ซึ่งถูกจำกัดเฉพาะองค์กรที่ผ่านการคัดเลือก เนื่องจากโมเดลนี้ไม่เพียงแค่ค้นหาช่องโหว่ แต่ยังมีศักยภาพในการโจมตีช่องโหว่เหล่านั้นได้ด้วย
ก่อนหน้านี้ในเดือนกรกฎาคม OpenAI เป็นข่าวใหญ่เมื่อ GPT-5.6 Sol และโมเดลก่อนเผยแพร่อีกตัว (ที่ไม่ใช่ Astra) ได้เจาะระบบของ Hugging Face โดยอัตโนมัติระหว่างการทดสอบ Benchmark ภายใน ขณะที่ Anthropic ก็พบว่า Claude เคยทำสิ่งที่คล้ายกัน และล่าสุดในสัปดาห์นี้ Meta ก็ออกมายอมรับว่าโมเดล AI ของตนก็เคยเจาะระบบของบริษัทอื่นในระหว่างการทดสอบด้านความปลอดภัยเช่นกัน ซึ่งสะท้อนให้เห็นว่าปัญหานี้ไม่ได้เกิดขึ้นกับบริษัทใดบริษัทหนึ่ง แต่กำลังกลายเป็นความท้าทายระดับอุตสาหกรรม AI โดยรวม
อ้างอิง | Macrumors.com