오픈AI가 차세대 모델 아스트라(Astra)가 사이버보안 분야에서 자사 준비 프레임워크상 최고 수준인 '크리티컬(Critical)' 역량 임계값에 도달했다고 1일 밝혔다. ExploitBench 평가에서 알려진 취약점 기반 익스플로잇 개발 능력이 100점을 기록했고, 2026년 6~8월 공개된 고위험 취약점 20개로 구성한 내부 평가에서는 기존에 알려지지 않은 취약점 2건을 스스로 발견해 공격에 활용했다. 사이버보안 탈옥(jailbreak) 요청 거부율은 91.5%로 이전 모델 GPT-5.6 솔의 59%보다 크게 개선됐다. 오픈AI는 학습 인프라 격리와 네트워크 통제를 강화하며 약 2주간 일부 프런티어 학습을 중단했다가 8월 28일 재개했고, 출시 초기에는 고급 사이버보안 기능을 소수 테스터에게만 제한적으로 제공할 계획이다.
- •아스트라가 오픈AI 준비 프레임워크상 최고 등급 '크리티컬' 사이버보안 역량으로 처음 지정됨
- •ExploitBench에서 익스플로입 개발 능력 100점, 내부 평가에서 미공개 취약점 2건 자체 발견
- •사이버보안 탈옥 요청 거부율 91.5%로 GPT-5.6 솔의 59%대비 크게 개선
- •허깅페이스 보안 사고 교훈으로 학습 인프라 격리·네트워크 통제 강화, 약 2주간 프런티어 학습 중단 후 8월 28일 재개
- •출시 초기 고급 사이버보안 기능은 소수 테스터에만 제공하고 '데이브레이크 블루' 통해 방어 목적 활용만 점진 확대 계획
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
오픈AI, 사이버보안 ‘Critical’ AI 모델 ‘아스트라’ 공개 예고…“인간 개입 없이 취약점 탐지·공격 가능”
본문 미리보기
오픈AI(OpenAI)가 1일(현지시간) 차세대 AI 모델 ‘아스트라(Astra)’가 사이버보안 분야에서 자사의 준비 프레임워크(Preparedness Framework)가 규정한 최고 수준인 ‘크리티컬(Critical)’ 역량 임계값에 도달했다고 밝혔다. 아울러, 아스트라의 사이버보안 능력 평가 결과와 출시를 위한 안전·보안 대책도 공개했다.이에 따라 오픈AI는 아스트라의 개발과 출시 과정에서 사이버 악용과 모델의 비인가 행동을 차단하기 위한 강화된 안전장치를 적용하고, 고급 사이버보안 기능에 대한 접근도 단계적으로 제한할 계획이
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:11AI 초안



