OpenAI의 Astra, '중요한' 해킹 능력을 갖춘 최초의 AI 모델이 되다
제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.
핵심 포인트
- 아직 출시되지 않은 모델은 사람이 각 단계를 거치지 않고도 제로데이 취약점을 찾아 이를 작동 가능한 익스플로잇으로 연결할 수 있으며, 해당 기능에 대한 액세스는 소규모 테스터 그룹에서 시작됩니다.
- OpenAI는 미공개 모델인 Astra가 자사가 해당 카테고리에 넣은 최초의 모델인 대비 프레임워크(Preparedness Framework)에 따라 사이버 보안 기능에 대한 "중요한" 임계값을 넘었다고 화요일 밝혔습니다.
- 이는 많은 사람들이 추가 모델이 아닌 GPT-6이라고 믿고 있는 Astra가 이전에 알려지지 않은 보안 결함을 찾아내고 단계별로 안내하는 사람 없이도 수많은 강화된 시스템에서 작동하는 익스플로잇을 구축할 수 있음을 의미합니다.
본문
아직 출시되지 않은 모델은 사람이 각 단계를 거치지 않고도 제로데이 취약점을 찾아 이를 작동 가능한 익스플로잇으로 연결할 수 있으며, 해당 기능에 대한 액세스는 소규모 테스터 그룹에서 시작됩니다. OpenAI는 미공개 모델인 Astra가 자사가 해당 카테고리에 넣은 최초의 모델인 대비 프레임워크(Preparedness Framework)에 따라 사이버 보안 기능에 대한 "중요한" 임계값을 넘었다고 화요일 밝혔습니다. 이는 많은 사람들이 추가 모델이 아닌 GPT-6이라고 믿고 있는 Astra가 이전에 알려지지 않은 보안 결함을 찾아내고 단계별로 안내하는 사람 없이도 수많은 강화된 시스템에서 작동하는 익스플로잇을 구축할 수 있음을 의미합니다. OpenAI는 “이제 Astra가 준비 프레임워크에 따라 중요한 사이버 보안 기능 임계값을 충족한다고 믿습니다.”라고 썼습니다.
"우리가 이 수준에서 지정하는 첫 번째 모델이며 개발 과정과 출시 전에 더 강력한 보호 조치가 필요합니다." 프레임워크 하에서, 모델이 다수의 강화된 실제 시스템에서 기능적인 제로데이 익스플로잇을 독립적으로 개발할 수 있거나 단지 높은 수준의 목표에서 시작하여 어려운 목표에 대한 전체 사이버 공격을 계획하고 실행할 수 있다면 모델은 매우 중요합니다. 모델이 이미 알려진 소프트웨어 취약점을 작동하는 익스플로잇으로 전환할 수 있는지 여부를 테스트하고 이를 직선 통과율로 평가하는 벤치마크인 ExploitBench에서 Astra는 완벽한 100%를 기록했습니다. Astra는 훨씬 적은 수의 출력 토큰을 사용하여 임의 코드 실행 속도에서 GPT-5.6 Sol을 이겼으며, 그 과정에서 OpenAI가 여전히 영향을 받는 유지 관리자에게 두 개의 제로 데이 취약점을 발견하고 연결했습니다.
OpenAI는 자체 테스트에서 이 모델이 사이버 탈옥 시도의 91.5%를 거부했다고 밝혔습니다. 이는 GPT-5.6 Sol의 59%보다 증가한 수치입니다. 불과 며칠 전, OpenAI는 모델의 사이버 및 코딩 기술이 빠르게 발전한 후 Astra의 개발을 일시 중지했습니다. 이 경고는 보안 벤치마크를 게임하는 동안 Hugging Face를 위반할 수 있는 취약성을 연결한 별도의 미공개 OpenAI 시스템에 대한 경고였습니다. Decrypt가 추적한 Myriad의 예측 시장은 코드명 GPT-6과 내부적으로 연결된 Astra가 9월까지 공개될 확률이 72%라고 밝혔습니다.
Decrypt는 6월에 OpenAI의 GPT-5.5-Cyber가 실제 오픈 소스 프로젝트에서 알려진 1,500개 이상의 취약점에 대해 AI 에이전트를 실행하고 얼마나 많은 취약점을 올바르게 재현하는지에 대해 점수를 매기는 벤치마크인 CyberGym에서 이미 Mythos 5를 능가했다고 보고했습니다. OpenAI는 Astra가 곧 출시될 예정이며, 알파 액세스가 먼저 이루어지고 Daybreak Blue가 그 이후에 가장 강력한 사이버 도구로 제어됩니다.