앤스로픽, 사이버 AI 3단계 심사…차단 기준·평가 결과 공개
제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.
핵심 포인트
- 앤스로픽이 사이버 검증 프로그램을 방어·레드팀·전문 액세스로 나누고 등급별 신청 대상과 안전장치를 제시했다.
- 자체 평가에서 클로드 오퍼스 5.5는 디펜스 액세스 시도 50회 중 46회를 차단했다.
- 앤스로픽이 사이버 보안용 AI 모델 접근을 방어 업무, 승인된 침투 테스트, 핵심 안전 시스템 시험 등 세 단계로 나눴다.
본문
앤스로픽이 사이버 검증 프로그램을 방어·레드팀·전문 액세스로 나누고 등급별 신청 대상과 안전장치를 제시했다. 자체 평가에서 클로드 오퍼스 5.5는 디펜스 액세스 시도 50회 중 46회를 차단했다. 앤스로픽이 사이버 보안용 AI 모델 접근을 방어 업무, 승인된 침투 테스트, 핵심 안전 시스템 시험 등 세 단계로 나눴다. 앤스로픽은 10월 6일(현지시간) 사이버 검증 프로그램(CVP)을 개편했다고 밝혔다. 개인 연구자는 신청할 수 없으며, 심사 중인 조직은 요건을 충족하면 디펜스 액세스를 이용할 수 있다. 기존 프로젝트 글래스윙 참여 조직은 현재 모델에 한해 재승인 없이 이 등급으로 전환된다. 앞서 앤스로픽이 사이버 검증 프로그램과 미토스급 접근 확대 계획을 발표한 데 이어 , 이번에는 등급별 신청 대상과 차단 기준, 평가 결과를 구체화했다. 앤스로픽은 자체 평가 도구 사이시나리오벤치(CyScenarioBench)로 안전장치를 시험했다.
클로드 오퍼스 5.5는 디펜스 액세스 평가에서 50회 시도 중 46회 차단됐고, 레드팀 액세스에서는 차단 없이 50개 과제 중 34개를 완료했다. 회사는 프로젝트 글래스윙 참여자들이 2026년 4~7월 검증된 소프트웨어 취약점 최소 12만9000건을 찾았고, 자체 오픈소스 스캔으로 4~10월 5500건을 추가 확인했다고 밝혔다. 이 가운데 3만3000건 이상은 심각 또는 높은 등급으로 분류됐다. 이번 개편은 접근 권한을 작업별로 구분하는 기준과 회사 자체 평가를 공개했지만, 취약점이 분류·공개·패치되는 과정과 현장 성과를 보여주는 자료는 별도로 필요하다.