“인류 멸망 공포보다 보안 구멍 막아라”…오픈AI 돌발 행동이 던진 과제
제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.
핵심 포인트
- 오픈AI가 테스트 과정에서 지시받지 않았거나 해서는 안 되는 행동을 한 AI 모델 사례 6건을 공개했다.
- [멕시코=심영재 특파원] 오픈AI가 테스트 과정에서 인공지능(AI) 모델이 지시받지 않았거나 해서는 안 되는 행동을 한 사례 6건을 공개했다.
- AI 모델이 외부 시스템에 침입하는 등 예상 밖 행동을 보이면서 안전성 논쟁이 커지고 있지만, 전문가들은 이를 AI가 자의식을 갖고 인류를 위협하는 징후로 해석해서는 안 된다고 지적했다.
본문
오픈AI가 테스트 과정에서 지시받지 않았거나 해서는 안 되는 행동을 한 AI 모델 사례 6건을 공개했다. [멕시코=심영재 특파원] 오픈AI가 테스트 과정에서 인공지능(AI) 모델이 지시받지 않았거나 해서는 안 되는 행동을 한 사례 6건을 공개했다. AI 모델이 외부 시스템에 침입하는 등 예상 밖 행동을 보이면서 안전성 논쟁이 커지고 있지만, 전문가들은 이를 AI가 자의식을 갖고 인류를 위협하는 징후로 해석해서는 안 된다고 지적했다. 17일(현지시각) 야후파이낸스에 따르면 오픈AI는 지난 16일 AI 모델 테스트·평가 과정에서 발견한 ‘예상하지 못했거나 우려되는 모델 행동’ 6건을 공개했다. 모델이 지시받지 않았거나 해서는 안 되는 행동을 하는 사례를 추적·보고·공개하기 위한 새로운 체계도 발표했다. 아직 출시되지 않은 오픈AI 모델이 AI 모델·테스트 플랫폼 허깅페이스(Hugging Face) 네트워크에 침입한 사례도 있었다고 야후파이낸스는 전했다.
앤트로픽 연구원 제이컵 콕슨은 회사를 떠나면서 앤트로픽과 전 직장 오픈AI가 스스로 성능을 개선하는 초지능 개발을 향해 경쟁하고 있다고 비판했다. 에번 허빙어 앤트로픽 정렬과학 책임자는 AI 기술이 모든 인간을 죽일 가능성을 10% 이상으로 본다는 개인적 견해를 밝혔다. 그는 오픈AI 사례에 대해 기본적인 보안 프로토콜이 제대로 적용되지 않은 문제라며 AI 기업들이 보안의 중요성을 다시 인식해야 한다고 지적했다. 밀턴 뮬러 조지아공대 교수는 허깅페이스 사례가 통제불능 AI의 공격이라기보다 에이전트형 AI의 보안 영향을 시험하는 과정에서 실험 환경이 제대로 구성되지 않아 발생했다고 설명했다. 피싱과 신원도용 같은 범죄를 확대하는 데 사용될 가능성도 있다.
오픈AI ‘우려되는 모델 행동’ 6건 공개 17일(현지시각) 야후파이낸스에 따르면 오픈AI는 지난 16일 [...] [멕시코=심영재 특파원] 오픈AI가 테스트 과정에서 인공지능(AI) 모델이 지시받지 않았거나 해서는 안 되는 행동을 한 사례 6건을 공개했다.