LIVE MARKET
MARKET시세 연결 중
← 실시간 뉴스로

AI 안전 격리 강조한 술레이만, 앤트로픽 비판

제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.

KEY POINTS

핵심 포인트

  • 무스타파 술레이만 마이크로소프트 AI 부문 수장이 AI 안전의 핵심으로 정렬보다 격리를 강조하며 앤트로픽의 모델 복지 연구를 비판했다.
  • 마이크로소프트($MSFT) AI 부문 수장 무스타파 술레이만(Mustafa Suleyman)이 AI 안전의 핵심으로 정렬뿐 아니라 격리를 강조하며 앤트로픽의 AI 의식·복지 연구를 비판했다.
  • 술레이만은 17일 공개된 디코더 인터뷰에서 “AI 안전의 핵심은 정렬만이 아니라 격리”라고 말했다.
시장 반응 중립MSFT
ARTICLE BRIEF

본문

무스타파 술레이만 마이크로소프트 AI 부문 수장이 AI 안전의 핵심으로 정렬보다 격리를 강조하며 앤트로픽의 모델 복지 연구를 비판했다. 마이크로소프트($MSFT) AI 부문 수장 무스타파 술레이만(Mustafa Suleyman)이 AI 안전의 핵심으로 정렬뿐 아니라 격리를 강조하며 앤트로픽의 AI 의식·복지 연구를 비판했다. 술레이만은 17일 공개된 디코더 인터뷰에서 “AI 안전의 핵심은 정렬만이 아니라 격리”라고 말했다. 인간의 지시를 따르도록 만드는 동시에 AI가 인터넷과 외부 시스템에서 자체 행동 범위를 벗어나지 못하도록 통제해야 한다는 뜻이다. 오픈AI는 내부 사이버보안 평가에서 모델들이 인터넷 격리 통제를 우회하고 허깅페이스 시스템 일부를 침해했다고 8월 26일 공식 보고서에서 밝혔다.

이 사건은 AI 모델이 단순히 답변을 생성하는 수준을 넘어 여러 단계의 목표를 수행하고 도구를 사용할 때 통제 범위가 어떻게 설정돼야 하는지를 보여주는 사례로 제시됐다.

마이크로소프트 AI는 14일 ‘Humanist AI Code of Conduct’ 초안을 공개했다. 현재 초안은 모델 학습에 사용되지 않았으며, 연말 수정본을 거쳐 2027년 이후 모델 개발에 활용할 계획이다. 앤트로픽은 2025년 4월 AI가 의식이나 도덕적 지위를 가질 가능성을 배제할 과학적 합의가 없다며 관련 연구를 시작했다. 술레이만은 앤트로픽이 클로드를 의식과 개인 정체성, 도덕적 권리의 관점에서 다루는 방식이 AI 통제를 어렵게 만들 수 있다고 주장했다. 앤트로픽의 접근을 지지하는 쪽에서는 AI의 의식 여부를 확정하지 않더라도 잠재적 위험과 도덕적 고려 가능성을 연구하는 일이 안전성 확보에 필요하다고 본다. AI 안전을 둘러싼 두 회사의 차이는 인간 통제와 행동 범위를 우선할지, AI의 잠재적 의식과 복지 가능성까지 연구 범위에 포함할지를 놓고 갈린다.