LIVE MARKET
MARKET시세 연결 중
바로가기
← 실시간 뉴스로

마이크로소프트, 선택지별 확률 점수 매기는 AI 공개

제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.

KEY POINTS

핵심 포인트

  • 마이크로소프트가 분류·우선순위 지정·AI 에이전트 제어에 활용하는 Microsoft-Decision-1을 공개했다.
  • 자체 평가에서 36개 벤치마크의 약 15만개 질문을 대상으로 가장 높은 정확도를 기록했다고 밝혔다.
  • 마이크로소프트($MSFT)가 정해진 선택지에 점수를 매겨 분류와 우선순위 지정, AI 에이전트 제어에 활용하는 ‘Microsoft-Decision-1’을 공개했다.
시장 반응 중립MSFT
ARTICLE BRIEF

본문

마이크로소프트가 분류·우선순위 지정·AI 에이전트 제어에 활용하는 Microsoft-Decision-1을 공개했다. 자체 평가에서 36개 벤치마크의 약 15만개 질문을 대상으로 가장 높은 정확도를 기록했다고 밝혔다. 마이크로소프트($MSFT)가 정해진 선택지에 점수를 매겨 분류와 우선순위 지정, AI 에이전트 제어에 활용하는 ‘Microsoft-Decision-1’을 공개했다. 마이크로소프트는 2026년 10월 9일 개발자 간행물에서 모델을 소개했다. 활용 분야로는 요청 분류, 작업 우선순위 지정, AI 응답 검증, 모델 선택, 에이전트 행동 제어가 제시됐다. 마이크로소프트는 향후 마이크로소프트 AI와 오픈AI의 다른 모델을 기반으로도 업데이트할 계획이라고 밝혔다.

회사는 약 15만 개 질문을 포함한 36개 벤치마크에서 모델이 가장 높은 정확도를 기록했고, Quyet-1.0-Large보다 4.5배, GPT-6 Sol보다 35배 빠르게 측정됐다고 밝혔다.

입력 변형에 따른 결정 변화율은 평균 1.3%였으며, 유해 요청과 탈옥 시도, 프롬프트 인젝션을 포함한 11개 벤치마크의 5250개 요청도 평가했다고 설명했다. 설문과 Steam, X에 올라온 게임 관련 의견 1만 건 이상을 주제별로 분류했으며, 마이크로소프트는 GPT-6 Sol과 비슷한 품질을 14배 넘는 속도와 200분의 1 수준의 비용으로 얻었다고 밝혔다. 확률 점수는 자동 처리와 사람 검토를 나누는 기준으로 활용할 수 있다. 다만 점수 자체가 판단의 정확성을 보장하지는 않으며, 실제 업무에서는 오판에 따른 재작업과 검토 부담, 운영 비용도 함께 살펴야 한다. 현재 공개된 적용 사례는 마이크로소프트 내부 시험에 집중돼 있다.