LIVE MARKET
MARKET시세 연결 중
바로가기
← 실시간 뉴스로

Claude Sonnet 5.5가 Arena의 Agent Arena 리더보드에서 3위를 차지했습니다.

제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.

KEY POINTS

핵심 포인트

  • Anthropic의 Claude Sonnet 5.5는 12.52%의 순 개선 점수와 작업당 $2.74의 비용으로 Arena의 Agent Arena에서 3위를 차지했습니다.
  • Anthropic의 중간 계층 모델은 12.52%의 순 개선 점수를 기록했으며 이제 더 비싼 형제 자매 중 단 두 명만을 뒤쫓고 있습니다.
  • Anthropic의 최신 중간 계층 모델은 Arena.ai의 Agent Arena 리더보드에서 3위를 차지했습니다.
시장 반응 긍정
ARTICLE BRIEF

본문

Anthropic의 Claude Sonnet 5.5는 12.52%의 순 개선 점수와 작업당 $2.74의 비용으로 Arena의 Agent Arena에서 3위를 차지했습니다. Anthropic의 중간 계층 모델은 12.52%의 순 개선 점수를 기록했으며 이제 더 비싼 형제 자매 중 단 두 명만을 뒤쫓고 있습니다. Anthropic의 최신 중간 계층 모델은 Arena.ai의 Agent Arena 리더보드에서 3위를 차지했습니다. Claude Sonnet 5.5는 12.5%의 순 개선 점수를 기록하여 OpenAI의 상위 항목보다 앞서 있습니다. Claude Sonnet 5.5는 2026년 9월 28일에 출시되었습니다. 며칠 만에 Agent Arena에서 3위 자리에 올랐습니다. 위의 두 모델은 Claude Fable 5.1(Max)이 14.31%이고 Claude Opus 5.5(High)가 13.82%입니다.

Agent Arena는 AI가 도구를 사용하고 다단계 작업을 완료하며 실제 사용자를 만족시켜야 하는 수백만 개의 실제 에이전트 작업에 대한 모델의 등급을 매깁니다. Arena에서는 Sonnet 5.5를 작업당 2.74달러로 표시하고 있으며, 10월 초 스냅샷에 따르면 중간 비용은 작업당 약 2.78달러입니다. 인공분석 지능지수에서는 56점으로 Opus 5.5(Max)에 이어 2위를 기록했습니다. Terminal-Bench 4.0에서는 Sonnet 5.5가 70.6%를 기록했습니다. 비교를 위해 이전 제품인 Sonnet 5는 동일한 테스트에서 대략 10~14%를 관리했습니다. Claude Sonnet 5.5가 Arena의 Agent Arena 리더보드에서 3위를 차지한 게시물이 Crypto Briefing에 처음 등장했습니다.