Nous Research, 에이전트 AI 모델을 벤치마킹하기 위해 Hermes Index 출시
제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.
핵심 포인트
- Nous Research는 새로운 Hermes를 포함한 4개 벤치마크에서 에이전트 성능 및 작업당 비용에 대한 AI 모델의 순위를 매기는 Hermes Index를 출시했습니다.
- 오픈 소스 연구소의 새로운 리더보드는 에이전트 성능 및 비용에 대한 14개 개척 모델의 순위를 매겼으며 Claude Opus 5.5가 1위를 차지했습니다.
- Nous Research는 AI 업계가 계속 가지고 있는 논쟁, 즉 어떤 모델이 실제로 작업을 완료하는지, 그리고 알아내는 데 드는 비용은 얼마인지에 대해 AI 업계가 계속 가지고 있는 논쟁을 해결하고자 합니다.
본문
Nous Research는 새로운 Hermes를 포함한 4개 벤치마크에서 에이전트 성능 및 작업당 비용에 대한 AI 모델의 순위를 매기는 Hermes Index를 출시했습니다. 오픈 소스 연구소의 새로운 리더보드는 에이전트 성능 및 비용에 대한 14개 개척 모델의 순위를 매겼으며 Claude Opus 5.5가 1위를 차지했습니다. Nous Research는 AI 업계가 계속 가지고 있는 논쟁, 즉 어떤 모델이 실제로 작업을 완료하는지, 그리고 알아내는 데 드는 비용은 얼마인지에 대해 AI 업계가 계속 가지고 있는 논쟁을 해결하고자 합니다. 오픈 소스 AI 연구소는 2026년 10월 6일에 Hermes Index를 출시했습니다. 이 지수는 회사의 Hermes Agent 프레임워크 내에서 에이전트로서 얼마나 잘 수행되는지에 대한 개척 모델의 순위를 매깁니다.
이 모든 것은 Nous Research가 2026년 2월 25일에 시작한 Hermes Agent를 통해 실행됩니다. Nous Research는 첫 번째 인덱스 버전에서 14개의 다양한 모델을 테스트했습니다. 지수가 출시된 지 하루 만인 2026년 10월 7일, Nous Research는 9천만 달러의 새로운 자금을 확보했습니다. 이번 라운드를 통해 연구소의 총 자본금은 약 1억 6천만 달러로 늘어났습니다. Nous Research는 이 자금이 Hermes 기술의 기업 배포 확장을 목표로 한다고 밝혔습니다. Hermes Agent는 2026년 2월에 출시되었으며 이제 Hermes Index를 통해 연구소는 자체 분야에서 업계 최대 모델의 등급을 공개적으로 평가할 수 있습니다. 이 지수는 Nous Research의 자체 Hermes Agent 프레임워크 내부 성능을 측정합니다.
Hermes 지수는 비용 효율성과 성능을 강조하여 AI 모델 평가를 재구성하여 잠재적으로 기업 채택에 영향을 미칠 수 있습니다. Nous Research가 에이전트 AI 모델을 벤치마킹하기 위해 Hermes Index를 출시한 게시물이 Crypto Briefing에 처음 등장했습니다.