LIVE MARKET
MARKET시세 연결 중
← 실시간 뉴스로

GPT-6 아스트라, 프론티어매스 Tier 4서 97.6%

제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.

KEY POINTS

핵심 포인트

  • GPT-6 아스트라가 프론티어매스 Tier 4(v2)에서 97.6%를 기록했다.
  • GPT-6 아스트라가 수학 추론 벤치마크 프론티어매스(FrontierMath) Tier 4(v2)에서 97.6%를 기록했다.
  • 오픈AI(OpenAI)는 공식 발표에서 자체 연구 환경 또는 API를 통해 GPT-6 아스트라를 평가한 결과 이 점수를 기록했다고 밝혔다.
시장 반응 중립
ARTICLE BRIEF

본문

GPT-6 아스트라가 프론티어매스 Tier 4(v2)에서 97.6%를 기록했다. GPT-6 아스트라가 수학 추론 벤치마크 프론티어매스(FrontierMath) Tier 4(v2)에서 97.6%를 기록했다. 오픈AI(OpenAI)는 공식 발표에서 자체 연구 환경 또는 API를 통해 GPT-6 아스트라를 평가한 결과 이 점수를 기록했다고 밝혔다. 같은 표에서 GPT-5.6 솔은 83.0%, 클로드 페이블 5.1은 87.8%를 기록했다. 프론티어매스 Tier 4(v2)는 연구 수준의 수학 문제를 다루는 평가다. Epoch AI는 전체 세트가 338개 문제로 구성됐으며, 이 가운데 295개는 Tiers 1~3, 43개는 Tier 4라고 밝혔다. Epoch AI는 이 문제의 최초 해결 모델로 GPT-6 아스트라를 기재했지만, 해결 방식은 ‘human + AI’로 표시했다.

Becker, Greger, Peters 연구진은 핵심 아이디어와 증명을 GPT-6 아스트라에 주로 귀속했지만 장시간 상호작용이 필요했다고 설명했다.

Epoch AI는 문제 페이지에서 “GPT-6 아스트라가 간단한 프롬프트만으로 문제를 바로 해결할 수 있었던 것은 아니다”라고 밝혔다. 따라서 ‘GPT-6 아스트라가 프론티어매스에서 첫 번째 Major Advance를 달성했다’는 표현은 서로 다른 사실을 합친 요약에 가깝다. 확인된 사실은 Tier 4(v2)에서 97.6%를 기록했다는 점과 별도 Open Problems 프로그램의 Major Advance 문제에 인간 연구자와 협업해 기여했다는 점이다. 프론티어매스 얼되시에서 GPT-6 아스트라의 공식 점수는 3%였고, Epoch AI는 고정된 조건에서 68개 문제 중 2개를 해결했다고 밝혔다.