퍼플렉시티 문맥형 임베딩, ConTEB 81.96%…회사 제시
제목 연관성·주요 수치·시장 영향·향후 전망을 기준으로 핵심 문장을 선별한 요약 브리핑입니다.
핵심 포인트
- 퍼플렉시티가 문서 전체 맥락을 반영하는 임베딩 모델을 공개했다.
- 다만 취재 단서에 나온 최신 9B 모델 출시는 공식 자료에서 확인되지 않았다.
- 퍼플렉시티(Perplexity)의 문맥형 임베딩 모델이 문서 검색 벤치마크에서 nDCG@10 81.96%를 기록했다.
본문
퍼플렉시티가 문서 전체 맥락을 반영하는 임베딩 모델을 공개했다. 다만 취재 단서에 나온 최신 9B 모델 출시는 공식 자료에서 확인되지 않았다. 퍼플렉시티(Perplexity)의 문맥형 임베딩 모델이 문서 검색 벤치마크에서 nDCG@10 81.96%를 기록했다. 퍼플렉시티는 2026년 2월 26일 표준 검색용 ‘pplx-embed-v1’과 문맥형 검색용 ‘pplx-embed-context-v1’을 공개했다. 퍼플렉시티의 ‘pplx-embed-context-v1-4B’는 nDCG@10 81.96%를 기록했다. 퍼플렉시티는 같은 비교에서 Voyage의 ‘voyage-context-3’가 79.45%, 앤트로픽(Anthropic) 모델이 72.4%였다고 밝혔다.
OpenReview에 공개된 비교표에서 표준 검색용 ‘pplx-embed-v1-4B’는 다국어 MTEB 검색 부문 nDCG@10 69.66%를 기록했고, Qwen3-Embedding-4B는 69.60%, ‘gemini-embedding-001’은 67.71%로 집계됐다. 따라서 ConTEB의 81.96%와 MTEB의 69.66%를 같은 조건의 성능으로 비교할 수는 없다. API 가격은 4B 표준 모델이 100만 토큰당 0.03달러(약 41원), 4B 문맥형 모델이 0.05달러(약 68원)다. 한 개발자는 동일한 A100 환경에서 ‘pplx-embed-v1-4B’의 색인 속도가 Qwen3-Embedding-4B보다 약 7~8배 느렸다고 개인 실험 결과를 공유했지만, 일반적인 성능으로 보기는 어렵다. 퍼플렉시티 측은 해당 동작이 정상이라고 답했고, 문서의 ‘QPS’ 표기를 ‘초당 처리 가능한 조각 수’로 수정했다는 내용이 포럼 게시물에 담겼다.
퍼플렉시티가 표준 검색과 문맥형 검색을 각각 겨냥한다고 설명한 내용은 연구 논문에 정리돼 있으며, 퍼플렉시티 검색 API의 성능 비교는 본지가 앞서 보도한 내용에서도 다뤄졌다.