관련링크
본문

OpenAI의 GPT-6 Astra 모델이 Perplexity의 연구 에이전트 순위에서 0.682라는 역대 최고 점수를 기록하며 AI 성능의 새로운 기준을 제시했습니다. 이는 이전 최고 성능 모델 대비 13.5% 향상된 수치로, AI 연구 분야에 큰 진전을 알리고 있습니다.
Perplexity는 자체 개발한 WANDR 벤치마크 툴을 사용하여 GPT-6 Astra를 테스트했으며, 그 결과 Claude Fable 5.1보다. 13.5% 높은 점수를 획득했습니다.
또한, GPT-6 Astra는 비용 측면에서도 6.1% 더 저렴한 것으로 나타나 뛰어난 비용 효율성을 입증했습니다. Opus 5 모델과 비교했을 때 GPT-6 Astra는 27% 높은 점수를 기록했으며, 비용 증가는 3.3%에 불과하여 전반적인 성능과 비용 효율성에서 압도적인 우위를 보였습니다.
Perplexity의 WANDR 벤치마크는 500개의 실제 연구 과제를 포함하며, 복잡한 정보 처리 및 검증 능력을 심층적으로 평가합니다. 이러한 평가는 AI 모델이 실제 연구 수행 능력을 얼마나 갖추고 있는지를 다각도로 측정하는 중요한 기준을 제시합니다.
◆GPT-6 Astra, Perplexity 벤치마크 1위… 성능 13.5%↑, 비용 6.1%↓ (+GPT-6 Astra, Perplexity, AI 성능, 비용 효율성)
|
|
|
|
|
|
추천 0 반대 0
댓글목록
등록된 댓글이 없습니다.





