관련링크
본문

※ 본 정보는 외부 공개 자료를 바탕으로 작성되었습니다. 기관 사정 등에 따라 변경 내용이 존재할 수 있습니다.
룩온체인에 따르면, 샤오미의 차세대 대형 언어 모델로 알려진 MiMo-V3-Pro 의 벤치마크 결과가 온라인 커뮤니티에 유출되었다고 한다. 유출된 벤치마크 결과에 따르면, MiMo-V3-Pro 는 SWE-Bench Pro에서 72.8점을 기록하며 코딩 에이전트 및 일반 에이전트 시나리오에 집중하고 있다고 한다.
이는 Claude Opus 5의 74.6점, GPT-5.6 Sol Max의 75.4점과 비교했을 때 3점 이내의 근소한 차이를 보이는 수준이며, GLM 5.3의 67.9점, Kimi K3의 65.8점보다는 높은 수치라고 전해진다. 또한 Terminal-Bench 2.0에서는 70.6점을, τ3-bench에서는 76.4점을 기록하며 일부 최고 수준의 해외 모델들과 어깨를 나란히 하는 성능을 보여주는 것으로 알려졌다.
만약 이 벤치마크 점수들이 공식적으로 확인되고 실제 제품에서도 재현된다면, MiMo-V3-Pro 는 세계 최고 수준의 모델들과 어깨를 나란히 할 잠재력을 가지고 있다고 볼 수 있다. 하지만 현재까지 유출된 벤치마크 스크린샷의 진위 여부와 테스트 환경에 대한 샤오미 측의 공식적인 확인은 이루어지지 않았기에, 해당 데이터는 아직 검증되지 않은 정보로 간주해야 한다.
◆샤오미 차세대 AI 'MiMo-V3-Pro', 벤치마크 결과 유출…GPT-5 근접 점수 (+샤오미, MiMo-V3-Pro, SWE-Bench Pro, AI모델)
|
|
|
|
|
|
|
댓글목록
등록된 댓글이 없습니다.


