MiMo-v2.6-Pro: 지능, 성능 및 가격 분석

2 weeks ago 15

MiMo-V2.6-Pro는 Artificial Analysis Intelligence Index에서 46점을 기록해, 비슷한 크기의 공개 가중치 모델 중앙값인 18점을 크게 웃돎 MoE 구조로 전체 파라미터 1조 개 중 추론 시 420억 개를 활성화하며, MIT 라이선스로 가중치를 공개해 상업적 사용과 자체 호스팅이 가능함 텍스트, 이미지, 음성, 영상 입력과 텍스트 출력을 지원하며, 100만 토큰 컨텍스트 윈도를 제공하는 추론 모델임 Xiaomi API 기준 출력 속도는 초당 57.9토큰으로 비교군 중앙값 67.7토큰보다 느리며, 첫 토큰까지 걸리는 시간도 2.61초로 중앙값 2.34초보다 김 API 가격은 100만 토큰당 입력 약 0.43달러, 출력 0.87달러이며, Intelligence Index 전체 평가 비용은 206.66달러임 모델 구조와 사용 범위 Xiaomi의 MiMo-V2.6-Pro는 복잡한 문제에 답하기 전 확장된 사고 또는 사고 사슬 추론을 사용하는 모델임 분석 대상은 추론 버전이며, 비추론 변형도 존재할 수 있음 텍스트, 이미지, 음성, 영상을 입력받아 텍스트를 출력하며, 이미지 분석과 설명, 이미지 관련 질의응답을 지원함 전체 파라미터는 1조 개, 활성 파라미터는 420억 개인 MoE 모델임 MoE는 라우팅 메커니즘으로 토큰마다 일부 전문가를 선택하므로 활성 파라미터가 전체보다 적음 밀집 모델은 모든 파라미터를 사용하므로 전체와 활성 파라미터 수가 같음 MIT 라이선스로 상업적 사용이 가능하며, Hugging Face의 모델 가중치를 내려받아 자체 호스팅할 수 있음 컨텍스트 윈도는 100만 토큰으로, Arial 12포인트 기준 A4 약 1,500쪽에 해당함 컨텍스트 한도는 입력과 출력 토큰의 합이며, 출력 토큰 한도는 일반적으로 이보다 훨씬 작고 모델마다 다름 큰 컨텍스트 윈도는 대량 데이터에서 정보를 검색하고 추론하는 RAG 워크플로와 관련이 있음 API 제공업체는 1곳이며, 제공업체 비교 페이지에서 가격과 성능을 확인할 수 있음 지능 점수와 비교 기준 Artificial Analysis Intelligence Index 점수는 46점으로, 비슷한 크기의 공개 가중치 모델 중앙값 18점보다 높음 Intelligence Index v4.3.2는 추론, 지식, 수학, 코딩 등을 종합하며 10개 평가로 구성됨 AA-Briefcase v1.1, GDPval-AA v2.1, Automation...

Read Entire Article