Artificial Analysis 벤치마크서 Inception Mercury 2.5 LLM, 770 tokens/s로 속도 2위…260k context와 낮은 출력 비용, 지능 지표는 평균 이하
편집자 요약
Artificial Analysis 기준 Mercury 2.5는 175개 모델 중 속도 2위에 해당하는 770.4 output tokens/s를 기록했습니다. 다만 Intelligence Index는 12점으로 중앙값 13보다 낮아 지능 평가는 평균 이하이며, text 입출력과 260k tokens context window를 지원합니다. 가격은 1M input tokens당 $0.25, 1M output tokens당 $0.75로 중간 수준이며 cache discount는 90%입니다.
인사이트
Mercury 2.5는 최고 수준의 추론 품질보다 저지연·대량 처리에 최적화된 모델로, 실시간 응답형 서비스나 비용 민감도가 높은 워크로드에 적합한 포지션입니다. 최근 LLM 시장은 단일 지능 점수 경쟁에서 벗어나 속도, context window, token 단가를 조합한 세분화 경쟁으로 이동하고 있습니다.
댓글
토론
> geekhaus:~$ 다음 읽을거리?

