기타 Hacker News · 2026-09-24

초당 770토큰 쏟아내는 정신나간 속도의 신규 LLM 등장

핵심 요약
  • 신규 독점 LLM '머큐리 2.5'가 벤치마크에서 초당 770.4토큰을 기록하며 전체 175개 모델 중 속도 2위에 올랐습니다.
  • 지능 지수는 12점으로 중앙값 이하를 기록했으나, 간결한 출력과 저렴한 비용(입력 $0.25/출력 $0.75), 260k 콘텍스트를 갖췄습니다.
  • 고지능 복잡 추론보다는 실시간 고속 처리가 요구되는 작업에 적합한 가성비 속도 특화 모델로 평가받습니다.
요약 인공지능 모델 벤치마크 및 분석 플랫폼인 아티피셜 아날리시스(Artificial Analysis)에 신규 LLM인 '머큐리 2.5(Mercury 2.5)'의 성능 분석 결과가 공개되었습니다. 이번 평가에서 머큐리 2.5는 초당 770.4토큰(Output tokens per second)이라는 압도적인 출력 속도를 기록하며 전체 비교 대상 175개 모델 중 속도 부문 2위에 올랐습니다. 반면 지능 지표는 다소 아쉬운 편입니다. 아티피셜 아날리시스 지능 지수(Intelligence Index)에서 12점을 기록해 동일 가격대 및 체급 모델의 중앙값(13점)보다 낮았으며, 종합 순위는 175개 모델 중 91위에 머물렀습니다. 지능 평가 과정에서 생성된 토큰 수는 3500만 개로, 비교 모델 중앙값(8500만 개) 대비 상당히 간결한 답변을 출력하는 특성을 보였습니다. 비용 및 사양 면에서는 가격 경쟁력을 갖췄다는 평가를 받습니다. 입력 토큰은 100만 개당 0.25달러, 출력 토큰은 100만 개당 0.75달러로 책정되었으며 캐시 할인은 90%가 적용됩니다. 텍스트 입력과 텍스트 출력을 지원하며, 약 390장의 A4 분량에 달하는 26만 토큰(260k)의 콘텍스트 윈도를 지원하는 추론(Reasoning) 모델 버전으로 확인되었습니다. 고난도 지능 작업보다는 초고속 응답 속도와 간결한 답변, 비용 효율이 필요한 특수 작업 파이프라인에서 주목받을 것으로 보입니다.
Sponsored · 광고