핵심 요약
- 매일 갱신되는 벤치마크 데이터를 바탕으로 예산별 최적의 가성비 LLM을 찾아주는 비교 웹사이트가 공개되었습니다.
- 가격 대비 성능 곡선(Value Frontier)을 통해 더 저렴한 대체재가 있는 비효율적인 모델을 배제하고 최선의 선택지를 바로 확인할 수 있습니다.
- 100만 토큰당 혼합 비용 기준이며, 깃허브 액션을 통해 신규 모델 추가 및 가격 변동 내역이 매일 자동 반영됩니다.
요약 개발자 테리 드조니(Terry Djony)가 공개한 'Best LLM for every budget'은 인공지능(AI) 모델의 성능 대비 가성비를 한눈에 비교할 수 있는 대시보드 프로젝트다. 벤치마크 및 가격 분석 전문 사이트인 Artificial Analysis의 무료 데이터 API를 기반으로 하며, 깃허브 액션(GitHub Actions) 크론 작업을 통해 매일 자동으로 최신 데이터를 수집·갱신한다.
이 사이트의 핵심 기능은 '가치 프론티어(Value Frontier)' 개념을 도입해 사용자의 예산 구간별로 가장 뛰어난 모델을 추천해 준다는 점이다. 가격 순으로 정렬했을 때 더 저렴하면서 성능까지 앞서는 비효율적인 모델(Dominated)은 걸러내고, 동일 가격대에서 가장 지능 지수가 높은 최선의 선택지(Pick)와 차선책(Runner-up)을 표 형태로 즉시 보여준다. 지능 점수뿐만 아니라 코딩, 수학 성능 지표도 함께 제공된다.
비용 계산은 Artificial Analysis의 기준인 입력 3 대 출력 1 비율을 적용한 '100만 토큰당 혼합 비용(Blended cost)'을 기준으로 산출된다. 단, 캐시 할인이나 배치(batch) 가격 정책, 패스트 모드 등은 반영되지 않는다. 또한 '모델당 1개 행(One row per model)' 필터를 지원하여, reasoning 모델의 추론 강도(low, medium, high 등)별 세부 파생 모델 중 가장 점수가 높은 대표 모델만 깔끔하게 추려볼 수 있도록 편의성을 높였다. 전일 대비 가격 변동, 점수 변경, 신규 추가 및 삭제 모델을 보여주는 디프(Diff) 기능도 제공되어 LLM 생태계의 가성비 변동 추이를 추적하기 유용하다.
Sponsored · 광고