기타 Hacker News · 6일 전

나온 지 딱 7일 만에 전작 관짝 보낸 GPT-6.1 Sol 스펙 요약 ㄷㄷ

핵심 요약
  • GPT-6 Sol이 공개된 지 불과 일주일 만에 성능을 대폭 개선한 후속 모델 GPT-6.1 Sol이 전격 발표되었습니다.
  • 최상위 모델인 GPT-6 Astra에 불과 1점 뒤처지는 지능을 달성하면서도 작업당 비용은 Astra의 4분의 1 미만으로 낮췄습니다.
  • 기본 토큰 단가는 유지하되 캐시 할인율을 95%로 높였으며 코딩 에이전트 지수 등 실무 벤치마크 전반에서 유의미한 점수 상승을 기록했습니다.
요약 인공지능 모델의 교체 주기가 경이로운 수준으로 빨라지고 있습니다. 인공지능 분석 플랫폼 아티피셜 애널리시스(Artificial Analysis)에 따르면, GPT-6 Sol이 출시된 지 불과 7일 만에 이를 대체하는 후속 모델 'GPT-6.1 Sol'이 전격 공개되었습니다. 새롭게 등장한 GPT-6.1 Sol의 핵심은 최상위급 플래그십 모델에 육박하는 지능을 획기적으로 낮아진 비용에 제공한다는 점입니다. 이 모델은 종합 지능 지수(Intelligence Index)에서 이전 모델인 GPT-6 Sol 대비 4점, 이전 세대인 GPT-5.6 Sol 대비 5점 상승하며 플래그십인 GPT-6 Astra에 불과 1점 뒤처지는 성능을 기록했습니다. 반면 최고 성능 기준 작업당 처리 비용은 0.72달러 수준으로, GPT-6 Astra(3.26달러)의 4분의 1도 안 되며 GPT-6 Sol(1.05달러)보다도 31% 저렴합니다. 토큰당 기본 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러로 GPT-6 Sol과 동일하지만, 캐시 읽기 할인율이 기존 90%에서 95%로 상향 조정되어 에이전트 작업 부하 시 실제 체감 비용은 더 낮아졌습니다. 전체적인 출력 토큰 사용량은 이전보다 10~30% 늘어났으나, 대폭 향상된 지능 덕분에 전반적인 가성비 파레토 프론티어를 새롭게 경신했습니다. 세부 성능을 살펴보면 코딩 및 지식 기반 작업에서 큰 폭의 도약이 두드러집니다. 터미널 벤치 4.0에서 12점 급상승했고, GDPval-AA와 AA-브리프케이스 등 에이전트 지식 평가에서도 각각 4~5점 올랐습니다. 특히 코딩 에이전트 지수 xhigh 설정에서는 최대 노력(max) 설정을 3점 상회하며 플래그십인 GPT-6 Astra보다 1점 높은 점수를 15% 미만의 비용으로 달성했습니다. 아울러 정확도 향상과 함께 할루시네이션(환각) 비율도 60%에서 54%로 6%포인트 감소했습니다. 일주일 만에 전작을 구형으로 만들어버린 초고속 세대교체에 테크 커뮤니티의 시선이 집중되고 있습니다.
Sponsored · 광고