핵심 요약
- SpaceXAI가 코딩 및 전문 지식 업무에 특화된 차세대 인공지능 모델 Grok 4.7을 발표했습니다.
- 이전 버전(4.6)과 동일한 가격(백만 토큰당 입력 $2, 출력 $6)을 유지하면서도 더 큰 베이스 모델과 장시간 과제 중심의 강화학습을 거쳐 가성비와 추론 성능을 크게 끌어올렸습니다.
- 현재 Cursor 및 전용 빌드 환경, API를 통해 즉시 사용할 수 있으며 탈옥 방지와 사이버 보안 안전 스택도 전면 강화되었습니다.
요약 SpaceXAI가 코딩 및 전문 지식 업무에 특화된 신규 인공지능 모델 'Grok 4.7'을 정식 공개했습니다. 이전 버전인 Grok 4.6과 동일한 가격과 속도를 유지하면서도 모델의 기반 체급과 성능을 대폭 끌어올린 점이 핵심입니다.
개발사 측 발표에 따르면 Grok 4.7은 Grok 4.6 대비 더 커진 신규 베이스 모델을 채택했으며, 수 시간이 소요되는 고난도 복합 과제에 초점을 맞춘 심화 강화학습(RL)을 거쳤습니다. 이에 따라 장시간 소요되는 작업 처리 능력이 향상되었고, 모델 자체의 검증 및 자가 수정 역량과 긴 컨텍스트 관리 성능이 대폭 강화되었습니다. 또한 Grok Bot 하네스를 자체적으로 이해하도록 훈련되어 대화형 업무 및 일반 지식 작업에서도 한층 자연스러운 처리가 가능합니다.
벤치마크 지표에서도 성능 향상이 두드러집니다. 장시간 코딩 과제를 평가하는 CursorBench 4.0에서 46.3%를 기록해 가격 대비 성능(가성비) 면에서 업계 최상위권을 기록했으며, 전문 소프트웨어 엔지니어링 벤치마크인 DeepSWE v1.1(고노력 기준) 71.0%, 전기공학 EEBench 64.0%를 기록했습니다. 법률·금융·의료 등 전문직 업무를 가늠하는 GDPval 및 AA Briefcase 벤치마크에서도 Fable 5.1 등 타사 프론티어 모델과 대등한 수준의 작업 처리력을 보여줬습니다.
보안과 안전성 측면에서는 전면 개편된 보호 스택이 적용되었습니다. 위험 작업 거부 및 탈옥 방지 평가에서 역대 최고 성적을 거두었으며, 특히 사이버 보안 위협 평가인 HackerBench v0.3에서는 악용 소지가 있는 프롬프트의 통과율을 3.3% 수준으로 억제하면서도 합법적인 보안 연구 작업은 정상 수행하도록 튜닝되었습니다. 현재 Grok 4.7은 백만 토큰당 입력 2달러, 출력 6달러로 책정되어 Cursor, Grok Build, Grok API를 통해 바로 이용할 수 있습니다.
Sponsored · 광고