xAI Grok 4.7 공개, 500,000토큰 문맥·텍스트와 이미지 입력

xAI Grok 4.7 공개, 500,000토큰 문맥·텍스트와 이미지 입력

기사 이해를 돕기 위한 이미지

xAI가 2026년 9월 21일(현지시각) Grok 4.7을 공개했다. 회사는 코딩을 비롯한 여러 평가에서 이전 모델인 Grok 4.6보다 높은 수치를 제시했으며, 기본 요금은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러로 책정했다. 출력 속도를 2배로 높인 Fast 변형은 가격도 2배라고 밝혔다.

50만 토큰 문맥과 멀티모달 입력

xAI 문서에 기재된 모델 ID는 grok-4.7이다. 문맥 창은 500,000토큰이며 텍스트와 이미지를 입력으로 받을 수 있다. 출력 형식은 텍스트만 지원한다.

추론 노력 설정은 Low, medium, high, xhigh 가운데 선택할 수 있으며 기본값은 high다. Grok 4.7은 Cursor와 Grok Build에서 제공되고 Grok API, 제3자 코딩 하네스, 모델 라우터와 클라우드 플랫폼에서도 이용할 수 있다.

xAI 발표 평가와 경쟁 모델 점수

xAI가 공개한 평가표에서 Grok 4.7은 CursorBench 4.0 46.3%, EEBench 64.0%, AA Briefcase v1.1 1,657, Terminal-Bench 4.0 37.6%, Harvey Legal Agent 19.6%를 기록했다. Grok 4.6의 수치는 각각 40.4%, 53.0%, 1,546, 20.3%, 15.8%였다.

같은 회사 발표표에서 Fable 5.1은 CursorBench 4.0 51.8%, AA Briefcase v1.1 1,678, Terminal-Bench 4.0 57.9%로 Grok 4.7보다 높았다. 반면 EEBench와 Harvey Legal Agent에서 Fable 5.1은 각각 56.4%와 6.7%였다.

high effort 조건의 DeepSWE v1.1에서 xAI가 발표한 Grok 4.7 점수는 71.0%로 Grok 4.6의 65.2%와 Fable 5.1의 70.0%를 웃돌았지만 GPT-5.6 Sol의 72.7%에는 미치지 못했다. HealthBench Professional에서는 Grok 4.7이 56.7%였고 GPT-5.6 Sol은 60.5%, Fable 5.1은 62.1%였다.

독립 평가에서 확인된 순위와 속도

독립 평가기관 Artificial Analysis는 xhigh 설정의 Grok 4.7에 Intelligence Index 46점을 부여해 212개 모델 중 21위로 집계했다. 측정된 출력 속도는 초당 39.2토큰으로 비교 대상 중앙값인 초당 71토큰보다 낮았고, 첫 토큰이 나오기까지 걸린 시간은 0.87초였다.

Artificial Analysis가 표시한 가격은 입력 100만 토큰당 2.00달러, 출력 100만 토큰당 6.00달러이며 캐시 할인율은 75%다. Intelligence Index 과제당 가중 비용은 3.74달러로 집계됐다. VentureBeat는 이 기관의 데이터를 인용해 xHigh 설정에서 과제당 출력 토큰이 81,000개로 GPT-6 Astra보다 196% 많았으며, 과제당 비용은 약 3.74달러로 GPT-5.6 Sol의 1.99달러보다 높았다고 보도했다.

평가기관별 Terminal-Bench 수치 차이

Vals AI의 독립 평가에서 Grok 4.7은 Vals Index 60.22%로 59개 모델 중 10위였다. Grok 4.6은 59.17%, Grok 4.5는 51.53%였으며 Grok 4.7의 테스트당 비용은 11.92달러로 제시됐다. 세부 평가 순위는 MedScribe 89.38%로 96개 중 4위, Terminal-Bench 4.0 28.28%로 31개 중 4위, Vibe Code Bench 86.17%로 97개 중 5위였다. ProofBench와 SAGE에서는 상대적으로 약한 결과가 보고됐다.

xAI 발표값은 37.6%였지만 Vals AI의 독립 측정값은 28.28%였고, VentureBeat 보도에는 38.0%와 xHigh 설정의 26%가 각각 제시됐다. VentureBeat는 xHigh 조건에서 GPT-6 Astra가 59.6%였다고 전했으며, The Decoder는 Grok 4.7 26%, GPT-6 Astra 60%, Claude Fable 5.1 55%로 보도했다.

GitHub는 Copilot Pro, Pro+, Max, Business, Enterprise 요금제에 Grok 4.7을 점진적으로 배포하고 있다. 적용 대상은 VS Code, Visual Studio, Copilot CLI, GitHub의 클라우드 에이전트, JetBrains, Xcode, Eclipse다. VentureBeat가 전한 요금은 표준형 입력·출력 100만 토큰당 2달러·6달러, Fast 변형 4달러·12달러이며 Cursor의 256K토큰 초과 Fast 구간은 6달러·18달러다.

참고 자료 바로가기

관련 기사 바로가기