AWS가 9월 28일 xAI의 Grok 4.7(그록 4.7)을 Amazon Bedrock에 제공한다고 발표했습니다. 기존 4.6 이용자라면 성능 점수와 함께 출력 토큰 사용량, 호출 지역, 실제 Bedrock 요금을 비교할 만합니다. 4.7은 긴 코딩·문서 작업을 겨냥하며 Global과 미국 지역 추론 프로필을 제공합니다. 출시 Hacker News 토론에서는 간결한 답변을 좋아한다는 의견과 지나치게 짧다는 불만이 함께 나왔습니다.

4.6에서 무엇이 달라졌나

AWS가 인용한 xAI 설명에 따르면 4.7은 더 큰 기반 모델과 긴 강화학습을 거쳤고, 작업 중 자신의 결과를 검토하는 능력에 초점을 맞췄습니다. 두 모델의 최대 입력 맥락은 모두 50만 토큰입니다. Bedrock 발표에 실린 Artificial Analysis의 독립 평가는 두 세대를 다음처럼 비교합니다.

평가 항목 Grok 4.7 Grok 4.6
Intelligence Index 46 44
Coding Agent Index 56 47
AA Briefcase 장기 지식 작업(Elo) 1,657 1,546
GDPval-AA 전문 작업물(Elo) 1,695 1,605
AA-Omniscience 환각률(낮을수록 좋음) 29% 34%
Intelligence Index 과제당 출력 토큰 약 8.1만 약 3.8만

4.7은 xhigh 추론 강도로 측정됐고, 4.6은 각 항목에 기재된 평가 강도를 사용했습니다. 점수는 올랐지만 과제당 출력 토큰도 두 배 남짓으로 늘었습니다. 같은 업무에서 비용이 얼마나 달라질지는 실제 토큰 사용량과 Bedrock 단가를 함께 봐야 알 수 있습니다. 한국어 작업이나 서울 출발 요청의 지연 시간은 이 표에 포함되지 않습니다.

서울에서 호출할 때 고를 경로

Bedrock의 4.7은 bedrock-runtime 엔드포인트에서 추론 프로필을 모델 ID로 지정합니다. global.xai.grok-4.7은 지원되는 상용 AWS 리전 사이로 요청을 보낼 수 있고, us.xai.grok-4.7은 미국 지역 안에서 처리합니다. Global은 지역 선택 폭이 넓고 AWS 설명상 미국 지역 프로필보다 저렴합니다. 미국 내 데이터 처리 조건이 있는 작업에는 미국 프로필이 맞습니다.

AWS 발표는 서울(ap-northeast-2)을 4.7 호출 출발 리전으로 명시하지 않습니다. 기존 4.6은 서울에서 Global 프로필로 호출할 수 있었지만, 4.7도 같은지는 Bedrock 콘솔의 해당 리전 모델 목록에서 계정별로 확인할 수 있습니다. 서울에서 Global을 고르더라도 요청 처리 장소는 서울로 고정되지 않습니다.

비교 Grok 4.7 Grok 4.6
최대 입력 맥락 50만 토큰 50만 토큰
Bedrock 호출 경로 Runtime의 Global·미국 추론 프로필 Mantle 오리건 리전 내, Runtime Global·미국 추론 프로필
서울 출발 호출 AWS 4.7 발표문에 명시되지 않음 모델 카드상 Runtime Global 출발 리전
Standard 공개 단가 발표문에 구체적 수치 없음 Global 입력 $2·출력 $6 / 미국 지역 입력 $2.20·출력 $6.60 (각 100만 토큰)

OpenAI 호환 Responses·Chat Completions API와 AWS Converse API를 모두 지원합니다. 기존 OpenAI SDK 코드에는 전자가 편하고, 여러 Bedrock 모델에 공통 메시지 형식을 쓰는 앱에는 Converse가 맞습니다. 입력은 텍스트와 이미지를 받고 출력은 텍스트입니다. 반복되는 긴 입력에는 자동 프롬프트 캐싱을 적용하며, JSON Schema 구조화 출력과 Bedrock Guardrails·호출 로그도 제공합니다. (AWS 발표)

비용을 가르는 두 설정 (9월 29일 기준)

서비스 티어는 약정 없는 토큰 종량제 Standard, 빠른 우선 처리의 Priority, 급하지 않은 작업에 낮은 요금을 적용하는 Flex로 나뉩니다. AWS 발표는 Global이 미국 지역 프로필보다 저렴하다고 설명하지만 4.7의 티어별 토큰 단가를 싣지 않았습니다. 위 표의 4.6 단가를 4.7 요금으로 적용할 근거는 없습니다. 요금은 Amazon Bedrock 가격표에서 호출 리전·추론 프로필·티어를 맞춰 확인합니다.

추론 강도는 low, medium, high, xhigh 중에서 고르며 기본값은 high입니다. 긴 에이전트 작업에는 높은 강도를 시험하고, 짧은 분류·요약을 반복한다면 낮은 강도부터 작업당 출력 토큰과 지연 시간을 비교하면 됩니다. 자동 캐싱이 적용되는 반복 접두부는 별도의 캐시 요금 기준을 확인할 수 있습니다.

출시 반응과 선택 기준 (9월 29일 기준)

Bedrock 제공에 앞서 9월 21일 xAI가 4.7을 공개했을 때 Hacker News 토론이 609점·댓글 539개를 기록했습니다. Bedrock 경로가 아니라 모델 자체를 두고 나온 반응입니다.

여러 댓글은 Grok의 간결한 영어 답변과, 다른 모델이 거절하는 요청도 덜 막는 점을 장점으로 꼽았습니다. 반대로 설명이 너무 짧아 용어를 다시 물었다는 불만과, 벤치마크 점수가 실제 코딩 경험과 다르다는 회의도 나왔습니다. 가장 많이 추천된 댓글은 4.7이 4.6보다 가중치가 40% 크지만 xAI 직접 API 단가(100만 토큰당 입력 $2·출력 $6)는 그대로라고 짚었는데, 이는 Bedrock 요금이 아니라 xAI API 기준입니다. 출시 직후 토론이라 기대와 개인 경험이 섞여 있고, 한국어 실사용 후기는 이 자료에서 확인되지 않습니다.

이미 4.6을 쓰고 있다면 같은 작업을 4.7에 보내 결과와 출력 토큰을 나란히 비교하는 것이 출발점입니다. 서울에서 호출한다면 먼저 4.7의 리전 표시를 확인하고, 데이터 처리 지역 조건에 따라 Global 또는 미국 프로필을 고릅니다.

참고한 자료