Grok 4.3은 현재 xAI API에서 텍스트와 이미지를 입력받아 텍스트를 출력하는 모델이다. 함수 호출, 구조화된 출력, none·low·medium·high 네 단계의 추론 설정을 지원하며 컨텍스트 윈도우는 100만 토큰이다. xAI 모델 페이지는 빠르고 안정적이며 도구 호출과 지시 이행에 강한 모델로 설명한다.
다만 100만 토큰을 모두 쓸 수 있다는 사양만 보고 비용을 계산하면 오차가 커진다. 프롬프트가 20만 토큰에 도달하면 입력뿐 아니라 캐시 입력과 출력까지 장문 요율이 요청 전체에 적용된다. 반대로 요청을 20만 토큰 아래로 관리하고 Batch API를 쓸 수 있다면 공식 가격표상 20% 할인을 받을 수 있다.
현재 xAI 모델 선택 페이지는 코드와 일반 채팅의 기본 추천을 Grok 4.6으로 제시한다. Grok 4.3은 최신 플래그십의 대체재라기보다, 더 큰 컨텍스트와 낮은 토큰 비용이 우선인 작업, 또는 2026년 5월에 종료된 구형 모델에서 이전하는 작업에 맞춰 검토할 모델이다.
정확히 어떤 모델인가
| 항목 | xAI 공식 문서상 내용 |
|---|---|
| 공식 제품명·API ID | Grok 4.3 · grok-4.3 |
| 별칭 | grok-4.3-latest |
| 입력·출력 | 텍스트·이미지 입력, 텍스트 출력 |
| 컨텍스트 윈도우 | 1,000,000 토큰 |
| 기능 | 함수 호출, 구조화된 출력, 조절 가능한 추론 |
| 추론 노력 | none, low, medium, high |
| 기본 토큰 단가 | 입력 $1.25, 캐시 입력 $0.20, 출력 $2.50 / 1M 토큰 |
| 장문 기준 | 프롬프트 200,000토큰 이상 |
| 장문 토큰 단가 | 입력 $2.50, 캐시 입력 $0.40, 출력 $5.00 / 1M 토큰 |
| Batch API | 지원, 가격표상 토큰 요금 20% 할인 |
| 모델 페이지 표기 한도 | 초당 37요청, 분당 10,000,000토큰 |
모델 페이지에는 최대 출력 토큰 수가 별도 수치로 적혀 있지 않다. 100만 토큰은 컨텍스트 윈도우이며 같은 수치를 최대 출력량으로 읽어서는 안 된다. 긴 결과물을 생성해야 하는 시스템은 실제 계정과 엔드포인트에서 출력 한도, 리전별 제공 조건, 처리량을 다시 확인해야 한다.
구형 Grok에서 무엇이 달라지는가
xAI는 2026년 5월 15일 낮 12시(미국 태평양 시간)에 여러 구형 API 모델을 종료했다. 종료 뒤에도 해당 slug는 사라지지 않지만 요청은 다른 모델로 자동 전환된다. 추론형 모델은 대체로 Grok 4.3의 low 추론으로, 비추론형 모델은 none 추론으로 처리된다.
| 기존 slug | 2026년 5월 15일 이후 공식 전환 대상 |
|---|---|
grok-4-1-fast-reasoning |
grok-4.3, low |
grok-4-fast-reasoning |
grok-4.3, low |
grok-4-0709 |
grok-4.3, low |
grok-4-1-fast-non-reasoning |
grok-4.3, none |
grok-4-fast-non-reasoning |
grok-4.3, none |
grok-3 |
grok-4.3, none |
코드 전용 grok-code-fast-1은 Grok 4.3이 아니라 grok-build-0.1로 전환된다. 이미지 모델도 별도 대체 모델을 사용한다. 따라서 “모든 구형 Grok가 4.3으로 바뀐다”는 해석은 맞지 않는다.
자동 전환은 기존 코드가 바로 깨지는 일을 줄여 주지만 모델 선택을 그대로 둬도 된다는 뜻은 아니다. xAI는 종료된 slug로 계속 요청해도 Grok 4.3 요금이 청구된다고 설명하며, 예상하지 못한 비용 변화를 막으려면 작업별 대체 모델과 추론 노력을 명시적으로 선택하라고 권고한다.
공식 문서에서 확인되는 성능 범위
전환 안내는 Grok 4.3이 에이전트형 도구 호출과 지시 이행 관련 리더보드에서 높은 위치라고 설명하지만 점수, 평가 세트, 비교 모델, 실행 조건은 싣지 않는다. 모델 페이지도 “강한 도구 호출과 지시 이행”이라는 제품 설명만 제공한다.
따라서 이 자료만으로 데이터 분석, 코딩, 한국어, 장문 검색 중 어느 영역에서 경쟁 모델보다 우수하거나 부족한지 수치화할 수 없다. 이 글의 비교는 같은 xAI 가격표와 모델 선택 페이지에서 직접 맞출 수 있는 컨텍스트, 비용, 운영 조건으로 제한한다.
Grok 4.5·4.6과 비교
| 항목 | Grok 4.3 | Grok 4.5 | Grok 4.6 |
|---|---|---|---|
| 컨텍스트 | 1,000,000 | 500,000 | 500,000 |
| 20만 토큰 미만 입력 | $1.25 / 1M | $2.00 / 1M | $2.00 / 1M |
| 20만 토큰 미만 캐시 입력 | $0.20 / 1M | $0.30 / 1M | $0.50 / 1M |
| 20만 토큰 미만 출력 | $2.50 / 1M | $6.00 / 1M | $6.00 / 1M |
| 20만 토큰 이상 입력 | $2.50 / 1M | $4.00 / 1M | $4.00 / 1M |
| 20만 토큰 이상 캐시 입력 | $0.40 / 1M | $0.60 / 1M | $1.00 / 1M |
| 20만 토큰 이상 출력 | $5.00 / 1M | $12.00 / 1M | $12.00 / 1M |
| 가격표상 Batch 할인 | 20% | 없음 | 없음 |
Grok 4.3은 세 모델 중 컨텍스트가 가장 크고 모든 토큰 단가가 가장 낮다. 특히 출력은 단문·장문 구간 모두 Grok 4.5와 4.6의 절반보다 낮다. 대량 요약, 문서 분류, 도구 호출처럼 품질 기준을 자체 평가할 수 있고 비용 민감도가 높은 작업에서는 먼저 시험할 근거가 있다.
반면 현재 xAI 모델 선택 페이지는 코드와 일반 채팅에 Grok 4.6을 권한다. 공식 자료에는 Grok 4.3과 4.5·4.6을 같은 조건으로 실행한 점수가 없으므로 낮은 가격을 곧바로 더 높은 성능이나 더 좋은 가성비로 바꿔 말할 수는 없다. 신규 코딩 에이전트처럼 실패 비용이 큰 작업은 Grok 4.6과 동일 프롬프트·도구·성공 기준으로 회귀 평가한 뒤 결정하는 편이 안전하다.
가격과 실제 선택 조건
Grok 4.3의 표준 요금은 100만 토큰당 입력 $1.25, 캐시 입력 $0.20, 출력 $2.50이다. 프롬프트가 200,000토큰 이상이면 입력 $2.50, 캐시 입력 $0.40, 출력 $5.00의 장문 요율이 요청 전체에 적용된다. 20만 토큰을 넘긴 부분만 비싸지는 구조가 아니다.
캐시 미적중 요청에 공식 단가를 단순 적용하면 경계 효과는 다음과 같다.
| 예시 요청 | 계산 | 토큰 비용 |
|---|---|---|
| 입력 199,000 + 출력 10,000 | 199,000 × $1.25/1M + 10,000 × $2.50/1M | $0.27375 |
| 입력 200,000 + 출력 10,000 | 200,000 × $2.50/1M + 10,000 × $5.00/1M | $0.55000 |
입력이 1,000토큰 늘었지만 두 번째 요청의 토큰 비용은 약 2.01배가 된다. 장문 에이전트에서는 요청 전에 토큰 수를 추정하고 20만 토큰 근처에서 맥락 압축, 검색 범위 축소, 작업 분할 중 하나를 적용해야 비용을 예측하기 쉽다.
각 요청이 20만 토큰 아래인 월간 1,000만 입력 토큰과 200만 출력 토큰을 가정하면 실시간 API 토큰 비용은 $17.50이다. 같은 작업이 Batch API 요건을 충족하면 가격표의 20% 할인 적용 후 $14.00이다. Batch는 비동기 처리이므로 즉시 응답이 필요한 서비스와는 맞지 않는다.
웹 검색, X 검색, 코드 실행을 사용하면 토큰 비용 외에 각 도구 호출료가 붙는다. xAI 가격표는 세 도구를 각각 1,000회당 $5로 표시한다. 에이전트가 호출 횟수를 자율적으로 늘릴 수 있으므로 토큰 예산과 도구 호출 상한을 따로 두는 편이 낫다.
먼저 답하면
- 추천 작업: 20만 토큰 아래의 대량 비동기 처리, 긴 문서 맥락, 비용 상한이 분명한 도구 호출 워크플로
- 비추천 작업: 현재 xAI 플래그십을 기본값으로 요구하는 신규 코딩 에이전트, 공식 벤치마크 점수만으로 성능을 확정해야 하는 도입 검토
- 현재 판단: 비용과 컨텍스트가 우선이면 Grok 4.3을 먼저 평가할 이유가 있다. 품질과 최신 공식 추천이 우선이면 Grok 4.6을 기준선으로 두고 비교해야 한다.
추천 대상 / 비추천 대상
추천
- 100만 토큰 컨텍스트가 필요하지만 프롬프트별 20만 토큰 경계를 모니터링할 수 있는 팀
- none부터 high까지 추론 노력을 작업별로 조절해 지연 시간과 비용을 관리하려는 서비스
- 즉시 응답이 필요 없는 대량 작업에서 20% Batch 할인을 활용할 수 있는 운영팀
- 종료된 Grok 3·Grok 4 계열 slug의 자동 전환 결과와 청구액을 명시적
grok-4.3호출로 정리하려는 팀
비추천
- 모델별 동일 조건 성능 자료 없이도 최고 품질을 보장해야 하는 업무
- 20만 토큰 이상 프롬프트를 상시 유지하면서 요청 전체의 장문 요율을 예산에 반영하기 어려운 서비스
grok-code-fast-1의 직접 후속 모델을 찾는 팀: xAI의 공식 대체 대상은grok-build-0.1이다.
판단
Grok 4.3의 선택 이유는 100만 토큰 컨텍스트 하나가 아니다. Grok 4.5·4.6보다 낮은 입력·캐시·출력 단가, none부터 high까지의 추론 설정, 20% Batch 할인, 구형 모델 전환 대상이라는 운영상의 역할이 함께 있다. 대량 처리와 긴 맥락에서 품질 합격선을 자체 시험할 수 있는 팀이라면 비용을 낮출 여지가 크다.
신규 고난도 작업의 기본 모델로 바로 확정하는 판단은 공식 문서만으로 뒷받침되지 않는다. 현재 xAI 모델 페이지는 코드와 일반 채팅에 Grok 4.6을 권하고, Grok 4.3 상세 페이지에는 비교 가능한 벤치마크 점수가 없다. 두 모델을 같은 입력, 도구, 추론 노력, 성공 조건으로 시험한 뒤 품질 차이를 비용 차이와 함께 봐야 한다.
운영 전에는 20만 토큰 경계를 자동으로 감시하고, 자동 전환된 구형 slug를 명시적 모델 ID로 교체하며, 실시간 호출과 Batch 작업을 분리하는 세 가지 조치가 필요하다. 이 조건을 갖추면 Grok 4.3의 낮은 단가와 큰 컨텍스트를 예산 안에서 활용하기 쉬워진다.
아직 공식 문서에서 확인되지 않은 부분
- Grok 4.3의 최대 출력 토큰 수
- Grok 4.3과 Grok 4.5·4.6의 동일 조건 성능 비교
- 한국어, 데이터 분석, 코딩, 장문 검색의 작업별 정확도와 지연 시간
- 모델 페이지 표기 처리량과 실제 계정·리전별 한도의 차이
함께 읽을 글
근거와 출처
- Grok 4.3 모델 문서 — API ID, 입출력 형식, 100만 토큰 컨텍스트, 함수 호출·구조화된 출력·추론 설정, 기본 단가, 별칭, Batch API와 처리량 표기. xAI 개발자 문서, 확인일 2026-08-26
- xAI API 가격표 — Grok 4.3·4.5·4.6의 단문·장문 요율, 장문 요율의 요청 전체 적용, Grok 4.3 Batch 할인과 서버 측 도구 호출 가격. xAI 개발자 문서, 확인일 2026-08-26
- 2026년 5월 15일 모델 종료 안내 — 종료 모델, 자동 전환 대상, 추론 노력, 가격 영향과 작업별 권장 대체 모델. xAI 개발자 문서, 확인일 2026-08-26
- xAI 모델 선택 페이지 — 현재 코드·채팅 기본 추천 모델과 모델 별칭 정책. xAI 개발자 문서, 확인일 2026-08-26
게시: 2026-08-26 00:37 KST 작성 방식: 직접 사용기가 아닌 xAI 공식 문서 분석
독자 의견
댓글 0
글에 대한 생각과 경험을 남겨 주세요. 서로를 존중하는 표현을 부탁드립니다.