Grok API 가격: grok-4.7·4.3 요금과 월 비용 계산
2026년 9월 기준 grok-4.7은 100만 토큰당 입력 $2·출력 $6, grok-4.3은 $1.25·$2.50입니다. 프롬프트가 20만 토큰 이상이면 요청 전체에 2배 단가가 붙습니다.
목차

2026년 9월 26일 기준 xAI 공식 가격표(9월 21일 갱신)에서 Grok API의 플래그십 모델 grok-4.7은 100만 토큰당 입력 $2.00, 캐시 입력 $0.50, 출력 $6.00입니다. 비용이 먼저라면 grok-4.3(입력 $1.25, 출력 $2.50, 컨텍스트 100만 토큰)이나 코딩용 grok-build-0.1(입력 $1.00, 출력 $2.00)로 예산을 따로 잡아 비교하는 것이 출발점입니다.
단가표만으로는 청구액이 맞지 않습니다. 프롬프트가 20만 토큰에 닿는 요청은 입력과 출력 전체가 긴 컨텍스트 단가(모든 항목 2배)로 계산되고, grok-4.7은 Batch API를 아예 지원하지 않아 Batch 20% 할인은 grok-4.3과 grok-4.20 계열에서만 받을 수 있습니다. Priority 처리는 2배, 미국 리전 엔드포인트는 1.1배이며, 웹 검색 같은 서버 측 도구는 1,000회 단위로 따로 붙습니다. 공개 가격 페이지에 무료 API 사용량은 없고, SuperGrok 같은 구독은 API 청구와 별개입니다.
현재 Grok API 텍스트 모델 요금
아래 표는 xAI API 가격 페이지의 텍스트 API 행에 Batch 조건을 덧붙인 것입니다. 단위는 모두 100만 토큰당 달러이고, 전역 엔드포인트(https://api.x.ai/v1) 기준입니다.
| 모델 | 컨텍스트 | 입력 | 캐시 입력 | 출력 | 20만 토큰 이상 입력 / 캐시 / 출력 | Batch |
|---|---|---|---|---|---|---|
grok-4.7 | 500K | $2.00 | $0.50 | $6.00 | $4.00 / $1.00 / $12.00 | 미지원 |
grok-4.6 | 500K | $2.00 | $0.50 | $6.00 | $4.00 / $1.00 / $12.00 | 할인 없음 |
grok-4.5 | 500K | $2.00 | $0.30 | $6.00 | $4.00 / $0.60 / $12.00 | 할인 없음 |
grok-build-0.1 | 256K | $1.00 | $0.20 | $2.00 | $2.00 / $0.40 / $4.00 | 할인 없음 |
grok-4.3 | 1M | $1.25 | $0.20 | $2.50 | $2.50 / $0.40 / $5.00 | 20% 할인 |
grok-4.20-0309-reasoning, grok-4.20-0309-non-reasoning, grok-4.20-multi-agent-0309 | 1M | $1.25 | $0.20 | $2.50 | $2.50 / $0.40 / $5.00 | 20% 할인 |
모델을 고르는 기준은 세 갈래입니다.
- grok-4.7: xAI 모델 페이지가 코딩, 에이전트 작업, 지식 업무용 최상위 모델로 소개합니다. 추론 강도는
low,medium,high,xhigh중에서 고르며 기본값은high입니다. 추론 토큰도 청구 대상이라 강도를 올리면 같은 질문이라도 토큰 사용량이 늘어납니다. - grok-4.3: 입력은 grok-4.7보다 37.5%, 출력은 약 58% 저렴하고, 컨텍스트가 100만 토큰으로 가장 깁니다. Batch 20% 할인도 grok-4.3과 grok-4.20 계열에만 있습니다.
- grok-build-0.1: 에이전트형 소프트웨어 개발과 엔지니어링 작업용 코딩 모델입니다. 단가는 가장 낮지만 컨텍스트가 256K라 20만 토큰이 넘는 큰 저장소를 한 번에 넣기에는 여유가 적습니다.
grok-4.6과 grok-4.5는 grok-4.7과 입력·출력 단가가 같습니다. 이미 코드에 고정해 둔 경우가 아니라면 같은 값을 내고 이전 모델을 쓸 이유는 크지 않습니다. Grok 4.1 Fast나 Grok 3 같은 이전 모델은 현재 텍스트 가격표에 없으므로 예전 자료의 저가 행으로 예산을 세우면 안 됩니다. grok-4.3으로 옮기는 절차는 Grok 4.3 API 가이드: 모델 ID, 가격, 마이그레이션, 테스트 계획에 따로 있습니다.
가격 페이지에는 Grok 4.7 Fast 요금도 보입니다. 같은 grok-4.7을 더 빠른 인프라에서 돌리는 버전으로, 단가가 정확히 2배(20만 토큰 미만 입력 $4.00, 캐시 $1.00, 출력 $12.00)입니다. 다만 Cursor와 Grok Build에서만 쓸 수 있고 공개 xAI API로는 호출할 수 없으므로 API 예산에는 넣지 않습니다.
청구액을 바꾸는 규칙
단가 다음으로 청구액을 크게 움직이는 것은 요청 방식입니다. 가격 페이지 곳곳에 흩어진 조건을 한 표로 모으면 다음과 같습니다.
| 규칙 | 적용 대상 | 청구 영향 |
|---|---|---|
| 긴 컨텍스트 | 프롬프트가 20만 토큰 이상인 요청 | 그 요청의 입력·캐시·출력 전체를 긴 컨텍스트 단가로 계산 |
| Batch API | grok-4.3, grok-4.20 계열(grok-4.7은 미지원) | 모든 토큰 20% 할인, 대부분 24시간 안에 완료 |
| Priority 처리 | Chat Completions, Responses | 모든 토큰 2배, 응답이 priority로 처리됐을 때만 |
| 미국 리전 엔드포인트 | grok-4.7, grok-4.6 | 모든 토큰 1.1배 |
| 서버 측 도구 | 웹 검색, X 검색, 코드 실행 등 | 토큰과 별도로 1,000회(또는 1,000건)당 요금 |
| 저장·다운로드 | 파일, 컬렉션 | GiB·일 단위 저장료와 GiB당 다운로드 요금 |
20만 토큰 이상이면 요청 전체가 2배
xAI는 "프롬프트가 긴 컨텍스트 임계값에 닿으면 그 요청의 모든 토큰을 긴 컨텍스트 단가로 청구한다"고 적고 있습니다. 넘은 부분만 비싸지는 것이 아니라 출력까지 포함한 요청 전체가 2배가 됩니다.
30만 토큰짜리 문서를 넣고 1만 토큰을 받는 요청 한 건으로 계산하면 차이가 분명합니다.
| 계산 방식 | 식 | 요청 1건 비용 |
|---|---|---|
| grok-4.7, 긴 컨텍스트 단가(실제 청구) | 0.3 × $4 + 0.01 × $12 | $1.32 |
| grok-4.7, 일반 단가로 잘못 추정 | 0.3 × $2 + 0.01 × $6 | $0.66 |
| grok-4.3, 긴 컨텍스트 단가 | 0.3 × $2.50 + 0.01 × $5 | $0.80 |
| grok-4.7, 15만 토큰씩 두 번 나눠 요청(출력 5천 토큰씩) | 2 × (0.15 × $2 + 0.005 × $6) | $0.66 |

일반 단가로 추정하면 실제 청구액의 절반밖에 잡지 못합니다. 문서를 나눠도 품질이 유지되는 작업이라면 프롬프트를 20만 토큰 아래로 쪼개는 것만으로 비용이 절반이 되고, 문서 전체를 한 번에 봐야 하는 작업이라면 긴 컨텍스트 단가에서도 grok-4.3이 grok-4.7보다 쌉니다. grok-build-0.1은 컨텍스트가 256K라 30만 토큰 프롬프트는 아예 들어가지 않습니다.
Batch 할인은 모델마다 다르다
xAI Batch API는 요청을 대기열에 넣어 백그라운드에서 처리하고, 대부분 24시간 안에 끝납니다. Batch 요청은 분당 한도(rate limit)에 포함되지 않습니다. 할인은 입력, 출력, 캐시, 추론 토큰 모두에 적용되지만 비율이 모델마다 다릅니다.
- 20% 할인: grok-4.3, grok-4.20-0309-reasoning, grok-4.20-0309-non-reasoning, grok-4.20-multi-agent-0309
- 지원하지 않음: grok-4.7(모델 페이지의 Batch API 항목이 "Not supported")
- 할인 없음: 그 밖의 모델(grok-4.6, grok-4.5, grok-build-0.1)
grok-4.7로 대량 작업을 돌리려면 실시간 API 요금을 그대로 내야 합니다. 기다려도 되는 작업을 싸게 처리하려면 grok-4.3으로 Batch를 보내는 것이 xAI 안에서 가장 낮은 요금입니다. 다른 회사 API처럼 "Batch는 50% 할인"이라고 가정하면 grok-4.3도 틀립니다. 할인 폭은 절반이 아니라 20%입니다. 이미지·동영상 생성은 Batch로 보내도 표준 요금입니다.
Priority 처리와 미국 리전 엔드포인트
Priority 처리는 텍스트 요청의 스케줄링 우선순위를 높여 지연을 줄이는 대신 입력, 출력, 캐시, 추론 토큰 모두 2배를 받습니다. 캐시 할인을 먼저 적용한 뒤 2배를 곱하고, 응답에 "service_tier": "priority"가 표시된 요청만 priority 요금으로 청구됩니다. 기본 등급으로 처리되면 표준 요금입니다. Chat Completions와 Responses 엔드포인트에서만 쓸 수 있고 Batch, 이미지·동영상 생성에는 적용되지 않습니다.
미국 리전 엔드포인트 https://us.api.x.ai/v1로 보낸 요청은 미국에서 추론을 실행하고 전역 단가의 1.1배를 냅니다. 현재 grok-4.7과 grok-4.6만 지원하며, grok-4.7 기준 20만 토큰 미만은 입력 $2.20, 캐시 $0.55, 출력 $6.60, 20만 토큰 이상은 $4.40, $1.10, $13.20입니다. 데이터 처리 지역을 미국으로 묶어야 하는 요건이 없다면 전역 엔드포인트가 더 쌉니다.
서버 측 도구와 저장 요금
서버 측 도구를 쓰는 요청은 토큰 요금에 도구 호출 요금이 더해집니다. 에이전트가 도구를 몇 번 부를지 스스로 정하기 때문에 질문이 복잡할수록 호출 수가 늘어납니다.
| 도구 | 요금 | 참고 |
|---|---|---|
Web Search (web_search) | 1,000회당 $5 | 이미지 검색도 웹 검색 요금 |
X Search (x_search) | 게시물 1,000건당 $5, 프로필 1,000건당 $10 | 호출 수가 아니라 가져온 항목 수로 청구, 부모·인용 게시물도 포함 |
| Code Execution | 1,000회당 $5 | 샌드박스 Python 실행 |
File Attachments (attachment_search) | 1,000회당 $10 | 메시지에 첨부한 파일 검색 |
| Collections Search | 1,000회당 $2.50 | 업로드한 문서 컬렉션 검색(RAG) |
| Remote MCP 도구 | 호출료 없음 | 사용한 토큰만 청구 |
파일을 xAI에 보관하면 GiB당 하루 $0.025, 컬렉션은 GiB당 하루 $0.10이 붙고, 파일·컬렉션 다운로드는 GiB당 $0.20입니다. 이용 가이드라인 위반으로 판정된 요청은 생성된 만큼 청구되며, Responses API에서 생성 전에 걸러진 경우에도 요청당 $0.05의 위반 수수료가 붙습니다.
Grok API 무료 사용과 SuperGrok 구독
xAI의 가격, 모델, 요청 한도 페이지 어디에도 무료 크레딧이나 무료 토큰 한도는 없습니다. 요청 한도 표의 Tier 0은 누적 결제액 $0인 계정에 적용되는 한도 등급일 뿐 무료 사용량이 아닙니다.
결제는 선불 크레딧이 기본입니다. xAI 결제 안내에 따르면 API 사용량은 미리 산 크레딧 잔액에서 차감되고, 월말 청구서 방식은 기본적으로 꺼져 있어 영업팀에 요청해야 켤 수 있습니다. 청구서 한도가 기본값 $0이면 선불 크레딧만 쓰며, 잔액이 떨어지는 순간 API 요청이 자동으로 거절됩니다. 즉 API 키를 만들어도 크레딧을 충전하기 전에는 요청이 처리되지 않습니다.
x.ai 요금제 페이지의 Free, SuperGrok, Business, Enterprise는 Grok 앱과 웹을 쓰기 위한 요금제입니다. API 사용량은 이 구독료와 별도로 콘솔 크레딧에서 청구되며, 공개 가격 문서에는 구독에 API 사용량이 포함된다는 설명이 없습니다. 데스크톱 앱인 Grok Bot도 구독 계정의 이용 권한으로 쓰는 제품이라 API 토큰 요금표와는 관계가 없습니다(Grok Bot 시작하기: 설치부터 로그인, 첫 Bot 만들기까지). 앱에서 사용량이 많다는 안내가 뜨는 문제도 API 결제와는 다른 경로입니다(Grok 사용량이 많다고 뜰 때: 상태, 접속 경로, 유료 플랜 확인 순서).
이름이 비슷한 Groq(groq.com)는 xAI와 무관한 추론 서비스 회사입니다. Groq의 무료 한도는 Grok API와 상관이 없습니다. 중계 서비스나 게이트웨이가 Grok 모델을 자체 가격으로 판매하는 경우도 있는데, 그 요금과 약관은 해당 업체와의 별도 계약이며 xAI 공식 가격이 아닙니다. 중계 경로의 장단점은 가장 저렴한 LLM API 제공업체: 가격, 품질, 지연시간, 게이트웨이 리스크 비교에서, 실제로 무료 한도가 있는 API는 무료 AI API 추천: 조건별 첫 선택과 무료 한도 비교에서 볼 수 있습니다.
워크로드별 월 비용 계산
월 비용은 아래 식에 토큰 수를 백만 단위로 넣으면 나옵니다. 예시의 요청 수와 토큰 수는 가정이며, 자신의 로그 값으로 바꿔 넣으면 됩니다.
월 비용 = 새 입력 토큰(백만) × 입력 단가
+ 캐시 입력 토큰(백만) × 캐시 단가
+ 출력 토큰(백만) × 출력 단가
+ 도구 호출 수 ÷ 1,000 × 도구 단가
+ 저장·다운로드 요금
조정: 프롬프트 20만 토큰 이상 요청은 긴 컨텍스트 단가
Batch × 0.8 (grok-4.3, grok-4.20 계열만)
Priority × 2, 미국 리전 × 1.1고객 지원 챗봇: 월 10만 건
한 달 100,000건의 답변에 요청당 새 입력 1,000토큰, 캐시되는 시스템 프롬프트 2,000토큰, 출력 400토큰을 가정합니다. 합계는 새 입력 1억 토큰(100백만), 캐시 입력 2억 토큰(200백만), 출력 4,000만 토큰(40백만)입니다. 도구 호출과 재시도는 넣지 않았습니다.
| 선택 | 계산 | 월 비용 |
|---|---|---|
| grok-4.7 | 100 × $2 + 200 × $0.50 + 40 × $6 | $540 |
| grok-4.3 | 100 × $1.25 + 200 × $0.20 + 40 × $2.50 | $265 |
| grok-4.3 + Batch | $265 × 0.8 | $212 |
| grok-build-0.1 | 100 × $1 + 200 × $0.20 + 40 × $2 | $220 |
| grok-4.7, 미국 리전 | $540 × 1.1 | $594 |
| grok-4.7, Priority | $540 × 2 | $1,080 |

grok-4.7에서 출력은 전체의 44%($240)를 차지합니다. 답변 길이를 줄이는 것이 단가 낮은 모델로 옮기는 것만큼 효과가 있을 수 있다는 뜻입니다. 캐시도 중요합니다. 시스템 프롬프트가 캐시되지 않아 2억 토큰이 일반 입력으로 청구되면 grok-4.7은 100 × $2 + 200 × $2 + 40 × $6 = $840이 됩니다. Batch 행은 실시간 답변에는 쓸 수 없고, 밤사이 티켓 분류처럼 기다려도 되는 작업에만 해당합니다.
웹 검색 리서치 에이전트: 월 1,000건
작업 1건당 입력 6만 토큰, 출력 3천 토큰, 웹 검색 5회를 가정합니다. 검색 결과가 입력 6만 토큰 안에 이미 들어 있다고 보면 한 달 합계는 입력 6,000만 토큰, 출력 300만 토큰, 검색 5,000회입니다.
| 모델 | 토큰 비용 | 검색 비용 | 합계 |
|---|---|---|---|
| grok-4.7 | 60 × $2 + 3 × $6 = $138 | 5,000 ÷ 1,000 × $5 = $25 | $163 |
| grok-4.3 | 60 × $1.25 + 3 × $2.50 = $82.50 | $25 | $107.50 |
검색 요금은 모델과 상관없이 같으므로 싼 모델일수록 청구액에서 도구가 차지하는 비중이 커집니다. grok-4.3에서는 약 23%입니다. 에이전트가 검색 횟수를 스스로 정하므로, 작업당 최대 호출 수를 코드에서 제한해 두지 않으면 이 줄이 가장 먼저 예산을 넘습니다.
ChatGPT·Claude API와 같은 토큰량으로 비교
캐시 없이 한 달에 입력 1억 토큰, 출력 2,000만 토큰을 쓴다고 가정하고 각 회사의 공식 표준 단가(2026년 9월 26일 기준)를 넣으면 다음과 같습니다.
| 모델 | 입력 / 출력 단가 | 계산 | 월 비용 |
|---|---|---|---|
| OpenAI GPT-6 Sol | $2 / $10 | 100 × $2 + 20 × $10 | $400 |
| Claude Sonnet 5 | $2 / $10 | 100 × $2 + 20 × $10 | $400 |
| xAI grok-4.7 | $2 / $6 | 100 × $2 + 20 × $6 | $320 |
| xAI grok-4.3 | $1.25 / $2.50 | 100 × $1.25 + 20 × $2.50 | $175 |
| xAI grok-build-0.1 | $1 / $2 | 100 × $1 + 20 × $2 | $140 |
| OpenAI GPT-6 Luna | $0.10 / $0.50 | 100 × $0.10 + 20 × $0.50 | $20 |
grok-4.7은 입력 단가가 GPT-6 Sol, Claude Sonnet 5와 같고 출력이 싸서 같은 토큰량이면 20% 저렴합니다. 출력 비중이 큰 작업일수록 차이가 커집니다. 다만 회사마다 토크나이저가 달라 같은 문서도 토큰 수가 다르게 나오고, 품질과 캐시 조건도 이 표에는 들어 있지 않습니다. 비용이 최우선이라면 OpenAI의 최저가 등급인 GPT-6 Luna가 grok-4.3보다도 8배 이상 싸므로, 작업 품질이 충분한지 먼저 시험해 볼 만합니다. OpenAI와 Anthropic의 캐시·Batch 조건까지 넣은 계산은 Claude API와 OpenAI API 가격 비교: 워크로드별 계산, 5개사 전체 등급 비교는 AI API 가격 비교: 5개사 등급별 요금과 가장 싼 모델에 있습니다.
지출 관리: 요청별 청구액과 한도
xAI API는 모든 추론 응답의 usage 객체에 cost_in_usd_ticks 필드로 그 요청의 실제 청구액을 돌려줍니다. 캐시 할인을 적용한 뒤의 금액이고, 서버 측 도구를 여러 번 부른 에이전트 요청이라도 토큰과 도구 요금이 한 값에 합쳐져 있습니다. 1달러는 10,000,000,000틱(10¹⁰)입니다.
import os
from openai import OpenAI
client = OpenAI(api_key=os.getenv("XAI_API_KEY"), base_url="https://api.x.ai/v1")
completion = client.chat.completions.create(
model="grok-4.7",
messages=[{"role": "user", "content": "Say hello"}],
)
cost_usd = completion.usage.cost_in_usd_ticks / 1e10 # 이 요청의 실제 청구액(달러)
print(f"{cost_usd:.6f}")스트리밍에서는 OpenAI SDK나 REST API 요청에 stream_options: {"include_usage": true}를 넣어야 마지막 청크에 비용이 담깁니다. 값은 요청 단위라 여러 턴 대화의 합계는 직접 더해야 합니다. 이 값을 요청 로그에 모델 ID, 프롬프트 토큰 수와 함께 남기면 위의 계산식과 실제 청구액을 바로 대조할 수 있습니다.
요청 한도 등급은 2026년 1월 1일 이후 누적 API 결제액으로 올라갑니다. Tier 1은 $50, Tier 2는 $250, Tier 3은 $1,000, Tier 4는 $5,000이고, 한 번 오른 등급은 내려가지 않습니다. grok-4.7의 분당 토큰 한도(TPM)는 Tier 0 5,000만에서 Tier 4 1억까지입니다. 캐시 입력 토큰은 싸게 청구되지만 TPM에는 그대로 포함되고, 한도를 넘으면 HTTP 429 오류가 돌아옵니다.
운영 전에는 다음 순서로 한도를 걸어 두는 것이 안전합니다.
- 청구서 한도를 기본값 $0으로 두고 선불 크레딧만 씁니다. 잔액이 떨어지면 요청이 거절되므로 예상치 못한 청구서가 생기지 않습니다.
- 자동 충전을 켠다면 충전 기준 잔액, 1회 충전액(최소 $5), 월 최대 금액을 정합니다. 월 한도의 80%를 쓰면 경고가 표시됩니다.
- 코드에 모델 ID를 고정하고 최대 출력 토큰과 작업당 도구 호출 수를 제한합니다.
- 요청 전에 프롬프트 토큰 수를 세어 20만 토큰에 가까운 요청을 따로 기록하거나 분할합니다.
- Priority를 쓴다면 응답의
service_tier값을 로그에 남겨 2배 요금이 붙은 요청 수를 셉니다.
자주 묻는 질문
Grok API 키를 무료로 받을 수 있나요?
키는 xAI 콘솔에서 만들 수 있지만, 공개 가격·모델·요청 한도 페이지에는 무료 크레딧이나 무료 토큰 한도가 없습니다. 기본 설정에서는 선불 크레딧 잔액이 없으면 요청이 거절되므로 실제로 쓰려면 크레딧을 충전해야 합니다. Tier 0은 무료 등급이 아니라 결제액 $0 계정의 요청 한도 등급입니다.
SuperGrok을 구독하면 API도 쓸 수 있나요?
SuperGrok은 Grok 앱과 웹용 소비자 구독이고, API 사용량은 콘솔의 선불 크레딧에서 따로 청구됩니다. 공개 가격 문서에는 구독에 API 사용량이 포함된다는 설명이 없으므로 API 예산은 구독료와 별도로 잡아야 합니다.
Grok API가 ChatGPT API보다 싼가요?
같은 토큰량이면 grok-4.7(입력 $2, 출력 $6)은 GPT-6 Sol(입력 $2, 출력 $10)보다 출력이 싸서, 입력 1억·출력 2,000만 토큰 기준 월 $320 대 $400입니다. 반면 GPT-6 Luna는 같은 조건에서 $20라 grok-4.3($175)보다도 훨씬 쌉니다. 비교는 모델 등급을 맞춰서 해야 하고, 토크나이저 차이로 실제 토큰 수는 회사마다 달라집니다.
Batch API를 쓰면 50% 할인되나요?
xAI에서는 아닙니다. Batch 할인은 grok-4.3과 grok-4.20 계열 네 모델만 20%입니다. grok-4.7은 Batch API 자체를 지원하지 않고, grok-4.6, grok-4.5, grok-build-0.1에는 할인이 없습니다.
grok-4.7과 grok-4.3 중 어느 쪽으로 예산을 잡아야 하나요?
품질이 우선인 코딩·에이전트 작업은 grok-4.7, 비용과 긴 문서 처리가 우선이면 grok-4.3입니다. 고객 지원 챗봇 예시에서 grok-4.3은 grok-4.7의 절반 이하($265 대 $540)였고, 100만 토큰 컨텍스트와 Batch 20% 할인도 grok-4.3에만 있습니다. 같은 샘플 작업을 두 모델로 돌려 cost_in_usd_ticks와 결과 품질을 함께 비교하면 결정이 빠릅니다.
Grok Bot은 얼마인가요?
Grok Bot은 구독 계정의 이용 권한으로 쓰는 데스크톱 앱이라 Grok API 요금표와는 별개입니다. API 토큰 단가로 Grok Bot 비용을 계산할 수 없고, 앱 이용 조건은 사용 중인 구독 요금제를 따릅니다.





