본문으로 건너뛰기

AI API 가격 비교: 5개사 등급별 요금과 가장 싼 모델

2026년 9월 26일 기준 공식 정가로 가장 싼 AI API는 GPT-6 Luna(입력 $0.10, 출력 $0.50)입니다. 캐시 적중이 많거나 프롬프트가 길면 순위가 바뀝니다.

LaoZhang AI Team게시업데이트 13 분 소요
목차
AI API 가격 비교 표지. 100만 토큰당 입력·출력 정가로 GPT-6 Luna $0.10/$0.50, GPT-6 Sol과 Claude Sonnet 5 $2/$10, Claude Opus 5.5 $4/$20을 등급별로 보여 줍니다

2026년 9월 26일 기준, 모델 제공사 공식 정가로 가장 싼 AI API는 OpenAI gpt-6-luna입니다. 100만 토큰당 입력 $0.10, 출력 $0.50으로, 아래 월 비용 예시에서도 입력 위주 작업과 출력 위주 작업 모두 가장 낮았습니다. 하지만 순위는 과금 조건에 따라 바뀝니다. 입력 대부분이 캐시에 적중하면 DeepSeek deepseek-flash의 캐시 적중 입력(오프피크 $0.003)이 훨씬 싸고, GPT-6 Sol과 Claude Sonnet 5는 짧은 프롬프트에서 입력 $2·출력 $10으로 같지만 입력이 272K 토큰을 넘으면 Sol만 요청 전체 단가가 올라갑니다. Gemini 3.8 Flash의 $0.75/$3.75는 2026년 12월 31일까지만 적용되고, 2027년 1월 1일부터 두 배가 됩니다.

따라서 "어디가 가장 싼가"는 표의 숫자 하나로 정해지지 않습니다. 등급별 정가를 확인하고, 자신의 입력·출력 비율로 월 비용을 계산한 다음, 그 순위를 바꾸는 조건을 대입해야 합니다.

등급별 공식 API 가격표

아래 가격은 모두 모델 제공사 공식 가격 페이지에 나온 100만 토큰당 USD 정가이며, 표준 처리와 짧은 프롬프트를 기준으로 합니다. 캐시 입력은 캐시에 적중한 입력 토큰의 단가입니다. 등급은 각 회사 라인업에서의 위치와 단가대를 기준으로 나눴습니다. Gemini 3.1 Pro Preview는 Google에서 가장 높은 모델이지만 단가가 중간대여서 중간 등급에 있습니다.

등급모델 (API 이름)입력출력캐시 입력단가를 바꾸는 조건
경량GPT-6 Luna (gpt-6-luna)$0.10$0.50$0.01입력 272K 초과 시 요청 전체 $0.20 / $0.75
경량DeepSeek Flash (deepseek-flash)$0.15 / $0.30$0.60 / $1.20$0.003 / $0.006오프피크 / 피크. 피크는 한국 시간 평일 10:00-13:00, 15:00-19:00
경량Gemini 3.1 Flash-Lite (gemini-3.1-flash-lite)$0.25$1.50$0.025오디오 입력은 $0.50
경량Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite)$0.30$2.50공식 요금 페이지 참조Batch $0.15 / $1.25
경량Claude Haiku 4.5$1$5$0.10Batch $0.50 / $2.50
중간Gemini 3.8 Flash (gemini-3.8-flash)$0.75$3.75$0.075 + 저장 요금2026-12-31까지 가격. 2027-01-01부터 $1.50 / $7.50
중간DeepSeek V4-Pro (deepseek-v4-pro)$0.66 / $1.32$1.98 / $3.96$0.022 / $0.044오프피크 / 피크
중간Grok 4.7 (grok-4.7)$2$6$0.50프롬프트 200K 이상이면 요청 전체 $4 / $12, 캐시 $1. Batch 미지원
중간GPT-6 Sol (gpt-6-sol)$2$10$0.20입력 272K 초과 시 요청 전체 $4 / $15
중간Claude Sonnet 5$2$10$0.20100만 토큰 컨텍스트까지 같은 단가
중간Gemini 3.1 Pro Preview (gemini-3.1-pro-preview)$2$12공식 요금 페이지 참조프롬프트 200K 초과 시 $4 / $18
최상위Claude Opus 5.5$4$20$0.20Fast mode $8 / $40
최상위GPT-6 Astra (gpt-6-astra)$10$50$1입력 272K 초과 시 요청 전체 $20 / $75
최상위Claude Fable 5.1$10$50$0.25Batch $5 / $25

가격 출처는 OpenAI API 가격, Claude API 가격, Gemini Developer API 가격, xAI API 가격, DeepSeek API 가격입니다. Gemini 가격은 AI Studio에서 발급하는 Gemini Developer API 키 기준이며 Vertex AI 요금과는 별개입니다. DeepSeek Flash는 DeepSeek-V4.1-Flash가 처리하고, 예전 이름인 deepseek-v4-flash로 호출해도 Flash 가격으로 과금됩니다. 가격은 수시로 바뀌므로 결제나 크레딧 충전 직전에 위 페이지에서 한 번 더 확인하는 편이 안전합니다.

표에서 바로 읽히는 점은 세 가지입니다. 경량 등급 안에서도 출력 단가는 $0.50(Luna)부터 $5(Haiku 4.5)까지 10배 차이가 납니다. 중간 등급의 Grok 4.7, GPT-6 Sol, Claude Sonnet 5, Gemini 3.1 Pro Preview는 입력 단가가 모두 $2여서, 실제 차이는 출력 단가($6~$12)와 긴 프롬프트 조건에서 생깁니다. 최상위 등급에서는 Claude Opus 5.5가 $4/$20으로 GPT-6 Astra와 Claude Fable 5.1($10/$50)의 40% 수준입니다.

월 비용으로 계산하면 순위가 달라집니다

토큰 단가를 월 비용으로 바꾸는 식은 간단합니다.

월 비용 = (월 입력 토큰 ÷ 100만) × 입력 단가 + (월 출력 토큰 ÷ 100만) × 출력 단가

입력과 출력 비율이 다른 두 가지 작업을 가정해 표의 정가를 대입하면 다음과 같습니다.

  • 입력 중심: 월 입력 3억 토큰 + 출력 3,000만 토큰. 예를 들어 하루 1만 건, 요청당 입력 1,000토큰·출력 100토큰을 30일 동안 처리하는 경우입니다. 고객 문의 답변이나 문서를 넣고 짧게 답하는 검색 기반 답변(RAG)이 여기에 가깝습니다.
  • 출력 중심: 월 입력 2,000만 토큰 + 출력 4,000만 토큰. 긴 글이나 코드를 생성하는 작업입니다.

두 예시 모두 표준 처리, 캐시 미사용, 짧은 프롬프트를 가정했습니다. 재시도, 도구 호출, 추론 토큰 양의 변동, 모델별 토크나이저 차이는 넣지 않았으므로 실제 청구서가 아니라 정가 기준 추정치입니다.

모델입력 중심 (월)출력 중심 (월)
GPT-6 Luna$45$22
DeepSeek Flash (오프피크 / 피크)$63 / $126$27 / $54
Gemini 3.1 Flash-Lite$120$65
Gemini 3.5 Flash-Lite$165$106
DeepSeek V4-Pro (오프피크 / 피크)$257.40 / $514.80$92.40 / $184.80
Gemini 3.8 Flash (2026년 / 2027년 가격)$337.50 / $675$165 / $330
Claude Haiku 4.5$450$220
Grok 4.7$780$280
GPT-6 Sol$900$440
Claude Sonnet 5$900$440
Gemini 3.1 Pro Preview$960$520
Claude Opus 5.5$1,800$880
GPT-6 Astra$4,500$2,200
Claude Fable 5.1$4,500$2,200

예를 들어 출력 중심 작업에서 Grok 4.7은 20 × $2 + 40 × $6 = $280, GPT-6 Sol은 20 × $2 + 40 × $10 = $440입니다. 입력 단가가 같으니 차이는 전부 출력 단가에서 나옵니다.

이 표에서 판단을 바꾸는 지점은 다음과 같습니다.

  • GPT-6 Luna는 두 경우 모두 가장 쌉니다. 남는 질문은 가격이 아니라 경량 모델이 요구하는 품질 기준을 넘는지입니다.
  • DeepSeek Flash는 호출 시간대에 따라 두 배 차이가 납니다. 오프피크라면 출력 중심 작업에서 Luna와 $5 차이지만, 피크 시간에 몰리면 $54가 됩니다.
  • Grok 4.7은 출력 비중이 클수록 유리합니다. Sol·Sonnet 5 대비 출력 중심에서는 $160(약 36%) 싸지만, 입력 중심에서는 차이가 $120(약 13%)로 줄어듭니다.
  • Gemini 3.8 Flash는 2027년 가격으로 보면 위치가 바뀝니다. 2026년 가격으로는 Haiku 4.5보다 싸지만, 2027년 1월 1일 이후 가격($675 / $330)으로는 두 예시 모두 Haiku 4.5($450 / $220)보다 비쌉니다.
  • Gemini 3.1 Pro Preview는 두 예시 모두 Sol·Sonnet 5보다 조금 비쌉니다. 입력 단가는 $2로 같고 출력 단가가 $12이기 때문입니다.

입력 중심과 출력 중심 작업의 월 비용 순위 비교. 출력 중심에서는 Grok 4.7이 Sol·Sonnet 5보다 약 36% 싸고, 2027년 가격의 Gemini 3.8 Flash는 두 경우 모두 Haiku 4.5보다 비쌉니다

자신의 작업에 적용할 때는 하루 요청 수 × 요청당 평균 입력 토큰 × 30으로 월 입력 토큰을, 같은 방식으로 월 출력 토큰을 구한 뒤 위 식에 넣으면 됩니다. 입력 대 출력 비율이 10:1에 가까우면 입력 중심 열을, 1:2에 가까우면 출력 중심 열을 먼저 참고하십시오.

표의 숫자를 바꾸는 과금 조건

긴 프롬프트: 272K와 200K 기준선

긴 문서를 한 번에 넣는 작업에서는 짧은 프롬프트 정가가 같은 모델끼리도 청구액이 크게 달라집니다.

  • OpenAI GPT-6: 입력이 272K 토큰을 넘는 요청은 입력·캐시 단가 2배, 출력 단가 1.5배가 적용됩니다. 초과분만이 아니라 요청 전체에 적용된다는 점이 핵심입니다.
  • Claude: Claude 4.6 이후 모델은 100만 토큰 컨텍스트 전체를 표준 단가로 청구합니다. 90만 토큰 요청도 9천 토큰 요청과 같은 토큰당 단가입니다.
  • Gemini 3.1 Pro Preview: 프롬프트가 200K 토큰을 넘으면 입력 $4, 출력 $18이 됩니다.
  • Grok 4.7: 프롬프트가 200K 토큰 이상이면 요청 전체가 입력 $4, 출력 $12로 청구됩니다.

입력 40만 토큰 + 출력 5,000토큰 요청 1건을 표준 처리로 계산하면 다음과 같습니다. 100만 토큰 단위로 바꾸면 입력은 0.4, 출력은 0.005입니다.

모델계산요청 1건 비용
GPT-6 Sol0.4 × $4 + 0.005 × $15$1.675
Claude Sonnet 50.4 × $2 + 0.005 × $10$0.85
Gemini 3.1 Pro Preview0.4 × $4 + 0.005 × $18$1.69
Grok 4.70.4 × $4 + 0.005 × $12$1.66

입력 400K·출력 5K 토큰 요청 1건의 비용. 200K와 272K 기준선을 넘은 Gemini 3.1 Pro Preview는 $1.69, GPT-6 Sol은 $1.675, 같은 단가가 유지되는 Claude Sonnet 5는 $0.85입니다

Sol을 짧은 프롬프트 단가로 잘못 계산하면 $0.85가 나와 Sonnet 5와 같아 보이지만, 실제로는 약 두 배입니다. 계약서, 코드 저장소, 긴 회의록처럼 272K를 자주 넘는 작업이라면 이 차이가 월 비용을 좌우합니다. GPT-6의 긴 컨텍스트 계산은 GPT-6 Astra API 가격: 272K 기준과 캐시·서비스 티어 계산법에서 더 자세히 다룹니다. Grok 4.7은 컨텍스트가 500K 토큰이고, 프롬프트가 200K 토큰 이상이면 요청 전체에 입력 $4, 캐시 입력 $1, 출력 $12가 적용됩니다.

DeepSeek의 피크·오프피크 요금

DeepSeek는 같은 모델이라도 호출 시간대에 따라 단가가 두 배 차이 납니다. 오프피크 단가는 피크 단가의 절반입니다. 공식 페이지의 피크 시간은 UTC 기준 월요일부터 금요일 01:00-04:00, 06:00-10:00이고, 한국 시간(UTC+9)으로 바꾸면 평일 오전 10시부터 오후 1시, 오후 3시부터 7시까지입니다. 중국 공휴일은 피크에서 제외되고, 주말과 중국 공휴일은 하루 종일 오프피크입니다.

이 시간대는 한국 업무 시간과 대부분 겹칩니다. 업무 시간에 사용자 요청을 실시간으로 처리하는 서비스라면 피크 단가(Flash 입력 $0.30, 출력 $1.20)로 예산을 잡고, 야간이나 주말로 미룰 수 있는 대량 처리만 오프피크 단가로 계산하는 편이 현실적입니다. 시간대별 계산 예시는 DeepSeek V4 피크 요금제: 한국 시간과 실제 API 비용 계산을 참고하십시오.

종료일이 있는 가격: Gemini 3.8 Flash

Gemini 3.8 Flash의 입력 $0.75, 출력 $3.75(출력에는 추론 토큰 포함)는 2026년 12월 31일까지의 가격입니다. 2027년 1월 1일부터는 입력 $1.50, 출력 $7.50으로 올라가고, 컨텍스트 캐싱도 $0.075에서 $0.15로, 저장 요금은 100만 토큰당 시간당 $0.50에서 $1.00으로 바뀝니다. Batch 단가 역시 $0.375/$1.875에서 $0.75/$3.75로 오릅니다.

연말을 넘겨 쓸 서비스라면 2027년 가격으로 예산을 잡아야 합니다. 앞의 월 비용 예시에서 봤듯이, 그 가격으로는 Claude Haiku 4.5보다 비싸집니다. Gemini API 키 발급과 결제 전 확인 사항은 Gemini API 키 구매 전 확인할 가격·결제·안전 경로에 정리되어 있습니다.

캐시 적중 단가와 캐시 쓰기 요금

같은 시스템 프롬프트나 문서를 반복해서 넣는 작업은 캐시 적중 단가가 실제 입력 비용을 결정합니다.

  • OpenAI GPT-6: 캐시 적중 입력은 기본 입력의 10%입니다(Sol $0.20, Luna $0.01, Astra $1). 캐시 쓰기는 따로 과금됩니다(Sol $2.50).
  • Claude: 캐시 적중은 보통 기본 입력의 0.1배지만 Fable 5.1은 0.025배($0.25), Opus 5.5는 0.05배($0.20)입니다. 그래서 캐시 적중 입력만 보면 Opus 5.5와 Sonnet 5가 똑같이 $0.20입니다. 캐시 쓰기는 5분 보관이 기본 입력의 1.25배, 1시간 보관이 2배입니다(Sonnet 5 기준 $2.50 / $4).
  • DeepSeek: 가격표에는 캐시 적중 입력, 캐시 미적중 입력, 출력 세 항목만 있습니다. Flash 오프피크 기준 적중 $0.003은 미적중 $0.15의 50분의 1입니다.
  • Gemini: 3.8 Flash의 컨텍스트 캐싱은 $0.075에 저장 요금(100만 토큰당 시간당 $0.50)이 붙고, 3.1 Flash-Lite는 $0.025입니다.
  • Grok 4.7: 캐시 적중 입력은 $0.50으로 기본 입력의 4분의 1이고, 프롬프트가 200K 토큰 이상인 요청에서는 $1입니다.

앞의 입력 중심 예시에서 입력의 80%가 캐시에 적중한다고 가정하면, DeepSeek Flash 오프피크 비용은 240 × $0.003 + 60 × $0.15 + 30 × $0.60 = $0.72 + $9 + $18 = $27.72로, 캐시 없이 계산한 $63의 절반 이하가 됩니다. OpenAI와 Claude는 캐시 쓰기 요금이 따로 있으므로, 같은 내용이 몇 번 재사용되는지까지 알아야 절감액을 계산할 수 있습니다.

Batch·Flex는 절반, Fast mode는 두 배

결과를 즉시 받지 않아도 되는 작업은 할인 옵션이 있습니다.

  • OpenAI의 Batch와 Flex는 GPT-6 세 모델 모두 표준의 절반입니다(Sol 입력 $1, 출력 $5). Flex는 가격 대신 지연 시간과 가용성을 양보하는 옵션입니다.
  • Claude Batch도 절반입니다(Sonnet 5 $1/$5, Opus 5.5 $2/$10).
  • Gemini Batch API도 50% 할인입니다(3.1 Pro Preview 200K 이하 $1/$6).
  • Grok 4.7은 Batch API를 지원하지 않습니다.

반대로 더 빠른 처리를 원하면 단가가 올라갑니다. OpenAI Fast mode(2026년 7월 30일 Priority에서 이름 변경)는 표준의 두 배(Sol $4/$20)이고, Claude Opus 5.5의 Fast mode는 $8/$40, xAI의 Priority 처리도 표준의 두 배입니다. 출력 중심 예시를 GPT-6 Sol Batch로 돌리면 $440이 $220이 되어 Grok 4.7의 표준 가격($280)보다 싸집니다. 야간 일괄 처리가 가능한 작업은 할인 옵션 여부가 모델 선택만큼 중요합니다.

같은 한국어 문장도 토큰 수가 다릅니다

토큰 단가가 같아도, 같은 텍스트가 모델마다 다른 토큰 수로 계산되면 청구액이 달라집니다. Anthropic은 Claude 4.7 이후 모델의 새 토크나이저가 같은 텍스트에서 이전 토크나이저보다 약 30% 많은 토큰을 만들며, 정확한 증가폭은 내용과 작업 형태에 따라 다르다고 밝히고 있습니다. 현재 Claude 가격표의 Sonnet 5, Opus 5.5, Fable 5.1이 여기에 해당합니다.

회사 간 비교는 더 어렵습니다. 2025년 11월 클리앙의 한 사용자는 같은 질문에서 Gemini 3.0 Pro가 5,530토큰, Claude 4.5 Opus가 9,996토큰을 썼다고 공유했지만, 이전 세대 모델을 대상으로 한 한 번의 관찰이고 답변 길이 차이도 섞여 있을 수 있습니다. 한국어에서 모델별 토큰 수 비율은 공개된 공식 수치가 없으므로, 실제로 쓸 한국어 프롬프트 몇 건을 각 모델에 보내고 API 응답이나 사용량 화면에 찍히는 입력·출력 토큰 수를 비교하는 것이 가장 정확합니다.

그 밖에 청구액에 더해지는 항목

  • OpenAI 데이터 레지던시(지역 처리) 엔드포인트는 2026년 3월 5일 이후 출시된 대상 모델에 10%가 추가됩니다. GPT-6 Sol과 Luna의 EU 데이터 레지던시는 표준 처리에서만 쓸 수 있습니다.
  • OpenAI 내장 도구가 쓰는 토큰은 해당 모델의 토큰 단가로 청구됩니다.
  • xAI의 미국 지역 엔드포인트로 보낸 요청은 글로벌 단가의 1.1배로 청구됩니다.
  • Gemini 3.x의 Google 검색 그라운딩(Grounding with Google Search)은 월 5,000건까지 무료(3.x 모델 공유)이고 이후 1,000건당 $14입니다.

무료 티어와 중계 서비스 가격은 따로 봅니다

Gemini Developer API는 무료 티어에서 Gemini 3.8 Flash와 3.1 Flash-Lite의 입력·출력을 무료로 제공합니다. 다만 무료 티어에 보낸 콘텐츠는 Google 제품 개선에 사용되고, 유료 티어는 사용되지 않습니다. 고객 데이터나 사내 코드가 들어가는 작업이라면 무료 여부보다 이 조건이 먼저이고, 무료 티어는 프롬프트 검증이나 시제품용으로 보는 것이 맞습니다. 회사별 무료 한도와 조건은 무료 AI API 추천: 조건별 첫 선택과 무료 한도 비교에서 비교합니다.

중계 서비스나 게이트웨이가 공식 가격보다 싼 요금을 내걸어도, 그것은 모델 제공사의 정가가 아니라 해당 업체와 맺는 별도 계약입니다. 실제로 연결되는 모델 ID, 과금 단위, 실패한 호출의 과금 여부, 속도 제한, 환불, 로그와 데이터 처리 방침을 업체별로 따로 확인해야 합니다. 판단 기준은 가장 저렴한 LLM API 제공업체: 가격, 품질, 지연시간, 게이트웨이 리스크 비교를 참고하십시오.

가격 비교 사이트의 숫자가 공식 가격표와 다를 때는 세 가지를 확인하면 원인이 대부분 드러납니다.

  1. 모델 세대: GPT-5.4나 Claude Sonnet 4.6 같은 이전 세대 모델의 행인지 확인합니다.
  2. 가격 주체: 모델 제공사의 정가인지, 중계 서비스의 판매 가격인지 확인합니다.
  3. 과금 조건: Batch 할인, DeepSeek 오프피크, Gemini 3.8 Flash의 연말까지 가격을 기본 가격처럼 적었는지 확인합니다.

먼저 테스트할 모델 1~2개 고르기

월 비용 예시와 과금 조건을 합치면, 처음 테스트할 후보는 다음처럼 좁힐 수 있습니다.

상황먼저 테스트할 모델이유와 확인할 점
대량 처리, 비용이 최우선GPT-6 Luna, DeepSeek Flash두 예시 모두 가장 쌉니다. 한국 업무 시간에 실시간으로 부르면 DeepSeek는 피크 단가로 계산합니다
Google 환경에서 저가 모델이 필요Gemini 3.1 Flash-Lite두 예시 모두 Luna와 DeepSeek Flash 오프피크 다음으로 쌉니다. 무료 티어의 데이터 사용 조건을 확인합니다
경량 모델이 품질 기준을 못 넘음Claude Haiku 4.5, Gemini 3.8 Flash3.8 Flash는 2027년 가격으로 예산을 잡으면 Haiku 4.5보다 비쌉니다
범용 주력 모델, 짧은 프롬프트GPT-6 Sol, Claude Sonnet 5정가가 같으므로 품질, 기존 개발 환경, 캐시 구조로 고릅니다
입력이 272K 토큰을 자주 넘음Claude Sonnet 5100만 토큰까지 같은 단가라 Sol·Gemini 3.1 Pro Preview의 약 절반입니다
긴 출력이 대부분Grok 4.7출력 $6으로 Sol·Sonnet 5보다 출력 중심 월 비용이 약 36% 낮습니다. 다만 Batch가 없어서, 기다릴 수 있는 작업은 Sol·Sonnet 5 Batch($220)가 더 쌉니다
가장 어려운 작업Claude Opus 5.5$4/$20으로 Astra·Fable 5.1의 40%입니다. 기준을 못 넘을 때 상위 모델을 봅니다

후보를 정했으면 실제 작업 20~50건을 같은 프롬프트, 같은 출력 상한, 같은 합격 기준으로 각 모델에 실행합니다. 입력·출력 토큰, 재시도, 형식 오류, 거절, 합격 여부를 기록한 뒤 다음 값을 비교합니다.

합격한 결과 1건당 비용 = 테스트 총비용 ÷ 합격한 결과 수

토큰 단가가 싼 모델도 재시도와 형식 오류가 잦으면 이 값이 올라갑니다. 반대로 단가가 높은 모델이 한 번에 합격한다면 실제로는 더 쌀 수 있습니다. 이 값에 월 예상 처리량을 곱하면 크레딧을 얼마나 충전할지 정할 수 있습니다.

모델별 가격과 계산을 더 자세히 보려면 다음 글이 이어집니다.

자주 묻는 질문

클로드 API 가격은 얼마인가요?

2026년 9월 26일 기준 100만 토큰당 Claude Haiku 4.5가 입력 $1·출력 $5, Sonnet 5가 $2·$10, Opus 5.5가 $4·$20, Fable 5.1이 $10·$50입니다. Batch는 절반이고, 100만 토큰 컨텍스트까지 긴 프롬프트 할증이 없습니다. Sonnet 5는 예고됐던 $3/$15 인상이 취소되어 $2/$10이 유지되고 있습니다.

GPT API 가격은 얼마인가요?

GPT-6 Luna가 입력 $0.10·출력 $0.50, Sol이 $2·$10, Astra가 $10·$50입니다(100만 토큰당, 표준 처리). 입력이 272K 토큰을 넘는 요청은 요청 전체에 입력 2배·출력 1.5배가 적용되고, Batch와 Flex는 절반, Fast mode는 두 배입니다.

가장 저렴한 AI API는 무엇인가요?

공식 정가로는 GPT-6 Luna가 가장 쌉니다. 입력 대부분이 캐시에 적중하는 작업이라면 DeepSeek Flash의 캐시 적중 입력($0.003, 오프피크)이 가장 낮고, 비용 없이 시험만 해 볼 목적이라면 Gemini 무료 티어가 있지만 입력 내용이 Google 제품 개선에 쓰입니다.

Claude API와 OpenAI API 중 어느 쪽이 더 싼가요?

등급에 따라 다릅니다. 가장 싼 모델끼리는 GPT-6 Luna($0.10/$0.50)가 Claude Haiku 4.5($1/$5)의 10분의 1입니다. 주력 모델인 Sol과 Sonnet 5는 짧은 프롬프트 정가가 같지만 272K 토큰을 넘으면 Sonnet 5가 약 절반이고, 최상위 등급에서는 Opus 5.5가 Astra의 40%입니다. 두 회사 비용을 실제 작업량으로 나눠 계산하는 방법은 Claude API와 OpenAI API 가격 비교: 실제 워크로드 기준으로 계산하기에서 볼 수 있습니다. 다만 그 글의 단가는 2026년 5월 기준이므로 현재 가격은 위 표를 사용하십시오.

Grok API 가격 표지: 100만 토큰당 입력·출력 단가 grok-4.7 $2와 $6, grok-4.3 $1.25와 $2.50, grok-build-0.1 $1과 $2, 20만 토큰 이상 요청 전체 2배와 grok-4.7 Batch 미지원 안내
API 가격·요금제

Grok API 가격: grok-4.7·4.3 요금과 월 비용 계산

2026년 9월 기준 grok-4.7은 100만 토큰당 입력 $2·출력 $6, grok-4.3은 $1.25·$2.50입니다. 프롬프트가 20만 토큰 이상이면 요청 전체에 2배 단가가 붙습니다.

11 분