# 가장 저렴한 LLM API 제공업체: 같은 모델의 구매 경로별 실제 비용

> 2026년 9월 기준 DeepSeek과 GPT-6 Luna는 제공사 직접 API의 오프피크·Batch가 가장 쌌습니다. 호스팅 업체는 모델마다 순서가 바뀌고, 라우터에는 충전 수수료가 붙습니다.

- URL: https://blog.laozhang.ai/ko/posts/cheapest-llm-api-provider
- Published: 2026-07-01
- Updated: 2026-09-26
- Author: LaoZhang AI Team (https://blog.laozhang.ai/ko/about)
- Category: API 가격
- Tags: LLM API, API 가격, DeepSeek, OpenRouter, API 게이트웨이

---
쓸 모델을 이미 정했다면 "가장 싼 업체"는 모델마다 다릅니다. 2026년 9월 26일 기준 각 업체 가격표로 월 입력 1억 토큰, 출력 2,000만 토큰(캐시 없음)을 계산하면 결과는 이렇습니다.

- **DeepSeek V4 Pro**: DeepSeek 공식 API 오프피크 $105.60, DeepInfra $182.00, 공식 API 피크 시간과 Together AI는 똑같이 $211.20입니다.
- **GPT-6 Luna**: OpenAI 직접 API의 Batch/Flex $10, 표준 $20, OpenRouter를 거치면 충전 수수료 5.5%가 더해져 $21.10입니다.
- **오픈 웨이트 모델끼리도 순서가 바뀝니다**: Kimi K3는 DeepInfra가 Together보다 5% 싸고, Qwen3.7-Max는 Together가 DeepInfra보다 40% 쌉니다.

그래서 판단 규칙은 세 가지로 정리됩니다. GPT·Claude·Gemini·Grok 같은 폐쇄형 모델은 제공사 직접 API가 토큰 단가의 기준점이고, 라우터와 게이트웨이는 그 기준점에 수수료나 배율을 더한 값과 편의(키 하나, 모델 전환, 결제 방식)를 함께 따져 고릅니다. DeepSeek·Kimi·Qwen·GLM 같은 오픈 웨이트 모델은 공식 API(오프피크 포함)와 호스팅 업체 두세 곳을 같은 사용량으로 계산해 봐야 합니다. 그리고 표에서 유난히 싼 행이 보이면 가격보다 먼저 모델 버전을 확인합니다. 어떤 모델이 가장 싼지부터 고르는 단계라면 [AI API 가격 비교: 5개사 등급별 요금과 가장 싼 모델](https://blog.laozhang.ai/ko/posts/cheapest-llm-models)을 먼저 보는 편이 빠릅니다.

## 네 가지 구매 경로는 서로 다른 것을 팝니다

LLM API를 사는 곳은 크게 네 부류입니다. 이름은 모두 "API 제공업체"지만 가격을 누가 정하고, 문제가 생겼을 때 누가 책임지는지가 다릅니다.

| 구매 경로 | 파는 것 | 가격을 정하는 쪽 | 싸지는 조건 | 먼저 볼 위험 |
| --- | --- | --- | --- | --- |
| 모델 제공사 직접 계약 (OpenAI, Anthropic, Google, xAI, DeepSeek) | 자기 모델의 최신 버전 | 모델 제공사 | 오프피크, Batch/Flex, 캐시 적중 | 결제 수단, 계정 한도 |
| 오픈 웨이트 호스팅 업체 (Together AI, DeepInfra, Fireworks) | 공개 가중치 모델을 자기 GPU로 서빙 | 호스팅 업체 | 업체 간 단가 차이, 전용 배포 | 버전·정밀도가 공식과 다를 수 있음 |
| 라우터·애그리게이터 (OpenRouter) | 여러 업체로 요청을 보내는 단일 API | 하위 업체 가격 + 라우터 수수료 | BYOK 무료 구간 | 충전 수수료, 실제로 어느 업체가 처리했는지 |
| 게이트웨이·중계 업체 (laozhang.ai 등) | 여러 제공사 모델을 한 키와 선불 잔액으로 이용 | 게이트웨이 | 그룹별 단가, 결제·접속 편의 | 공식 운영자가 아님, 그룹 배율, 선불 잔액 |

폐쇄형 모델은 첫째 줄과 셋째·넷째 줄에서만 살 수 있습니다. 오픈 웨이트 모델은 네 줄 모두에 나타나기 때문에 비교할 행이 많고, 그만큼 같은 이름의 다른 버전을 섞어 비교할 위험도 큽니다.

## 같은 모델을 경로별로 계산하면

아래 표는 모두 100만 토큰당 입력 / 출력 단가이며, 2026년 9월 26일 각 업체 공개 가격표 기준입니다. 월 비용은 입력 1억 토큰과 출력 2,000만 토큰, 캐시 적중 없음으로 계산했습니다. 공식은 `입력 단가 × 100 + 출력 단가 × 20`입니다.

| 모델 | 구매 경로 | 입력 / 출력 | 월 비용 |
| --- | --- | ---: | ---: |
| DeepSeek V4 Pro | DeepSeek 공식 API, 오프피크 | $0.66 / $1.98 | $105.60 |
| DeepSeek V4 Pro | DeepInfra | $1.30 / $2.60 | $182.00 |
| DeepSeek V4 Pro | DeepSeek 공식 API, 피크 | $1.32 / $3.96 | $211.20 |
| DeepSeek V4 Pro | Together AI (V4 Pro 0813) | $1.32 / $3.96 | $211.20 |
| DeepSeek V4.1 Flash | DeepSeek 공식 API, 오프피크 | $0.15 / $0.60 | $27.00 |
| DeepSeek V4.1 Flash | DeepSeek 공식 API, 피크 | $0.30 / $1.20 | $54.00 |
| DeepSeek V4.1 Flash | Together AI | $0.30 / $1.20 | $54.00 |
| Kimi K3 | DeepInfra | $2.85 / $14.25 | $570.00 |
| Kimi K3 | Together AI | $3.00 / $15.00 | $600.00 |
| Qwen3.7-Max | Together AI | $1.50 / $4.50 | $240.00 |
| Qwen3.7-Max | DeepInfra | $2.50 / $7.50 | $400.00 |
| GPT-6 Luna | OpenAI 직접, Batch/Flex | $0.05 / $0.25 | $10.00 |
| GPT-6 Luna | OpenAI 직접, 표준 | $0.10 / $0.50 | $20.00 |
| GPT-6 Luna | OpenRouter 경유 (Standard 수수료 5.5%) | $0.10 / $0.50 + 수수료 | $21.10 |

출처: [DeepSeek 가격 문서](https://api-docs.deepseek.com/quick_start/pricing), [Together AI 가격](https://www.together.ai/pricing), [DeepInfra 가격](https://deepinfra.com/pricing), [OpenRouter 가격](https://openrouter.ai/pricing). Kimi K3와 Qwen3.7-Max는 호스팅 업체 두 곳끼리만 비교한 값입니다.

![DeepSeek V4 Pro와 GPT-6 Luna의 구매 경로별 월 비용 막대 비교: V4 Pro는 공식 오프피크 $105.60, DeepInfra $182.00, 공식 피크와 Together AI $211.20, GPT-6 Luna는 Batch/Flex $10.00, 표준 $20.00, OpenRouter 경유 $21.10](https://blog.laozhang.ai/posts/ko/cheapest-llm-api-provider/img/route-monthly-cost.webp)

### DeepSeek: 공식 오프피크가 호스팅 업체보다 쌉니다

DeepSeek 공식 API는 평일 01:00-04:00, 06:00-10:00 UTC(중국 공휴일 제외)를 피크로 보고, 나머지 시간에는 피크의 절반을 받습니다. 한국 시간으로는 평일 10:00-13:00와 15:00-19:00가 피크입니다. 야간 배치나 주말 작업처럼 시간을 옮길 수 있는 일이라면 V4 Pro를 월 $105.60에 쓸 수 있고, 이보다 싼 호스팅 행은 표에 없습니다. 시간대 계산과 예약 방법은 [DeepSeek V4 피크 요금제: 한국 시간과 실제 API 비용 계산](https://blog.laozhang.ai/ko/posts/deepseek-v4)에 정리되어 있습니다.

반대로 한국 업무 시간에 실시간으로 응답해야 한다면 계산이 바뀝니다. 그 시간대 공식 단가는 피크이므로 V4 Pro는 DeepInfra가 월 $29.20 싸집니다(출력 단가 $2.60 대 $3.96). Together AI의 V4 Pro와 V4.1 Flash 행은 DeepSeek 공식 피크 가격과 숫자가 똑같고 오프피크 할인 표시가 없으므로, 시간대와 관계없이 공식 API보다 싸지지 않습니다.

캐시 적중이 많으면 순서가 또 달라집니다. 입력 1억 토큰 중 80%가 캐시에 적중한다고 가정하면 V4 Pro 월 비용은 공식 오프피크 $54.56, DeepInfra $86.00, 공식 피크 $109.12, Together AI $116.00입니다. 캐시 입력 단가가 공식 피크 $0.044, DeepInfra $0.10, Together AI $0.13으로 달라서 Together는 공식 피크보다도 비싸집니다. 다만 캐시가 실제로 얼마나 적중하는지는 업체의 캐시 방식에 따라 다르므로 80%는 계산용 가정입니다.

### 오픈 웨이트 모델: 호스팅 업체 순위는 모델마다 뒤집힙니다

Kimi K3에서는 DeepInfra가, Qwen3.7-Max에서는 Together AI가 쌌습니다. 한 업체가 모든 모델에서 싸다는 전제로 계정을 하나만 만들면 모델에 따라 월 $160(Qwen3.7-Max 기준)을 더 낼 수 있습니다. 호스팅 업체를 고를 때는 "어느 업체가 싸냐"가 아니라 "내가 쓸 모델의 행이 어디서 싸냐"를 봐야 합니다.

같은 업체 안에서도 서빙 방식에 따라 가격표가 나뉩니다. Together AI 가격 페이지에는 서버리스 가격과 별도로 Batch API 가격 탭이 있고, Fireworks는 서버리스를 토큰당 후불로 과금하면서 GPU 초 단위로 과금하는 전용 배포를 따로 둡니다. 사용량이 많아지면 이 탭들도 같은 사용량으로 계산해 볼 가치가 있습니다.

### 폐쇄형 모델: 직접 API가 기준, 라우터는 수수료만큼 비쌉니다

OpenRouter는 하위 업체의 가격을 마크업 없이 그대로 넘기고, 대신 크레딧을 충전할 때 수수료를 받는다고 FAQ에 밝히고 있습니다. 수수료는 Standard 요금제 5.5%, Business 8%입니다. 따라서 GPT-6 Luna를 OpenRouter로 쓰면 토큰 단가는 OpenAI 정가와 같고, 충전액에 수수료가 붙는 만큼 비싸집니다. $500를 충전하면 수수료는 $27.50입니다.

직접 API에만 있는 할인도 챙겨야 합니다. OpenAI는 Batch/Flex에 표준 가격의 절반을 받고, Google Gemini 3.8 Flash도 Batch가 절반입니다. Gemini 3.8 Flash의 입력 $0.75 / 출력 $3.75는 2026년 12월 31일까지이고 이후에는 $1.50 / $7.50으로 오릅니다. 라우터나 게이트웨이가 같은 Batch 할인을 제공하는지는 해당 업체 가격표에서 따로 확인해야 합니다. Claude와 OpenAI를 워크로드별로 비교하려면 [Claude API와 OpenAI API 가격 비교: 워크로드별 계산](https://blog.laozhang.ai/ko/posts/claude-api-vs-openai-api-pricing), Grok은 [Grok API 가격: grok-4.7·4.3 요금과 월 비용 계산](https://blog.laozhang.ai/ko/posts/xai-grok-api-pricing)을 참고하세요.

## 싸 보이는 가격에 숨은 함정

가격 비교가 틀어지는 지점은 대부분 단가 자체가 아니라 무엇을 비교하고 있는지에 있습니다.

**호스팅 가격이 공식 피크 가격과 같은 경우.** Together AI의 DeepSeek V4 Pro 0813($1.32 / $3.96)과 V4.1 Flash($0.30 / $1.20)는 DeepSeek 공식 피크 가격과 같습니다. 호스팅 업체를 쓰면 공식 API보다 싸다는 기대로 옮겼다가, 오프피크 절반 할인만 잃는 결과가 됩니다.

**비슷한 이름으로 파는 구 스냅샷.** DeepSeek 공식 API의 `deepseek-flash`는 지금 DeepSeek-V4.1-Flash가 처리하고, 예전 `deepseek-v4-flash` 이름은 공식 API에서 퇴역해 같은 V4.1-Flash로 연결됩니다. 그런데 호스팅 업체에는 이전 스냅샷이 남아 있습니다. Together AI는 DeepSeek V4 Flash 0731을 $0.14 / $0.28에, DeepInfra는 DeepSeek-V4-Flash-0731을 $0.06 / $0.18에 팝니다. DeepInfra에는 날짜 없이 DeepSeek-V4-Flash라고만 적힌 행($0.09 / $0.18)도 있는데, 이것이 V4.1인지 가격표만으로는 알 수 없습니다. 월 비용으로 치면 공식 V4.1 Flash 오프피크 $27.00과 DeepInfra 0731 $9.60은 서로 다른 모델의 가격입니다. 버전 차이가 품질에 얼마나 영향을 주는지는 쓰려는 작업으로 직접 비교해야 합니다. GLM 계열도 GLM-5.3-Flash($0.15 / $0.50, Together AI)처럼 버전명이 세분되어 있으니 [GLM-5.3-Flash 사용 가이드: Ox Alpha 정체, API 가격, 로컬 실행](https://blog.laozhang.ai/ko/posts/glm-5-3-flash-guide)에서 버전 관계를 확인하고 비교하세요.

![DeepSeek 공식 API의 deepseek-flash는 V4.1-Flash가 처리하지만 호스팅 업체는 V4 Flash 0731 스냅샷과 날짜 없는 V4-Flash 행을 더 싸게 판다는 비교, 월 $27.00과 $9.60은 서로 다른 모델의 가격](https://blog.laozhang.ai/posts/ko/cheapest-llm-api-provider/img/flash-version-trap.webp)

**패스스루 가격 위에 붙는 충전 수수료.** "마크업 없음"은 토큰 단가 이야기이고, 결제 단계의 수수료는 별도입니다. OpenRouter에서 자기 제공사 키를 연결하는 BYOK를 쓰면 Standard·Business 요금제 기준 매월 정가 기준 $25,000어치 추론까지는 수수료가 없고, 초과분에는 5%가 붙습니다. 이미 제공사 계정이 있고 라우팅 기능만 필요하다면 충전 수수료보다 BYOK가 유리한 구간이 있습니다.

**업체가 스스로 만든 순위.** SiliconFlow가 펴낸 "가장 저렴한 LLM API 제공업체" 가이드처럼 호스팅 업체나 게이트웨이가 직접 만든 순위에는 그 업체 자신이 들어 있습니다. 자기 서비스를 포함한 순위는 가격 근거가 아니며, 위 표처럼 같은 모델, 같은 사용량으로 다시 계산하는 편이 정확합니다.

**무료 크레딧과 무료 모델.** Fireworks는 서버리스 가입 시 $1 크레딧을 주고, OpenRouter Free 요금제는 25개 이상 무료 모델을 하루 50요청까지 쓸 수 있게 합니다. 프롬프트를 시험하기에는 충분하지만 운영 비용 계산에는 들어가지 않습니다. 무료 한도를 조건별로 비교하려면 [무료 AI API 추천: 조건별 첫 선택과 무료 한도 비교](https://blog.laozhang.ai/ko/posts/free-ai-api-tiers-compared)를 보세요.

**정밀도(양자화) 문제.** 호스팅 업체가 싸면 양자화된 가중치로 서빙하는 것 아니냐는 걱정이 흔합니다. 가격표에는 가중치 정밀도가 적혀 있지 않으므로 가격만으로는 판단할 수 없습니다. 모델 상세 페이지나 문서에 정밀도 표기가 있는지 확인하고, 없으면 업체에 문의한 뒤, 최종적으로는 같은 프롬프트 세트의 합격률로 비교하는 것이 가장 확실합니다.

## 가격표보다 합격 출력당 비용으로 비교합니다

토큰 단가가 싼 경로가 실제로 싼지는 결과물이 기준을 통과했을 때만 말할 수 있습니다. 비교에 쓸 식은 하나입니다.

`합격 출력당 비용 = 시험 기간의 총 청구액 ÷ 품질 기준을 통과한 출력 수`

예를 들어 월 10만 건을 처리하는 작업에서 경로 A는 청구액 $200에 60%가 통과하고, 경로 B는 $250에 90%가 통과한다고 합시다. 합격 1,000건당 비용은 A가 $3.33($200 ÷ 60,000 × 1,000), B가 $2.78($250 ÷ 90,000 × 1,000)입니다. 가격표에서는 A가 싸지만 실제로는 B가 쌉니다. 불합격 출력을 다시 요청하면 A의 청구액은 더 늘어납니다.

이 값을 바꾸는 변수는 다음과 같습니다.

| 변수 | 왜 순서가 바뀌나 | 기록할 값 |
| --- | --- | --- |
| 출력 길이 | 모델·버전에 따라 같은 작업에도 출력 토큰 수가 다름 | 합격 출력의 평균 출력 토큰 |
| 캐시 적중률 | 캐시 입력 단가 차이가 업체마다 큼 | 실제 캐시 적중 비율 |
| 재시도 | 시간 초과, 형식 오류, 거절도 과금될 수 있음 | 합격 1건당 요청 수 |
| 시간대 | 오프피크·Batch는 지연을 허용할 때만 적용 | 지연 허용 작업의 비율 |
| 수수료·배율 | 충전 수수료, 게이트웨이 그룹 배율 | 청구서 총액 ÷ 정가 기준 사용량 |

## 게이트웨이·중계 업체를 쓸 때의 확인 기준

게이트웨이·중계 업체의 단가는 모델과 그룹 배율에 따라 달라서 제공사 정가보다 쌀 수도, 비쌀 수도 있습니다. 단가와 별개로 해외 결제가 어렵거나, 여러 제공사 계정을 따로 관리하기 부담스럽거나, 하나의 API 형식으로 여러 모델을 바꿔 가며 써야 할 때 전체 비용(개발 시간과 계정 관리 포함)을 줄여 줄 수 있습니다. 이 경우에도 비교 기준은 위와 같습니다. 게이트웨이 가격표의 행에 그룹 배율과 수수료를 곱한 값을 제공사 정가와 나란히 놓고 계산합니다.

laozhang.ai는 이 블로그를 운영하는 LaoZhang의 API 게이트웨이로, 같은 기준으로 확인할 수 있는 사실은 다음과 같습니다.

- 싱가포르 법인 YingTu Technology Pte. Ltd.가 운영하며, 연결하는 제3자 모델의 공식 운영자가 아니라고 문서에 밝히고 있습니다.
- 기본 주소 하나(`https://api.laozhang.ai/v1`)로 OpenAI 호환 형식과 Anthropic Messages 형식(`/v1/messages`)을 모두 받습니다. 네트워크에서 기본 주소에 접속되지 않으면 `api2.laozhang.ai`를 씁니다.
- 선불 잔액에서 차감하며, 모델에 따라 토큰 단위 또는 호출당 과금이고, 일부 토큰 그룹에는 가격 배율이 적용됩니다. 모델별 단가와 그룹은 "Models and pricing" 페이지와 콘솔에서 확인하고, 호출 로그에 요청별 비용이 남습니다.
- 프롬프트와 응답 내용은 기본적으로 저장하지 않고, 과금·보안·속도 제한에 필요한 메타데이터(시각, 모델, 사용량, 상태, 지연 시간)는 보관합니다.
- 가입에는 Gmail 주소가 필요하고, 가입과 서비스 이용은 허용 목록 심사를 거칩니다.

그러므로 laozhang.ai가 맞는 경우는 여러 제공사 모델을 한 키와 선불 잔액으로 묶고 싶을 때, 그리고 선불 잔액으로 지출 상한을 두고 싶을 때입니다. 특정 모델 하나만 대량으로 쓰고 제공사 계정과 결제가 문제없다면, 직접 API의 정가와 Batch·오프피크 할인을 먼저 계산한 뒤 게이트웨이 행과 비교하세요. Claude 접속 경로를 따로 비교하려면 [Claude 안정 접속은 어떻게 골라야 하나: Anthropic 직결, 지원 클라우드, 아니면 laozhang.ai 호환 게이트웨이?](https://blog.laozhang.ai/ko/posts/claude-gateway-laozhang-ai), 에이전트 도구에 중계 API를 연결하는 설정은 [OpenClaw 완전 가이드: API 중계 설정, 모델 선택, 비용 최적화 (2026)](https://blog.laozhang.ai/ko/posts/openclaw-api-guide)에 있습니다.

## 운영 트래픽을 옮기기 전 확인 목록

가격표로 후보를 좁혔다면, 실제 전환은 아래 순서로 진행합니다.

1. **모델 ID와 버전 대조**: 후보 경로의 모델 ID, 스냅샷 날짜, 컨텍스트 길이를 제공사 공식 API와 맞춰 봅니다. 날짜가 없거나 다른 행은 별도 모델로 취급합니다.
2. **과금 단위 확인**: 100만 토큰당 입력·캐시 입력·출력, 호출당 과금, 그룹 배율, 충전 수수료를 모두 적습니다.
3. **시간대와 Batch**: 작업 중 몇 퍼센트를 오프피크나 Batch로 돌릴 수 있는지 정하고, 그 경로에서 할인이 실제로 적용되는지 확인합니다.
4. **결제 방식**: 선불인지 후불인지, 최소 충전액과 환불 조건, 잔액 소진 시 요청이 어떻게 처리되는지 확인합니다.
5. **한도와 지연 시간**: 분당 요청·토큰 한도와 필요한 동시 처리량을 비교하고, 피크 시간대에 지연 시간을 측정합니다.
6. **데이터 처리**: 프롬프트에 개인정보나 비공개 소스 코드가 들어간다면 경로마다 보존·학습 사용 조건을 확인합니다. 방법은 [LLM API 데이터 보존 vs ZDR: 소스 코드 배포를 막는 보안 게이트](https://blog.laozhang.ai/ko/posts/llm-api-data-retention-vs-zero-data-retention)에 있습니다.
7. **같은 프롬프트 세트 실행**: 실제 작업에서 뽑은 수백 건을 후보 경로마다 돌려 청구액, 재시도, 합격 출력 수를 기록하고 합격 출력당 비용을 계산합니다.
8. **상한을 건 부분 전환**: 지출 상한과 원래 경로로 되돌릴 방법을 준비한 뒤 트래픽 일부부터 옮깁니다.

모델 버전을 특정할 수 없거나, 실패한 요청의 과금 방식이 문서에 없거나, 사용량을 요청 단위로 볼 수 없다면 그 경로는 단가가 낮아도 운영에 넣지 않는 편이 안전합니다. 비용을 추적할 수 없는 경로는 절감 효과도 확인할 수 없습니다.

## 자주 묻는 질문

### OpenRouter 같은 라우터가 직접 API보다 싼가요?

토큰 단가로는 싸지 않습니다. OpenRouter는 하위 업체 가격을 그대로 넘기고 크레딧 충전 시 Standard 5.5%, Business 8%의 수수료를 받으므로, 같은 업체를 직접 쓰는 것보다 수수료만큼 비쌉니다. 다만 오픈 웨이트 모델에서 여러 호스팅 업체 중 싼 곳으로 보내 주거나, 키 하나로 여러 모델을 바꿔 쓰는 편의가 수수료보다 크다면 선택할 만합니다.

### 호스팅 업체가 DeepSeek 공식 API보다 싼가요?

2026년 9월 26일 기준 V4 Pro는 DeepInfra($1.30 / $2.60)가 공식 피크($1.32 / $3.96)보다 싸지만, 공식 오프피크($0.66 / $1.98)보다는 비쌉니다. Together AI는 공식 피크와 같은 가격입니다. 작업을 한국 시간 평일 10:00-13:00, 15:00-19:00 밖으로 옮길 수 있다면 공식 API가 가장 쌉니다.

### 가격표에서 훨씬 싼 DeepSeek 행이 보이면 써도 되나요?

먼저 버전을 확인하세요. DeepSeek V4 Flash 0731처럼 날짜가 붙은 행은 공식 API가 지금 제공하는 V4.1-Flash와 다른 스냅샷입니다. 싼 이유가 버전 차이라면 같은 모델의 가격 비교가 아니므로, 쓰려는 작업에서 품질을 따로 시험한 뒤 결정해야 합니다.

### laozhang.ai는 제공사 직접 API보다 싼가요?

모델과 토큰 그룹에 따라 단가와 배율이 달라서 한 줄로 말할 수 없습니다. "Models and pricing" 페이지와 콘솔에서 쓰려는 모델의 행과 그룹 배율을 확인한 뒤, 제공사 정가 및 Batch·오프피크 할인과 같은 사용량으로 비교하세요. 여러 제공사 모델을 한 키와 선불 잔액으로 쓰는 편의가 필요할 때 고려할 만한 경로입니다.

### 가장 싼 모델 자체를 찾고 있다면 어디서 시작하나요?

모델을 아직 정하지 않았다면 제공사별 등급과 공식 정가를 먼저 비교하는 편이 빠릅니다. [AI API 가격 비교: 5개사 등급별 요금과 가장 싼 모델](https://blog.laozhang.ai/ko/posts/cheapest-llm-models)에서 모델을 고른 뒤, 위 표처럼 그 모델을 파는 경로별로 월 비용을 계산하면 됩니다.
