# 무료 AI API 추천: 조건별 첫 선택과 무료 한도 비교

> 2026년 9월 26일 기준, 민감하지 않은 데이터라면 Gemini API 무료 한도가 가장 무난합니다. 민감한 데이터는 로컬 실행이나 유료 프로젝트, 오픈 모델 위주라면 Groq가 맞습니다.

- URL: https://blog.laozhang.ai/ko/posts/free-ai-api-tiers-compared
- Published: 2026-07-02
- Updated: 2026-09-26
- Author: LaoZhang AI Team (https://blog.laozhang.ai/ko/about)
- Category: API 가이드
- Tags: 무료 AI API, 무료 LLM API, Gemini API, Groq, OpenRouter, NVIDIA Build, API 한도

---
돈을 쓰지 않고 LLM API를 호출하려는 개발자에게 2026년 9월 26일 기준으로 가장 무난한 첫 선택은 Google AI Studio에서 키를 발급받는 Gemini API 무료 한도입니다. 결제 수단 없이 Flash 계열 모델을 쓸 수 있고, 한국이 이용 가능 지역에 들어 있으며, OpenAI 호환 주소를 제공해 기존 코드를 거의 그대로 쓸 수 있습니다. 대신 무료 한도로 보낸 입력과 출력은 Google 제품 개선에 쓰이고 사람이 검토할 수 있습니다. 고객 정보나 사내 문서를 넣을 계획이라면 이 조건 하나로 선택이 바뀝니다.

조건별로 정리하면 이렇습니다.

- 데이터가 민감하지 않고 성능 좋은 모델이 필요하다: Gemini API 무료 한도
- 데이터를 외부에 보내기 곤란하다: 로컬 실행(Ollama 등) 또는 결제를 연결한 유료 프로젝트
- gpt-oss 같은 오픈 모델을 하루 수백 회 정도 호출한다: Groq 무료 플랜
- 여러 회사의 모델을 키 하나로 비교해 보고 싶다: OpenRouter의 `:free` 모델
- 프로토타입 용도로 NVIDIA가 호스팅하는 모델을 써 보고 싶다: NVIDIA Build(build.nvidia.com)

어느 쪽이든 무료 한도는 시험과 학습을 위한 것이고, 실제 사용자가 붙는 서비스를 받쳐 주도록 설계되어 있지 않습니다. 한도는 보장값이 아니며, 하루 한도를 다 쓰면 초기화 시각까지 429 오류가 이어집니다.

## 무료에도 종류가 있습니다

"무료 AI API"라는 말 안에는 성격이 다른 네 가지가 섞여 있습니다. 어떤 무료인지에 따라 추천이 달라지므로 먼저 구분해 두면 비교표를 읽기 쉽습니다.

| 무료 방식 | 어떻게 주어지나 | 예시 | 알맞은 쓰임 |
| --- | --- | --- | --- |
| 계속 쓰는 무료 한도 | 분·일 단위 요청 한도 안에서 매일 다시 쓸 수 있음 | Gemini API, Groq, Cloudflare Workers AI, SambaNova | 반복 테스트, 개인 도구, 학습 |
| 체험 크레딧 | 가입 시 한 번 주고 기간이 지나면 소멸, 결제 수단 등록이 조건인 경우도 있음 | Cerebras, Anthropic 신규 사용자 크레딧 | 특정 모델을 짧게 평가 |
| 라우터의 무료 모델 | 중개 서비스가 일부 모델을 무료로 열어 두고 호출 횟수를 제한 | OpenRouter `:free` 모델 | 여러 모델 비교, 대체 경로 |
| 로컬 실행 | 오픈 모델을 내 컴퓨터에서 직접 실행 | Ollama 같은 실행 도구 | 민감한 데이터, 오프라인 작업 |

클라우드 API 가운데 조건 없이 무제한인 곳은 없습니다. 호출 횟수 제한에서 자유로운 것은 로컬 실행뿐이고, 이때는 내 하드웨어가 돌릴 수 있는 모델 크기와 속도가 한계가 됩니다.

## 무료 AI API 비교 (2026년 9월 26일 기준)

표의 수치는 각 회사 공식 문서에 공개된 무료 조건입니다. 한도는 예고 없이 자주 바뀌므로 가입 전에 확인 위치 열의 화면을 한 번 더 보는 것이 안전합니다.

| 서비스 | 무료 방식 | 공개된 무료 한도 | 한도 확인 위치와 초기화 | 잘 맞는 경우 |
| --- | --- | --- | --- | --- |
| Gemini API (Google AI Studio) | 결제 연결 없이 쓰는 무료 등급 | Flash·Flash-Lite 계열(`gemini-3.8-flash` 등), 2.5 Pro·Flash·Flash-Lite, Gemma 4, Embedding 2가 무료. 모델별 숫자는 문서에 공개하지 않음 | AI Studio에서 확인, 프로젝트 단위, 일일 한도는 태평양 시간 자정에 초기화 | 성능 좋은 범용 모델로 프로토타입 |
| Groq | 무료 플랜 | `openai/gpt-oss-120b` 등 30 RPM, 하루 1,000회, 분당 8,000토큰, 하루 200,000토큰 | 계정 설정의 Limits 페이지, 조직 단위 | 오픈 모델로 만드는 챗봇·요약 도구 |
| OpenRouter | ID가 `:free`로 끝나는 모델 | 20 RPM, 하루 50회. 누적 10크레딧 이상 구매했다면 하루 1,000회 | `GET /api/v1/key` 응답의 `free_model_daily_requests`, UTC 기준 하루 | 여러 모델 비교 |
| NVIDIA Build | NVIDIA Developer Program 회원에게 프로토타입용 무료 제공 | 해당 안내 페이지에 수치 없음 | build.nvidia.com 계정 | 프로토타입, 연구, 테스트 |
| Cloudflare Workers AI | Workers 무료·유료 플랜에 포함 | 하루 10,000 Neurons, 일부 모델은 유료 결제 수단 필요 | 매일 00:00 UTC 초기화 | 이미 Workers를 쓰는 프로젝트 |
| Mistral | 무료 모드 | 월 포함 사용량은 계정마다 Limits 페이지에만 표시 | 계정 Limits 페이지 | Mistral 모델 평가 |
| SambaNova Cloud | 결제 수단을 연결하지 않은 상태 = 무료 등급 | DeepSeek-V3.1 등 20 RPM, 하루 20회, 하루 200,000토큰 | 공식 한도 문서 | 동작 확인 몇 번 |
| Cohere | 체험 키 | 월 1,000회, 채팅은 모델별 분당 20회 | 공식 한도 문서 | 임베딩·재정렬 평가 |
| Hugging Face Inference Providers | 무료 계정 월 크레딧 | 월 $0.10 | 결제 페이지 | 아주 작은 실험 |

Gemini는 "무료"와 "무제한"을 구분해서 읽어야 합니다. 요금표의 "Free of charge"는 토큰 가격이 0원이라는 뜻이고, 요청 한도는 그대로 있습니다. Google은 모델별 무료 RPM·RPD를 문서에서 내리고 AI Studio에서만 보여 주며, 명시된 한도도 보장값이 아니라고 적고 있습니다. 반대로 3.1 Pro Preview, 이미지 생성 모델(Nano Banana), 동영상 생성 모델 Veo는 무료 등급에서 쓸 수 없습니다. 무료 모델 목록과 AI Studio에서 내 한도를 보는 방법은 [Gemini API 무료 사용 한도와 실시간 한도 확인법](https://blog.laozhang.ai/ko/posts/gemini-api-free-tier)에 있습니다.

Groq의 네 가지 한도는 먼저 닿는 쪽이 적용됩니다. 캐시된 토큰은 한도에 포함되지 않지만, 요청당 입력과 출력을 합쳐 2,000토큰을 쓴다고 하면 계산은 이렇습니다.

- 하루: 200,000토큰 ÷ 2,000토큰 = 약 100회. 하루 1,000회보다 토큰 한도가 먼저 찹니다.
- 분당: 8,000토큰 ÷ 2,000토큰 = 4회. 30 RPM보다 토큰 한도가 먼저 찹니다.

긴 문서를 넣는 챗봇이라면 "하루 1,000회"가 아니라 이 계산 결과를 기준으로 잡아야 합니다.

![요청당 2,000토큰 기준 Groq 무료 플랜에서 하루 약 100회, 분당 4회로 토큰 한도가 요청 수 한도보다 먼저 막히는 계산](https://blog.laozhang.ai/posts/ko/free-ai-api-tiers-compared/img/groq-free-limit-math.webp)

NVIDIA Build에서 중요한 것은 용도 제한입니다. NVIDIA 문서는 이 무료 접근을 "프로토타입, 연구, 개발, 테스트 용도"로 한정합니다. 운영 환경에 올리려면 NVIDIA AI Enterprise 라이선스가 필요하다고 명시되어 있고, 공개 안내 페이지에는 호출 한도나 크레딧 수치가 없습니다.

### 무료로 알려졌지만 지금은 조건이 다른 곳

오래된 추천 목록에 남아 있는 서비스 중에는 무료 조건이 바뀌었거나 아예 종료된 곳이 있습니다.

| 서비스 | 2026년 9월 26일 기준 상태 |
| --- | --- |
| GitHub Models | 2026년 7월 30일 완전 종료. 플레이그라운드, 모델 카탈로그, 추론 API 모두 사용 불가 |
| Cerebras | 계속 쓰는 무료 등급 없음. 결제 수단을 등록하면 $5 체험 크레딧을 주고 30일 뒤 소멸, 등록 전에는 API가 비활성 |
| DeepSeek | 공개 무료 한도 없음. 대신 유료 요금이 낮음 |
| Anthropic Claude API | 신규 사용자에게 소액 테스트 크레딧만 제공, 반복 무료 한도 없음 |
| OpenAI API | 가입만으로 누구에게나 주는 크레딧은 현재 문서에 없음 |

OpenAI와 Claude의 계정별 무료 조건은 각각 [OpenAI API 무료 크레딧과 무료 토큰 확인법](https://blog.laozhang.ai/ko/posts/openai-api-free-tier), [Claude API 키 발급과 무료 크레딧 확인법](https://blog.laozhang.ai/ko/posts/claude-api-key-free-tier)에서 계정 화면 기준으로 다룹니다.

## 내 조건으로 첫 서비스 고르기

선택을 가장 크게 바꾸는 순서대로 네 가지를 확인하면 됩니다.

**1. 입력 데이터가 외부 학습·검토에 쓰여도 괜찮은가.** Gemini API 약관은 무료 한도로 보낸 내용과 생성된 응답을 Google이 제품 제공·개선·개발에 사용하고, 품질 개선을 위해 사람이 입력과 출력을 읽을 수 있다고 적고 있습니다. 그래서 민감한 정보, 기밀, 개인정보를 무료 서비스에 넣지 말라고 직접 안내합니다. 결제 계정이 연결된 Cloud 프로젝트로 호출하면 유료 서비스로 분류되어 이 사용 조항이 적용되지 않습니다. 고객 대화나 사내 문서를 다룬다면 무료 Gemini는 빼고, 로컬 실행이나 유료 프로젝트 중에서 고르세요.

OpenRouter의 무료 모델은 실제 응답을 만드는 상위 제공사가 모델마다 다르기 때문에, 데이터 처리 조건도 어느 제공사가 그 모델을 서비스하는지에 따라 달라집니다. Groq, NVIDIA, Mistral 등 다른 서비스도 무료 요청의 데이터 처리 방식은 각 회사 약관에서 따로 확인해야 합니다.

**2. 하루에 몇 번, 얼마나 긴 요청을 보내는가.** 하루 수십 회라면 표에 있는 어느 서비스든 충분합니다. 하루 수백 회에 요청이 길다면 Groq처럼 토큰 한도가 공개된 곳에서 위의 계산을 해 보고, Gemini는 AI Studio에 표시된 내 프로젝트 한도로 판단합니다. OpenRouter는 크레딧을 산 적이 없으면 하루 50회라서 본격적인 개발보다는 모델 비교에 맞습니다.

**3. 결제 수단을 등록할 수 있는가.** 카드 등록 없이 시작하려면 Gemini 무료 등급, SambaNova 무료 등급처럼 결제 수단을 연결하지 않은 상태가 곧 무료인 곳이 편합니다. Cerebras는 결제 수단을 등록해야 체험 크레딧이 활성화되므로 카드가 없으면 후보에서 빠집니다. OpenRouter의 하루 1,000회 한도는 누적 10크레딧 구매가 조건이므로 무료가 아니라 한 번의 실제 지출로 계산하세요.

**4. 필요한 모델 성능은 어느 정도인가.** Gemini 무료 등급에는 2.5 Pro와 최신 Flash 계열이 들어 있어, 긴 문맥 이해나 추론이 필요한 작업도 무료로 시험해 볼 수 있습니다. 다만 최상위 3.1 Pro Preview는 유료 전용입니다. 요약, 분류, 간단한 챗봇이라면 Groq의 gpt-oss 계열로 먼저 시험해 보고, 품질이 부족할 때 Gemini와 비교하면 됩니다.

## 첫 요청 보내기와 한도 확인

Gemini API는 Google AI Studio에서 키를 발급한 뒤 환경 변수에 넣고 바로 호출할 수 있습니다. 키는 코드에 직접 쓰지 말고 `$GEMINI_API_KEY` 같은 환경 변수로만 읽으세요.

```bash
export GEMINI_API_KEY="AI Studio에서 발급한 키"

curl "https://generativelanguage.googleapis.com/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $GEMINI_API_KEY" \
  -d '{
    "model": "gemini-3.8-flash",
    "messages": [{"role": "user", "content": "무료 한도 테스트입니다. 한 문장으로 답해 주세요."}]
  }'
```

OpenAI 호환 주소를 제공하는 곳은 base_url과 모델 이름만 바꾸면 같은 코드로 호출됩니다. 공식 문서에서 확인되는 주소는 다음 세 곳입니다.

| 서비스 | base_url | 모델 예시 |
| --- | --- | --- |
| Gemini API | `https://generativelanguage.googleapis.com/v1beta/openai/` | `gemini-3.8-flash` |
| Groq | `https://api.groq.com/openai/v1` | `openai/gpt-oss-120b` |
| OpenRouter | `https://openrouter.ai/api/v1` | 모델 목록에서 `:free`로 끝나는 ID |

한도를 확인하는 방법은 서비스마다 다릅니다.

- Gemini: AI Studio에서 프로젝트별 한도를 봅니다. 한도는 API 키가 아니라 프로젝트에 걸리므로 같은 프로젝트에서 키를 여러 개 만들어도 늘지 않습니다.
- Groq: 계정 설정의 Limits 페이지에 조직 전체의 정확한 한도가 나옵니다. 한도를 넘으면 429와 함께 몇 초 뒤 다시 시도하라는 `retry-after` 헤더가 옵니다.
- OpenRouter: 아래처럼 키 정보를 조회하면 오늘 쓴 무료 호출 수와 남은 횟수가 나옵니다. 분당 한도는 여기에 표시되지 않습니다. 계정이나 키를 더 만들어도 한도는 늘지 않고, 크레딧 잔액이 마이너스면 무료 모델에서도 오류가 날 수 있습니다.

```bash
curl https://openrouter.ai/api/v1/key \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
```

## 429 오류가 나면 다른 서비스로 넘기기

429는 "요청이 너무 많다"는 응답입니다. 분당 한도에 걸렸다면 잠시 기다리면 풀리지만, 일일 한도에 걸렸다면 초기화 시각(Gemini는 태평양 시간 자정, OpenRouter와 Cloudflare는 UTC 자정)까지 같은 서비스로는 더 호출할 수 없습니다. OpenRouter에서는 429가 OpenRouter 자체 한도에서 올 수도 있고, 모델을 실제로 서비스하는 상위 제공사에서 올 수도 있습니다.

무료 한도로 개인 도구를 돌린다면, 한 서비스가 429를 반환할 때 다음 서비스로 넘기는 정도의 처리만 넣어도 멈추는 일이 크게 줄어듭니다. 아래 Python 예시는 OpenAI SDK 하나로 Gemini, Groq, OpenRouter를 차례로 시도합니다.

![Gemini, Groq, OpenRouter 순서로 429가 나면 다음 서비스로 넘기는 흐름과 서비스별 한도 초기화 시각](https://blog.laozhang.ai/posts/ko/free-ai-api-tiers-compared/img/free-api-429-fallback.webp)

```python
import os
from openai import OpenAI, RateLimitError

PROVIDERS = [
    {
        "name": "gemini",
        "base_url": "https://generativelanguage.googleapis.com/v1beta/openai/",
        "key_env": "GEMINI_API_KEY",
        "model": "gemini-3.8-flash",
    },
    {
        "name": "groq",
        "base_url": "https://api.groq.com/openai/v1",
        "key_env": "GROQ_API_KEY",
        "model": "openai/gpt-oss-120b",
    },
    {
        "name": "openrouter",
        "base_url": "https://openrouter.ai/api/v1",
        "key_env": "OPENROUTER_API_KEY",
        # 모델 목록에서 :free로 끝나는 ID를 골라 환경 변수에 넣습니다
        "model": os.environ.get("OPENROUTER_FREE_MODEL", ""),
    },
]


def ask(prompt: str) -> str:
    last_error = None
    for p in PROVIDERS:
        api_key = os.environ.get(p["key_env"])
        if not api_key or not p["model"]:
            continue  # 키나 모델이 설정되지 않은 서비스는 건너뜁니다
        client = OpenAI(api_key=api_key, base_url=p["base_url"], max_retries=0)
        try:
            response = client.chat.completions.create(
                model=p["model"],
                messages=[{"role": "user", "content": prompt}],
            )
            return f'{p["name"]}: {response.choices[0].message.content}'
        except RateLimitError as e:
            wait = e.response.headers.get("retry-after")
            print(f'{p["name"]} 429, retry-after={wait}, 다음 서비스로 넘어갑니다')
            last_error = e
    raise RuntimeError("설정된 서비스가 모두 한도에 걸렸거나 키가 없습니다") from last_error


if __name__ == "__main__":
    print(ask("무료 API 폴백 테스트입니다. 한 문장으로 답해 주세요."))
```

`max_retries=0`은 SDK가 같은 서비스에 자동으로 재시도하는 것을 막아 곧바로 다음 서비스로 넘어가게 합니다. 순서는 자유롭게 바꿀 수 있지만, 민감한 입력이 섞일 수 있다면 Gemini 무료 한도를 목록에서 빼야 합니다. 폴백은 멈추지 않게 해 줄 뿐 한도를 늘려 주지는 않으므로, 여러 서비스를 합쳐도 하루 처리량의 상한은 각 무료 한도의 합입니다.

## 무료를 그만둘 시점과 다음 선택지

다음 중 하나에 해당하면 무료 한도로 버티기보다 유료로 옮길 때입니다.

- 실제 사용자가 생겼다. 무료 한도는 보장값이 아니고, NVIDIA처럼 약관상 프로토타입·테스트 용도로 한정된 곳도 있습니다.
- 429 때문에 기능이 자주 멈추거나, 폴백 순서에 따라 답변 품질이 들쭉날쭉해진다.
- 고객 데이터나 사내 문서를 다루게 됐다.
- 무료 등급에 없는 모델(Gemini 3.1 Pro Preview, 이미지·동영상 생성 모델 등)이 필요하다.

다음 단계는 크게 세 갈래입니다.

**유료 공식 API.** 무료로 쓰던 서비스에 결제를 연결하는 것이 가장 간단합니다. Gemini API는 결제 계정을 연결하면 입력이 제품 개선에 쓰이지 않고 한도도 올라갑니다. 2026년 9월 26일 기준 Gemini 3.8 Flash 유료 가격은 아래와 같고, 2027년 1월 1일부터 오를 예정입니다.

| 기간 | 입력 (100만 토큰당) | 출력 (100만 토큰당) |
| --- | --- | --- |
| 2026년 12월 31일까지 | $0.75 | $3.75 |
| 2027년 1월 1일부터 | $1.50 | $7.50 |

**저렴한 유료 API.** DeepSeek은 무료 한도는 없지만 요금이 낮습니다. `deepseek-flash`는 할인 시간대 기준 100만 토큰당 입력(캐시 미적중) $0.15, 출력 $0.6이고, 피크 시간대에는 두 배입니다. 피크는 UTC 기준 평일 01:00~04:00, 06:00~10:00(중국 공휴일 제외)이라 한국 시간으로는 평일 오전 10시~오후 1시, 오후 3시~7시에 해당합니다. 한국 근무 시간 대부분이 피크에 걸린다는 점을 비용 계산에 반영하세요. 여러 회사의 유료 가격을 품질과 지연시간까지 함께 비교하려면 [가장 저렴한 LLM API 제공업체 비교](https://blog.laozhang.ai/ko/posts/cheapest-llm-api-provider)를 참고하세요.

**게이트웨이.** 여러 회사의 모델을 OpenAI 호환 키 하나로 쓰고 결제도 한곳에서 하고 싶다면 게이트웨이가 편합니다. OpenRouter에 크레딧을 충전해 유료 모델을 쓰는 방법이 있고, laozhang.ai도 `https://api.laozhang.ai/v1` 주소로 여러 회사 모델을 호출하는 선불 종량제 게이트웨이입니다. 둘 다 무료 서비스가 아니며, 상위 제공사의 무료 한도를 넘겨받는 구조도 아닙니다. Claude Code 같은 코딩 에이전트에 게이트웨이를 연결하는 설정은 [Claude Code에서 OpenRouter와 DeepSeek 쓰기](https://blog.laozhang.ai/ko/posts/claude-code-openrouter-deepseek)에서 다룹니다.

이미지 생성 API를 찾고 있다면 조건이 전혀 다릅니다. Gemini도 이미지 모델은 무료 등급에서 제외되어 있으므로 [2026 무료 AI 이미지 생성 API 정리](https://blog.laozhang.ai/ko/posts/free-ai-image-generation-api)를 따로 보세요.

## 자주 묻는 질문

### 완전 무료, 무제한인 AI API가 있나요?

클라우드 API 중에는 없습니다. Gemini API의 "Free of charge"도 토큰 요금이 없다는 뜻일 뿐 요청 한도는 있고, 모델별 한도는 AI Studio에서 확인해야 합니다. 호출 횟수 제한 없이 쓰려면 Ollama 같은 도구로 오픈 모델을 로컬에서 실행해야 하며, 이 경우 성능과 속도는 내 컴퓨터 사양이 결정합니다.

### NVIDIA API는 무료로 사용할 수 있나요?

NVIDIA Developer Program 회원이면 build.nvidia.com의 NIM API 엔드포인트를 무료로 쓸 수 있습니다. 다만 용도가 프로토타입, 연구, 개발, 테스트로 한정되고, 운영 환경에는 NVIDIA AI Enterprise 라이선스가 필요합니다. 공개 안내 페이지에는 구체적인 호출 한도가 나와 있지 않습니다.

### API 키를 여러 개 만들면 무료 한도가 늘어나나요?

늘어나지 않습니다. Gemini는 한도가 프로젝트 단위, Groq는 조직 단위로 걸리고, OpenRouter는 계정이나 키를 추가해도 한도가 바뀌지 않는다고 명시합니다.

### DeepSeek API는 무료인가요?

공개된 무료 한도는 없습니다. 대신 유료 요금이 낮아서, 무료 한도로 부족해졌을 때 옮겨 갈 후보가 됩니다. `deepseek-flash`는 할인 시간대 기준 100만 토큰당 입력 $0.15이고, 한국 시간 평일 낮 대부분은 두 배 요금이 붙는 피크 시간대입니다.
