본문으로 건너뛰기

DeepSeek V4 피크 요금제: 한국 시간과 실제 API 비용 계산

4 분 소요AI API Guides

한국 시간 기준 평일 10:00–13:00와 15:00–19:00는 피크 요금입니다. 나머지 시간의 반값 혜택은 지연 가능한 작업에서만 안전하게 활용할 수 있습니다.

DeepSeek V4 피크 시간, token 요금, 비용 계산과 작업 예약 기준 요약

한국에서 DeepSeek 공식 API를 쓴다면 먼저 달력에 두 구간을 표시하면 됩니다. 평일 10:00–13:00, 15:00–19:00 KST는 피크 시간이고, 나머지 시간과 주말은 비피크입니다. 비피크 단가는 피크의 정확히 절반입니다.

하지만 할인만 보고 모든 호출을 밤으로 옮기면 안 됩니다. 야간 평가나 대량 분류처럼 결과가 나중에 와도 되는 작업은 좋은 후보입니다. 사용자가 기다리는 채팅, 장애 대응, 결제·안전 판단, 대화형 coding agent는 지연 자체가 더 큰 비용이 될 수 있습니다.

아래 수치는 2026년 9월 3일 DeepSeek 공식 가격 문서에서 확인했습니다. 공급자가 가격을 바꿀 수 있다고 명시하므로, 예산 확정 전에는 같은 페이지를 다시 확인해야 합니다.

모델 이름보다 먼저 토큰 구성을 확인하세요

공식 hosted API는 입력을 캐시 적중과 캐시 미적중으로 나누고, 출력에는 별도 단가를 적용합니다. 따라서 “입력 800만 토큰”만으로는 청구액을 재현할 수 없습니다.

모델시간대캐시 적중 입력캐시 미적중 입력출력
deepseek-v4-flash비피크$0.007$0.22$0.66
deepseek-v4-flash피크$0.014$0.44$1.32
deepseek-v4-pro비피크$0.022$0.66$1.98
deepseek-v4-pro피크$0.044$1.32$3.96

단위는 100만 tokens당 USD입니다. 제3자 gateway, cloud marketplace, open-weight 자체 운영의 가격표는 다를 수 있습니다. 웹·앱 이용과 API 과금도 같은 계약이 아닙니다.

Flash는 자동 검증이 가능한 반복 작업의 첫 선택으로 두기 쉽습니다. Pro는 실제 업무에서 성공률을 높이거나 재시도와 사람 검수를 줄였을 때 선택해야 합니다. 비피크 단가가 싸다는 사실만으로 Pro가 더 경제적인 것은 아닙니다.

하루치 사용량으로 청구액을 재현하는 법

한 모델과 한 시간대의 비용식은 다음과 같습니다.

text
비용 = 캐시 적중 입력 ÷ 1,000,000 × 적중 단가 + 캐시 미적중 입력 ÷ 1,000,000 × 미적중 단가 + 출력 ÷ 1,000,000 × 출력 단가

입력 800만 tokens 중 600만이 캐시에 적중하고, 출력이 100만 tokens인 배치를 가정해 보겠습니다. 미적중 입력은 200만입니다.

V4 Flash 비용은 비피크 6 × 0.007 + 2 × 0.22 + 1 × 0.66 = $1.142, 피크 $2.284입니다. V4 Pro는 비피크 $3.432, 피크 $6.864입니다.

같은 token 구성을 비피크로 옮기면 공급자 token 비용은 절반이 됩니다. 캐시 적중률을 높이는 것은 별도 최적화입니다. 비싼 미적중 입력을 싼 적중 입력으로 바꾸기 때문입니다. 두 효과는 함께 얻을 수 있지만 서로 대신하지는 못합니다.

이 계산에는 재시도, gateway 수수료, 세금, 환율, 처리 지연, 품질 저하와 검수 시간이 포함되지 않습니다. 지연 때문에 마감을 놓치거나 사람이 다시 실행하면 API 항목이 싸져도 작업 전체는 비싸질 수 있습니다.

DeepSeek V4 Flash와 Pro의 피크·비피크 token 비용 계산

KST로 보여 주되 UTC로 판정하세요

공식 규칙은 월요일부터 금요일까지 01:00–04:00 UTC, 06:00–10:00 UTC를 피크로 정의합니다. KST는 UTC+9이고 서머타임이 없으므로 같은 날짜의 10:00–13:00, 15:00–19:00로 안정적으로 바뀝니다.

그럼에도 scheduler의 기준은 UTC로 유지하는 편이 안전합니다. 서버 region이나 container의 local timezone이 바뀌어도 가격 규칙과 어긋나지 않기 때문입니다. 운영 화면에서만 KST로 변환하고 로그에는 offset을 포함한 원본 시각을 남기세요.

각 작업에는 요청 시각, 실제 model ID, 캐시 적중 입력, 미적중 입력, 출력 tokens, 재시도 횟수, 최종 상태, 마감과 작업별 비용을 기록합니다. 잔액 감소만 보면 시간대, 출력 증가, 캐시 저하, 중복 실행을 구분할 수 없습니다.

작업 큐에 넣기 전 확인할 조건

비피크 대기열에 적합한 작업은 입력이 저장되어 있고, 다시 실행해도 업무 결과가 중복되지 않으며, 성공을 자동 확인할 수 있어야 합니다. 다음 비피크 창까지 기다려도 마감에 여유가 있어야 하고, 재시도 한도를 넘었을 때 복구 경로도 필요합니다.

회귀 평가, 문서 분류, 색인 보강, 비긴급 repository scan, 다시 만들 수 있는 전처리는 대체로 이 조건에 맞습니다. 실시간 사용자 응답, incident 대응, 결제·위험 판단, 짧은 SLO의 자동화는 즉시 실행하는 편이 안전합니다.

애매한 작업에는 고정 야간 시각 대신 not_beforedeadline_at을 부여하세요. 마감까지 여유가 있는 동안만 비피크를 기다리고, 여유가 줄면 즉시 실행 대기열로 승격합니다. 가격은 scheduling 신호가 되지만 사용자 경험을 덮어쓰지 않습니다.

중복 전달도 대비해야 합니다. 안정적인 업무 키로 DB 기록이나 알림을 중복 제거하고, DeepSeek request와 최종 업무 commit을 따로 추적하면 재시도가 두 번의 결과를 만들지 않습니다.

DeepSeek 배치 작업을 비피크 대기열로 옮길지 판단하는 흐름

비피크는 여유 용량을 보장하지 않습니다

현재 rate limit 문서는 계정 기준 동시 요청을 Flash 2500, Pro 500으로 표시하며, 초과하면 HTTP 429를 반환한다고 설명합니다. 일부 계정은 증설을 요청할 수 있지만 공개 수치는 어느 시간대의 latency나 availability도 보장하지 않습니다.

지수 backoff, 최대 재시도 수, queue age 경보, dead-letter 처리를 그대로 유지하세요. 먼저 고정된 작업 집합을 소량으로 한 주 동안 실행하고 피크/비피크의 성공률, p95 지연, 재시도, 출력 길이, 검수 시간을 비교합니다. 100만 tokens 가격이 아니라 “승인된 작업 하나의 총비용”이 내려갔을 때만 범위를 넓히면 됩니다.

DeepSeek의 V4 Pro 정식 출시 공지에 따르면 새 가격은 2026년 8월 16일 16:00 UTC부터 적용됐습니다. 그래서 4월 Preview와 고정 단가를 설명하는 예전 문서는 현재 청구와 맞지 않습니다.

다른 공급자까지 비용 후보에 넣는다면 같은 입력, 출력 상한, 재시도 정책과 합격 기준으로 현재 LLM API 가격을 비교하세요. 반값 시간은 분명하지만, 작업이 제시간에 올바르게 끝났을 때만 실제 절감입니다.

#DeepSeek V4#DeepSeek API#API 요금#배치 처리
Share: