본문으로 건너뛰기

Gemini 3.8 Flash 출시 가이드: 가격, 모델 ID, 3.7 마이그레이션

Gemini 3.8 Flash는 바로 평가할 수 있지만 3.7과 토큰 단가가 같다고 총비용까지 같지는 않습니다. 작업 합격률·토큰·지연·도구를 측정하고 Cyber는 별도의 Fairwind 신청으로 보세요.

LaoZhang AI Team게시업데이트 4 분 소요
목차
Gemini 3.8 Flash 가격 확인과 3.7 카나리 전환, 제한된 Flash Cyber 접근 판단을 연결한 안내도

Gemini 3.8 Flash는 2026년 9월 2일 공개됐고, Gemini Developer API의 안정 모델 ID는 gemini-3.8-flash입니다. 새 서비스를 시작한다면 우선 평가할 만한 현재 Flash 모델입니다. 이미 3.7을 운영 중이라면 전체 트래픽을 한 번에 바꾸기보다 언제든 되돌릴 수 있는 도전 모델로 먼저 붙이는 편이 안전합니다.

3.8과 3.7의 2026년 말까지 토큰 단가는 같습니다. 하지만 Google은 3.8이 복잡한 작업에서 더 작은 추론 단계를 거치고 도구를 반복 호출하면서 더 많은 토큰을 사용할 수 있다고 설명합니다. 단가가 같아도 요청당 비용, 지연시간, 재시도 횟수가 달라질 수 있습니다.

같이 발표된 Gemini 3.8 Flash Cyber도 일반 Flash와 분리해야 합니다. Cyber는 공개 API 목록에 추가된 보통 모델이 아니라, Fairwind Program에서 승인된 방어 조직에 제공되는 제한 모델입니다.

공개 Gemini 3.8 Flash에서 확인할 항목

2026년 9월 3일 기준 공식 모델 사양은 다음을 명시합니다.

항목내용
상태와 IDGA, gemini-3.8-flash
입력 / 최대 출력1,048,576 / 65,536 tokens
입력 형식text, image, video, audio, PDF
출력 형식text
Thinkinglow, medium, high; 기본값 medium
지원하지 않는 값minimal은 오류 반환
주요 기능caching, code execution, file search, function calling, Search/Maps grounding, structured output, URL context
별도 주의computer use는 Preview, image/audio generation과 Live API는 미지원

이미지나 오디오를 입력할 수 있다는 사실은 그런 미디어를 출력할 수 있다는 뜻이 아닙니다. 이미지 생성이나 실시간 음성이 필요한 제품이라면 그 출력에 맞는 전용 모델을 선택해야 합니다.

모델 지원 종료 표에는 현재 3.8과 3.7의 shutdown date가 없습니다. 영구 지원 약속은 아니지만, 당장 종료 일정 때문에 급하게 전환할 필요도 없습니다. 3.7은 비용 민감 작업과 롤백에 계속 쓸 수 있습니다.

가격표보다 중요한 실제 작업 비용

Gemini Developer API 가격표에서 3.8과 3.7은 같은 도입 가격을 사용합니다.

처리 방식2026년 12월 31일까지2027년 1월 1일부터
Standard 입력$0.75 / 1M tokens$1.50 / 1M
Standard 출력$3.75 / 1M$7.50 / 1M
Batch/Flex 입력$0.375 / 1M$0.75 / 1M
Batch/Flex 출력$1.875 / 1M$3.75 / 1M

출력 요금에는 thinking tokens가 포함됩니다. Context cache 저장, Priority, Search grounding, Maps grounding은 별도 행으로 계산됩니다. 이 금액은 Gemini Developer API의 USD 목록 가격이며 Vertex AI, 기업 계약, 세금, 환율, 제3자 gateway 가격과 동일하지 않습니다.

입력 50,000 tokens와 thinking을 포함한 출력 8,000 tokens를 Standard로 처리하면 2026년 말까지 약 $0.0675입니다.

(50,000 × $0.75 + 8,000 × $3.75) / 1,000,000

3.8이 같은 입력에 출력·thinking 14,000 tokens를 쓰면 $0.09가 됩니다. 반대로 3.7에서 두 번 호출해야 통과하던 일을 3.8이 한 번에 끝내면 전체 비용은 낮아질 수 있습니다. 따라서 총 호출비를 수정 없이 채택된 결과 수로 나눈 값을 비교해야 합니다.

3.7 코드를 바꾸기 전에 점검할 것

Gemini 3 요구사항을 잘 지킨 3.7 애플리케이션이라면 실제 변경은 모델 ID 한 줄로 끝날 수 있습니다.

bash
GEMINI_MODEL=gemini-3.8-flash

그래도 카나리 전에 공식 마이그레이션 checklist를 확인하세요. Generation config에서 temperature, top_p, top_k, candidate_count를 제거하고 thinking_budget 대신 문자열 thinking_level을 사용합니다. 3.8에는 minimal을 보내면 안 됩니다.

여러 턴은 서버 측 previous_interaction_id로 이어가고 미리 채운 model turn을 제거합니다. Function calling에서는 payload와 thought signature를 점검합니다. generateContent API라면 모든 FunctionResponse에 call_id와 name이 있어야 합니다. 도구 호출 전 텍스트로 Malformed_Function_Call이 발생하면 형식을 고쳐야지 재시도로 감추면 안 됩니다.

이 목록 전체가 3.8에서 새로 생긴 변경은 아닙니다. 정상적인 3.7 구현은 상당 부분 이미 충족했을 가능성이 큽니다. 오래된 호환 코드나 gateway 변환이 지원 종료 필드를 다시 넣는지 찾는 데 이 점검을 활용하세요.

gemini-3.7-flash는 롤백 값으로 유지합니다. 재현 가능한 평가가 필요하므로 gemini-flash-latest 같은 이동 alias를 기준 모델로 쓰지 않는 편이 좋습니다.

정확한 모델 ID와 동일 작업 비교, 소규모 카나리, 롤백을 연결한 Gemini 3.8 Flash 전환 안내도

전환을 허용하는 지표를 먼저 정하기

최근 정상 작업, 알려진 실패, 장애 비용이 큰 경계 사례를 작게 모읍니다. 두 모델에 동일한 prompt, 입력 파일, tool schema, timeout, retry, thinking level을 적용하고 다음을 기록합니다.

  1. 사람 수정 없이 채택할 수 있는 결과 비율
  2. 올바른 도구 선택과 유효한 인자 비율
  3. 입력·출력·thinking token
  4. 첫 token 시간과 전체 지연, timeout
  5. 형식 오류, 안전 차단, 재시도
  6. 채택 결과 1건당 총비용

오프라인 또는 shadow 비교를 통과한 뒤 3.8에 작은 비율의 실제 트래픽만 보냅니다. 작업 합격률이 떨어지지 않고 tool error가 늘지 않으며 P95 지연과 실제 비용이 예산 안에 있을 때만 비율을 높입니다.

장기 소프트웨어 엔지니어링, 자율 다단계 agent, 복잡한 전문 업무는 3.8의 장점을 확인하기 좋은 대상입니다. 짧은 분류나 대량 추출에서 3.7이 이미 기준을 만족하면 그대로 유지해도 됩니다. 3.8의 추가 추론이 필요 없을 때는 thinking_level: "low"도 같은 데이터로 평가하세요.

공개 Gemini 3.8 Flash와 Fairwind 승인 전용 Flash Cyber를 구분하는 접근 안내도

Flash Cyber는 모델 ID보다 조직 자격이 먼저다

Google의 Fairwind Program은 승인된 신뢰 파트너만 참여하는 제한 프로그램입니다. 정부와 국가 사이버 기관, 핵심 인프라 운영자, 널리 쓰이는 기술 플랫폼, 방어 벤치마킹을 하는 학술 연구실을 우선합니다. 조직의 보안 이력과 윤리적 운영 기록을 확인하며 승인 여부나 처리 기간을 보장하지 않습니다.

승인 파트너는 Gemini 3.8 Flash Cyber를 단독 또는 CodeMender와 함께 사용할 수 있습니다. 내부 cybersecurity, incident response, penetration testing 팀에만 권한을 줄 수 있고, 사용자별 인증, phishing-resistant MFA, 접근 제어, 사용 추적이 필요합니다.

승인된 위협 시뮬레이션, reverse engineering, malware analysis는 방어 또는 학술 연구 목적으로 허용됩니다. Malware 제작과 같은 악의적 작업은 허용되지 않습니다. 접근을 공유·판매·재배포하는 것도 금지됩니다.

그러므로 gemini-3.8-flash-cyber를 확인된 공개 API ID로 쓰면 안 됩니다. 일반 3.8 가격표를 Cyber에 적용해서도 안 됩니다. Google은 공개 Cyber 요금이나 일반 승인 일정을 제시하지 않았습니다. 자격이 없는 조직에는 공개 모델과 CodeMender, AI Threat Defense 제품이 대안이 될 수 있지만 지역과 가격, 계약은 각각 따로 확인해야 합니다.

지금 선택하는 방법

새 프로젝트는 gemini-3.8-flash부터 평가할 수 있습니다. 기존 3.7 서비스는 설정 점검, 같은 작업 비교, shadow 실행, 소규모 카나리 순서로 옮기세요. 채택 가능한 작업, 도구 신뢰성, 지연, 총비용이 기준을 만족할 때만 확대합니다.

단순하고 비용에 민감한 작업을 3.7에 남기는 것은 뒤처진 선택이 아닙니다. Google이 여전히 지원하는 효율 전략입니다. Flash Cyber가 필요하다면 숨은 모델 문자열을 찾기보다 조직이 Fairwind의 방어 목적과 통제 요건을 충족하는지부터 확인해야 합니다.

현재 모델 경로, 가격 구간, AI Studio를 중심으로 정리한 Gemini 3.1 Pro API 가이드
Gemini·Google AI

Gemini 3.1 Pro API 가이드: 설정, 가격, 제한, 마이그레이션 (2026)

Gemini 3.1 Pro API는 긴 컨텍스트, 멀티모달 입력, 도구형 워크플로를 위한 Google의 유료 preview 모델입니다. 이 글에서는 지금 써야 하는 model ID, 가장 빠른 시작 경로, 실제 가격과 제한, 그리고 `gemini-3-pro-preview` 종료 이후 바뀐 점을 정리합니다.

8 분