Saltar al contenido principal

Gemini 3.8 Flash: precio, ID y migración segura desde 3.7

6 min de lecturaModelos de IA

Gemini 3.8 Flash se puede evaluar en producción, pero compartir tarifa con 3.7 no garantiza la misma factura. Mide resultados aceptados, tokens, latencia y herramientas; Cyber exige otra vía mediante Fairwind.

Decisión entre el precio de Gemini 3.8 Flash, una migración gradual desde 3.7 y el acceso restringido a Flash Cyber

Gemini 3.8 Flash dejó de ser un nombre por confirmar el 2 de septiembre de 2026. Su identificador estable en Gemini Developer API es gemini-3.8-flash y Google lo marca como disponible de forma general. Es un candidato lógico para una integración nueva. Si ya tienes 3.7 en producción, conviene introducirlo como alternativa reversible y no como sustitución inmediata de todo el tráfico.

Hay un matiz económico importante: 3.8 y 3.7 comparten las tarifas actuales por token, pero Google avisa de que 3.8 puede razonar durante más pasos y llamar más veces a herramientas en trabajos complejos. La misma tarifa no asegura el mismo número de tokens, la misma latencia ni el mismo coste por tarea aprobada.

El lanzamiento también incluye Gemini 3.8 Flash Cyber. No es otra opción pública del catálogo. Google la reserva a defensores aprobados en Fairwind Program. Migrar una aplicación normal y solicitar acceso a Cyber son procesos distintos.

La ficha técnica que debes fijar

La especificación oficial de Gemini 3.8 Flash indica, a 3 de septiembre:

ElementoGemini 3.8 Flash
Estado e IDGA; gemini-3.8-flash
Entrada / salida máxima1.048.576 / 65.536 tokens
Formatos de entradaTexto, imagen, vídeo, audio y PDF
Formato de salidaTexto
Niveles de thinkinglow, medium, high; medium por defecto
Nivel no admitidominimal devuelve un error
Funciones principalesCaché, ejecución de código, búsqueda de archivos, function calling, grounding con Search/Maps, salida estructurada y contexto URL
Límites relevantesComputer use está en Preview; no genera imágenes o audio ni usa Live API

Aceptar una imagen o un audio como entrada no significa generarlos como salida. Para imagen, voz sintetizada o conversación en tiempo real debes elegir una familia especializada.

La tabla de retirada de modelos no muestra fecha de apagado para 3.8 ni 3.7. No es una garantía perpetua, pero permite conservar gemini-3.7-flash como opción eficiente y como reversión mientras validas el cambio.

La tarifa coincide; la factura puede cambiar

El precio oficial de Gemini Developer API separa el periodo promocional de 2026 del estándar de 2027:

ProcesamientoHasta el 31 de diciembre de 2026Desde el 1 de enero de 2027
Standard, entrada$0.75 / 1M tokens$1.50 / 1M
Standard, salida$3.75 / 1M$7.50 / 1M
Batch/Flex, entrada$0.375 / 1M$0.75 / 1M
Batch/Flex, salida$1.875 / 1M$3.75 / 1M

La salida incluye thinking tokens. El almacenamiento de caché, Priority y el grounding con Search o Maps tienen conceptos adicionales. Son precios en USD de Gemini Developer API, no tarifas de Vertex AI, contratos empresariales, impuestos, cambio a euros o proveedores intermediarios.

Una petición con 50.000 tokens de entrada y 8.000 de salida —thinking incluido— cuesta unos $0.0675 en Standard durante 2026:

text
(50.000 × $0.75 + 8.000 × $3.75) / 1.000.000

Si 3.8 consume 14.000 tokens de salida, sube a $0.09. Pero si evita un segundo intento que 3.7 necesitaba, el coste total puede bajar. Por eso conviene dividir todo el gasto entre los resultados que se pueden usar sin reparación, en lugar de comparar solo una llamada.

Qué revisar antes de cambiar desde 3.7

Una integración 3.7 bien actualizada puede necesitar únicamente este cambio:

bash
GEMINI_MODEL=gemini-3.8-flash

Aun así, revisa la lista oficial de migración. Elimina temperature, top_p, top_k y candidate_count de la configuración. Sustituye thinking_budget por el enum de texto thinking_level y no envíes minimal a 3.8.

En conversaciones de varios turnos utiliza previous_interaction_id en el servidor y retira los turnos de modelo precargados. Comprueba los payloads de function calling y conserva las thought signatures. Con generateContent, cada FunctionResponse debe incluir call_id y name. Si el texto anterior a una herramienta provoca Malformed_Function_Call, corrige el formato en vez de ocultar el fallo con reintentos.

No todos esos puntos son cambios nuevos entre 3.7 y 3.8. Un servicio 3.7 limpio probablemente ya cumple muchos. La auditoría sirve para descubrir compatibilidad antigua, prompts heredados o transformaciones de un gateway que vuelven a insertar campos retirados.

Mantén gemini-3.7-flash como valor de reversión. Para una prueba reproducible fija IDs exactos y evita basarte en gemini-flash-latest, que puede cambiar sin que cambie tu código.

Migración a Gemini 3.8 Flash con ID fijado, comparación del mismo trabajo, canary pequeño y reversión

Una prueba que sí puede autorizar el cambio

Selecciona casos normales, fallos recientes y límites con alto impacto. Ejecuta 3.7 y 3.8 con los mismos prompts, archivos, esquemas de herramientas, timeouts, reintentos y thinking. Registra:

  1. porcentaje de resultados aceptables sin arreglo manual;
  2. selección correcta de herramientas y argumentos válidos;
  3. tokens de entrada, salida y thinking;
  4. tiempo hasta el primer token y latencia total;
  5. errores de formato, bloqueos y reintentos;
  6. coste total por resultado aceptado.

Tras superar la comparación offline o en shadow, envía a 3.8 una parte pequeña del tráfico que cumpla los requisitos. Amplía solo si la tasa de aceptación no empeora, no aumentan los errores de herramientas y tanto la latencia P95 como el coste real entran en el presupuesto.

Los proyectos largos de software, los agentes autónomos de varios pasos y los procesos profesionales complejos son candidatos naturales para comprobar 3.8. Una clasificación breve o una extracción masiva quizá siga funcionando mejor económicamente con 3.7. También puedes probar thinking_level: "low" si el trabajo no necesita razonamiento adicional.

Distinción de acceso entre Gemini 3.8 Flash público y Flash Cyber restringido a Fairwind

El límite real de Gemini 3.8 Flash Cyber

Fairwind Program tiene acceso controlado. Google prioriza autoridades públicas de ciberseguridad, operadores de infraestructuras críticas, plataformas tecnológicas centrales y laboratorios académicos centrados en evaluación defensiva. Revisa el historial y la conducta ética de cada organización; no promete aprobación ni un plazo fijo de respuesta.

Los socios aprobados pueden usar Gemini 3.8 Flash Cyber de forma independiente o con CodeMender. Solo pueden conceder acceso a sus equipos internos de ciberseguridad, respuesta a incidentes o pruebas de penetración. Deben aplicar autenticación individual, MFA resistente al phishing, controles de acceso y seguimiento del uso.

Se permiten simulaciones de amenazas autorizadas, ingeniería inversa y análisis de malware cuando el fin es defensivo o académico. Crear malware u otras tareas maliciosas sigue prohibido. Tampoco se puede compartir, revender o redistribuir el acceso.

La consecuencia es directa: gemini-3.8-flash-cyber no debe presentarse como un ID público confirmado, y el precio del Flash normal no puede atribuirse automáticamente a Cyber. Google no publica una tarifa pública general ni garantiza que una organización obtenga acceso. Para quien no sea elegible, propone CodeMender con modelos públicos y otros productos AI Threat Defense, cuyas condiciones y precios deben verificarse por separado.

Una decisión práctica

Para un proyecto nuevo, empieza la evaluación con gemini-3.8-flash. Para un sistema 3.7, revisa el contrato de API, compara el mismo trabajo, ejecuta en shadow y después abre un canary pequeño. Solo expande cuando resultados aceptados, fiabilidad de herramientas, latencia y coste total cumplan los límites.

Mantener 3.7 para tareas estables y sensibles al coste es una decisión vigente, no quedarse atrás. Si lo que necesitas es Flash Cyber, comienza por la elegibilidad y el gobierno de Fairwind, no por buscar un modelo oculto o comprar acceso a un tercero.

#Gemini 3.8 Flash#Gemini 3.7 Flash#Gemini API#Migración de modelos#Fairwind Program
Share: