Modelos · EDICIÓN 04

Gemini 3.8 Flash gana capacidad, aunque puede consumir más por tarea

Ilustración editorial con el símbolo de Google Gemini
Imagen: Cath Virginia / The Verge

En breve

  • Disponible para desarrolladores y determinados planes de Gemini.
  • Flash Cyber permanece reservado a defensores verificados.
  • El mayor esfuerzo puede elevar el consumo aunque la tarifa por token no cambie.

Qué cambia

Google ha estrenado Gemini 3.8 Flash, centrado en programación de larga duración, agentes y razonamiento con herramientas. Mantiene el precio promocional por millón de tokens de 3.7 Flash, pero Google avisa de que el modelo puede dar más pasos y generar más tokens para resolver problemas complejos. Una tarifa idéntica por token no implica, por tanto, una factura idéntica por trabajo terminado.

La familia añade Gemini 3.8 Flash Cyber, una variante defensiva para localizar vulnerabilidades y proponer parches. Esta versión no se ofrece de manera abierta: está limitada a gobiernos, operadores de infraestructuras críticas y mantenedores de software aceptados en el programa Fairwind.

El contexto y los límites

La diferencia más interesante para un desarrollador está en el control del esfuerzo. Google recomienda niveles bajos cuando prima el coste y 3.7 Flash para cargas muy sensibles a la eficiencia. The Verge recogió pruebas iniciales de Artificial Analysis que estimaban alrededor de un 40% más de coste por tarea respecto a 3.7 Flash, debido a más tokens de salida y más turnos en evaluaciones agentivas. Esa observación sirve como advertencia, no como medida universal.

Google publica mejoras en sus pruebas de ingeniería de software, finanzas, derecho y ciberseguridad. Algunas evaluaciones pertenecen a terceros, pero la selección y la presentación de los resultados forman parte del anuncio del proveedor. En producción conviene medir precisión, latencia, consumo real y estabilidad con las mismas tareas que resolverá la aplicación. Para usuarios de Gemini, la disponibilidad se concentra inicialmente en los planes AI Pro y Ultra, mientras que los desarrolladores pueden usarlo desde AI Studio y la API.

Cómo llevarlo a la práctica

Para una aplicación, prepara diez tareas representativas y ejecútalas con 3.7 Flash y 3.8 Flash usando el mismo criterio de evaluación. Registra tokens de entrada y salida, número de llamadas a herramientas, latencia y correcciones humanas. Así podrás saber si el mayor razonamiento compensa el consumo adicional.

No utilices Flash Cyber fuera de un entorno autorizado. El modelo general puede ayudar a revisar código, pero una auditoría de seguridad profesional requiere herramientas específicas, permisos explícitos y verificación independiente de cada hallazgo.

Comprueba las fuentes

El anuncio y su contraste están enlazados para que puedas consultar el alcance original. Las valoraciones pertenecen a la síntesis editorial.

Fuente original · GoogleSegunda referencia · The Verge

Sigue leyendo

GPT‑6 Astra convierte el uso del ordenador en la gran apuesta de OpenAI

Claude Fable 5.1 mejora el trabajo largo y reduce el coste de la memoria caché

La carrera de la IA abre un debate incómodo: avanzar más despacio para poder controlar los riesgos

← Volver a la edición · Archivo · Cómo seleccionamos las noticias