MODELOS DE IA
Google presenta Gemini 3.8 Flash con variante especializada en ciberseguridad
Google lanza dos versiones de Gemini 3.8: Flash, su modelo más inteligente para ingeniería de software y agentes autónomos, y Flash Cyber, especializado en detección de vulnerabilidades y parcheo automático, al mismo precio que su predecesor.

Google acaba de lanzar Gemini 3.8, la tercera actualización de su línea Flash en apenas seis semanas. Esta versión llega en dos variantes: Gemini 3.8 Flash, descrito como su modelo más capaz hasta ahora para razonamiento y código, y Gemini 3.8 Flash Cyber, diseñado específicamente para ciberseguridad. Según anunció Google en su blog oficial, ambas versiones mantienen el precio introductorio de 3.7 Flash: $0.75 por millón de tokens de entrada y $3.75 por millón de salida.
Rendimiento: más cerca de modelos premium, a fracción del costo
En DeepSWE v1.1, un benchmark de ingeniería de software a largo plazo, 3.8 Flash supera a la mayoría de los modelos frontier más grandes resolviendo problemas de ingeniería complejos de forma autónoma. En dominios especializados como finanzas y legal, 3.8 Flash superó a 3.7 Flash y otros modelos frontier en benchmarks como Vals Finance Agent V2 y Harvey's Legal Agent Benchmark. El modelo alcanzó un 54.9% en HLE-Verified, que mide razonamiento multi-paso en STEM, humanidades y campos profesionales.
La mejora tiene un trade-off: 3.8 Flash "trabaja más duro", ejecutando pasos de razonamiento adicionales y llamando herramientas de forma iterativa. En tareas complejas puede usar más tokens que su predecesor, especialmente en niveles de esfuerzo altos. Para aplicaciones donde la eficiencia computacional es prioritaria, Google sugiere usar niveles de esfuerzo más bajos o continuar con 3.7 Flash, que seguirá soportado.
La variante Cyber: del 70% de éxito en detección a parcheo automático
Gemini 3.8 Flash Cyber está disponible solo para un grupo selecto de defensores a través del nuevo Fairwind Program de Google. En CyberGym, el benchmark estándar de detección de vulnerabilidades, muestra rendimiento de nivel frontier superando tanto a 3.5 Flash Cyber como a modelos significativamente más grandes.
En un benchmark interno que cubre 20 lenguajes de programación (más allá del C/C++ de CyberGym), el modelo alcanza más del 70% de éxito en descubrir vulnerabilidades en bases de código complejas. En capacidades de parcheo, logra 47.2% pass@1 en CWE-Bench, prácticamente al nivel del mejor modelo frontier (47.8%) pero a menor costo.
Google ya está usando 3.8 Flash Cyber internamente: el equipo de seguridad de Chrome reporta que el modelo produce 2.6 veces más parches correctos a vulnerabilidades que los mejores modelos comerciales de mayor tamaño.
Por qué importa
La estrategia de Google con esta release es clara: iterar rápido y bajar el piso de lo que podés hacer con un modelo económico. Tres actualizaciones en seis semanas señalan un ritmo de desarrollo que pocas organizaciones pueden igualar, y poner rendimiento casi-frontier a $0.75 el millón de tokens cambia la ecuación de costos para aplicaciones de producción.
Para empresas que están construyendo agentes autónomos o sistemas de análisis en dominios especializados, 3.8 Flash ofrece un punto de entrada con relación precio-rendimiento que hasta hace poco solo estaba disponible en modelos mucho más caros. La variante Cyber, aunque de acceso restringido, marca una apuesta concreta: entrenar modelos específicamente para defensa, priorizando parcheo sobre explotación.
Si estás evaluando modelos para flujos de trabajo agenticos o necesitás razonamiento complejo sin explotar el presupuesto, esta actualización vale la pena probar. Y si tu caso de uso tolera mayor uso de tokens a cambio de mejor rendimiento, el comportamiento "más trabajador" de 3.8 puede ser exactamente lo que necesitás.
SEGUIR LA SEÑAL
VER TODO →OpenAI confirma que Astra alcanza el umbral crítico en ciberseguridad
La compañía retrasó el lanzamiento de Astra para reforzar salvaguardias contra exploits autónomos de zero-days. Es el primer modelo que OpenAI clasifica en nivel crítico bajo su marco de preparación.
Anthropic lanza Claude Fable 5.1 y Mythos 5.1 con 45% menos de costo
Anthropic presentó Claude Fable 5.1 y Mythos 5.1, sus modelos más avanzados para coding y conocimiento. La versión 5.1 reduce costos hasta 45% en tareas agentivas y mejora safeguards en ciberseguridad, mientras Mythos queda restringido a programas de acceso para ciencias de la vida.
Google Gemini Omni 1.1 Flash baja 60% el costo de generar video con IA
La nueva versión del modelo de Google introduce un modo borrador a 360p que cuesta un tercio que la resolución estándar y procesa hasta 60% más rápido. Permite extender escenas hasta 40 segundos y usar footage externo como referencia de estilo.