Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
FUNDINGAccel en conversaciones para invertir $1B en Thinking MachinesDATOSam Altman advierte sobre exceso "insostenible" en cómputo de IAMODELOK2 Horizon lanza seis nuevos modelos de IA de código abiertoMODELONuevo modelo de Google mejora drásticamente pronóstico del tiempoPRODUCTOOllie apuesta a la privacidad para ganar carrera de asistentes de IADATOMeta paga a usuarios para monitorear uso de su modelo de IAPRODUCTOAbliteration.ai: negocio de eliminar salvaguardas de IABREAKINGCrusoe levanta USD 3.000 M y triplica valuación en 10 meses con infraestructura de IA alimentada por energía varadaBREAKINGOpenAI destina US$1.000 millones para que defensores cibernéticos protejan infraestructura crítica con IABREAKINGNvidia lanza PAIR: software gratuito que conecta tus PCs para crear un centro de IA localDATONueva York restringe uso de IA en escuelas hasta nivel secundariaMODELOQuasar 438B: Europa presenta su nuevo modelo de IA líderFUNDINGPalo Alto Networks adquiere la startup Console por $500 millonesMODELOOpenAI califica a Astra como su modelo más 'peligroso' y difícil de monitorearDATOMilitares de EE.UU. añaden ChatGPT y Grok a su plataforma GenAI.milPRODUCTOChatGPT: 3 días de trabajo en 3 horas para ATV Big Air TourFUNDINGHiddenLayer obtiene $100M para proteger despliegues de IA empresarialMODELOMeta anuncia Muse Spark 1.3, su nuevo modelo de IA generativaBREAKINGAnthropic invierte USD 35.000 millones con Lambda para expandir infraestructura de Claude en TexasBREAKINGEl DOJ de EE.UU. respalda el uso justo para entrenar IA en el caso del New York Times vs OpenAIBREAKINGGoogle lanza Gemini 3.8 Flash con variante especializada en ciberseguridad al mismo precio que 3.7DATOBenchMIRT: ¿Qué miden realmente los benchmarks de LLM?PRODUCTOHugging Face lanza 200+ WebGPU Kernels para IA localPRODUCTOChatGPT se integra con historiales de salud para organizaciones médicas

MODELOS DE IA

Google presenta Gemini 3.8 Flash con variante especializada en ciberseguridad

Google lanza dos versiones de Gemini 3.8: Flash, su modelo más inteligente para ingeniería de software y agentes autónomos, y Flash Cyber, especializado en detección de vulnerabilidades y parcheo automático, al mismo precio que su predecesor.

3 DE SEPTIEMBRE DE 20263 SEPLECTURA 3 MINREDACTADO POR IA
Google presenta Gemini 3.8 Flash con variante especializada en ciberseguridad
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

Google acaba de lanzar Gemini 3.8, la tercera actualización de su línea Flash en apenas seis semanas. Esta versión llega en dos variantes: Gemini 3.8 Flash, descrito como su modelo más capaz hasta ahora para razonamiento y código, y Gemini 3.8 Flash Cyber, diseñado específicamente para ciberseguridad. Según anunció Google en su blog oficial, ambas versiones mantienen el precio introductorio de 3.7 Flash: $0.75 por millón de tokens de entrada y $3.75 por millón de salida.

Rendimiento: más cerca de modelos premium, a fracción del costo

En DeepSWE v1.1, un benchmark de ingeniería de software a largo plazo, 3.8 Flash supera a la mayoría de los modelos frontier más grandes resolviendo problemas de ingeniería complejos de forma autónoma. En dominios especializados como finanzas y legal, 3.8 Flash superó a 3.7 Flash y otros modelos frontier en benchmarks como Vals Finance Agent V2 y Harvey's Legal Agent Benchmark. El modelo alcanzó un 54.9% en HLE-Verified, que mide razonamiento multi-paso en STEM, humanidades y campos profesionales.

La mejora tiene un trade-off: 3.8 Flash "trabaja más duro", ejecutando pasos de razonamiento adicionales y llamando herramientas de forma iterativa. En tareas complejas puede usar más tokens que su predecesor, especialmente en niveles de esfuerzo altos. Para aplicaciones donde la eficiencia computacional es prioritaria, Google sugiere usar niveles de esfuerzo más bajos o continuar con 3.7 Flash, que seguirá soportado.

La variante Cyber: del 70% de éxito en detección a parcheo automático

Gemini 3.8 Flash Cyber está disponible solo para un grupo selecto de defensores a través del nuevo Fairwind Program de Google. En CyberGym, el benchmark estándar de detección de vulnerabilidades, muestra rendimiento de nivel frontier superando tanto a 3.5 Flash Cyber como a modelos significativamente más grandes.

En un benchmark interno que cubre 20 lenguajes de programación (más allá del C/C++ de CyberGym), el modelo alcanza más del 70% de éxito en descubrir vulnerabilidades en bases de código complejas. En capacidades de parcheo, logra 47.2% pass@1 en CWE-Bench, prácticamente al nivel del mejor modelo frontier (47.8%) pero a menor costo.

Google ya está usando 3.8 Flash Cyber internamente: el equipo de seguridad de Chrome reporta que el modelo produce 2.6 veces más parches correctos a vulnerabilidades que los mejores modelos comerciales de mayor tamaño.

Por qué importa

La estrategia de Google con esta release es clara: iterar rápido y bajar el piso de lo que podés hacer con un modelo económico. Tres actualizaciones en seis semanas señalan un ritmo de desarrollo que pocas organizaciones pueden igualar, y poner rendimiento casi-frontier a $0.75 el millón de tokens cambia la ecuación de costos para aplicaciones de producción.

Para empresas que están construyendo agentes autónomos o sistemas de análisis en dominios especializados, 3.8 Flash ofrece un punto de entrada con relación precio-rendimiento que hasta hace poco solo estaba disponible en modelos mucho más caros. La variante Cyber, aunque de acceso restringido, marca una apuesta concreta: entrenar modelos específicamente para defensa, priorizando parcheo sobre explotación.

Si estás evaluando modelos para flujos de trabajo agenticos o necesitás razonamiento complejo sin explotar el presupuesto, esta actualización vale la pena probar. Y si tu caso de uso tolera mayor uso de tokens a cambio de mejor rendimiento, el comportamiento "más trabajador" de 3.8 puede ser exactamente lo que necesitás.

#gemini#google#modelos de lenguaje#ciberseguridad#agentes autónomos

SEGUIR LA SEÑAL

VER TODO →