Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
PRODUCTOPlaud lanza auriculares con eSIM para agentes de IADATOBarret Zoph, ex-OpenAI, se une a GoogleFUNDINGOpenAI expande su presencia a BrasilDATOAustralia prohíbe IA generativa en listas musicalesMODELOReportan el ascenso de los modelos de IA pequeñosDATOIndustria IA critica plan de Trump de gravar chipsPRODUCTOGoogle Search integra IA para planificar y reservar viajesDATOJensen Huang (Nvidia) afirma haber logrado AGI 'sin sentido'BREAKINGOpenAI lanza publicidad en ChatGPT gratuito y Go en India con 50 marcas y ad manager desde septiembreBREAKINGGoogle Gemini Omni 1.1 Flash baja 60% el costo de generar video con IA y procesa más rápidoBREAKINGAnthropic lanza estándar para que agentes de IA controlen equipamiento físico de laboratorio y fábricaBREAKINGAnthropic firma contrato de US$45 mil millones con Nscale para capacidad de cómputo previo a su IPODATOAmazon triplica pedidos de chips Nvidia por demanda crecienteDATONvidia camino a ser empresa de $100 mil millones por trimestreBREAKINGSam Altman: AGI de OpenAI para fines de 2026 (según su definición)FUNDINGStartup viral Instinct levanta $350M con valuación de $2.5BFUNDINGAnthropic cierra acuerdo de $45B con Nscale por cómputo de IAPRODUCTOGoogle lanza Gemini 3.5 Transcribe, edita 'ums' y 'ahs'MODELOIBM libera Granite 4.2: modelos open-weight con agentesMODELOAlibaba lanza Qwen3.8-Flash-Next: eficiencia de costo extremaBREAKINGIsrael montó un think tank falso para manipular chatbots con propaganda disfrazada de investigación académicaBREAKINGMeta canceló plan para reemplazar 60% de empleados con IA tras aumento del 40% en incidentes técnicosBREAKINGNvidia compra Hugging Face por USD 12.900 millones mientras OpenAI y Anthropic desarrollan chips propiosBREAKINGZ.ai lanza GLM-5.3-Flash, modelo open source chino que promete alto rendimiento y costos reducidos

SEGURIDAD EN MODELOS

OpenAI frena el desarrollo de Astra tras detectar capacidades cibernéticas críticas

El nuevo modelo Astra alcanzó el umbral crítico de ciberseguridad del Preparedness Framework de OpenAI, lo que llevó a la compañía a pausar actividades internas y reforzar controles de seguridad antes de continuar.

8 DE AGOSTO DE 20268 AGOLECTURA 3 MINREDACTADO POR IA
OpenAI frena el desarrollo de Astra tras detectar capacidades cibernéticas críticas
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

OpenAI anunció que detuvo parte del desarrollo interno de Astra, uno de sus próximos modelos de lenguaje, después de que evaluaciones preliminares indicaran que alcanzó el nivel crítico de capacidades cibernéticas bajo su Preparedness Framework. Es la primera vez que un modelo de la compañía cruza este umbral desde que el marco fue publicado en diciembre de 2023.

Según OpenAI, las evaluaciones de los últimos días mostraron avances significativos en codificación agéntica y ciberseguridad. La conclusión: no pueden descartar que el modelo pueda identificar y desarrollar exploits de vulnerabilidades zero-day de todos los niveles de gravedad en sistemas críticos reales sin intervención humana, o diseñar y ejecutar estrategias completas de ciberataques contra objetivos robustos a partir de objetivos de alto nivel.

Qué es el umbral crítico

El Preparedness Framework clasifica modelos en cuatro niveles de riesgo por capacidad: bajo, medio, alto y crítico. Un modelo alcanza el nivel Critical en ciberseguridad cuando puede explotar vulnerabilidades de día cero en múltiples sistemas endurecidos del mundo real de forma autónoma, o idear y ejecutar ataques complejos de punta a punta sin ayuda humana.

Modelos anteriores de OpenAI, incluido GPT-5.6-Sol, habían sido evaluados en el umbral High pero nunca llegaron a crítico. Astra es el primero en cruzar esa línea. La compañía aclara que Astra no estuvo involucrado en el reciente incidente de seguridad con Hugging Face.

Medidas de seguridad inmediatas

OpenAI pausó todas las actividades internas con Astra que no cumplan con los nuevos requisitos de control de seguridad reforzados. Las medidas incluyen:

  • Entornos de prueba aislados con acceso restringido a redes y herramientas.
  • Protección y cifrado mejorados para los pesos del modelo.
  • Monitoreo universal de acciones riesgosas y desalineación en todas las aplicaciones agénticas de Astra, incluidos entrenamiento y evaluación. Los monitores revisan la cadena de pensamiento del modelo y activan respuestas de seguridad para interrumpir actividad de alto riesgo.
  • Ejecución en sandboxes para todas las operaciones.

La compañía también anunció que trabajará con agencias gubernamentales y organizaciones selectas de seguridad en IA para testear las capacidades del modelo, y proveerá controles de seguridad recomendados a socios externos que ejecuten evaluaciones de alto riesgo.

Por qué importa

Esta es la primera pausa pública de desarrollo que OpenAI ejecuta bajo su propio marco de preparación, y marca un punto de inflexión en la conversación sobre modelos avanzados. Que un laboratorio líder detenga trabajo interno porque su propio sistema de evaluación detectó riesgo crítico valida dos cosas: que los marcos de autoevaluación pueden funcionar, y que las capacidades ofensivas en ciberseguridad están escalando más rápido de lo esperado.

Para empresas que adoptan IA, esto refuerza la necesidad de implementar controles de seguridad en capas cuando se despliegan modelos con capacidades agénticas, especialmente si esos agentes tienen acceso a sistemas críticos o datos sensibles. No todos los modelos llegarán al nivel de Astra, pero las técnicas de monitoreo y aislamiento que OpenAI está aplicando —sandboxes, revisión de cadenas de pensamiento, cifrado de pesos— son prácticas transferibles a cualquier operación que ejecute agentes autónomos a escala.

OpenAI sostiene que modelos con capacidades cibernéticas avanzadas deberían ayudar a defensores a identificar vulnerabilidades antes que atacantes. Esa promesa solo se cumple si los controles de seguridad están a la altura de las capacidades. Este anuncio es una señal de que la industria está empezando a tomarse esa responsabilidad en serio.

#openai#ciberseguridad#astra#preparedness framework#modelos avanzados

SEGUIR LA SEÑAL

VER TODO →