OpenAI anunció el martes que su próximo modelo de inteligencia artificial, Astra, es el primero en alcanzar el umbral establecido por la empresa para lo que denomina capacidades cibernéticas “críticas”.
La compañía asegura que tiene previsto lanzar públicamente una versión de Astra “próximamente”. Sin embargo, sus capacidades cibernéticas avanzadas estarán inicialmente limitadas a socios seleccionados dentro de Daybreak Blue.
Leer También:
- Bill Gates advierte sobre las consecuencias de la inteligencia artificial
- McDonald’s y la inteligencia artificial: cómo la digitalización está transformando la comida rápida global
Astra alcanzó el umbral de capacidades cibernéticas “críticas”
Responsables de seguridad de OpenAI afirmaron que Astra alcanza las capacidades críticas descritas en su marco de preparación. Según la compañía, ese umbral se alcanza cuando un modelo puede encontrar y explotar de forma independiente vulnerabilidades previamente desconocidas en software real.
Astra no solo puede encontrar nuevas vulnerabilidades y desarrollar formas de explotarlas para realizar ataques informáticos. También puede “encadenar” múltiples exploits, una técnica que permite penetrar cada vez más profundamente en un sistema objetivo y obtener un acceso que no sería posible mediante una sola vulnerabilidad.
Astra supera a modelos líderes en pruebas de ciberseguridad
Según datos de OpenAI, Astra superó a modelos de IA líderes en la industria, como GPT-5.6 Sol y Mythos, en pruebas de ciberseguridad como ExploitBench, donde obtuvo una puntuación del 100 %.
Estas capacidades se enmarcan en el creciente potencial de los modelos de IA para realizar ataques informáticos, una tendencia que OpenAI y Anthropic llevan meses anticipando. En abril, Anthropic destacó que Mythos Preview podía desarrollar cadenas de exploits de forma autónoma.
A medida que las industrias de la IA y la ciberseguridad se adaptan, expertos han recalcado que las defensas digitales fundamentales y las buenas prácticas de larga data siguen siendo efectivas. Sin embargo, la IA expone a un riesgo aún mayor a las organizaciones y sistemas que no han implementado por completo esas protecciones.
OpenAI detuvo el desarrollo hasta implementar salvaguardas
La empresa siguió el procedimiento previsto: detener el desarrollo hasta implementar las salvaguardas y medidas de seguridad adecuadas.
El retraso permitió reforzar los controles de seguridad
OpenAI suspendió durante varias semanas algunas tareas de entrenamiento relacionadas con Astra y con un futuro modelo. Los directivos afirmaron que reanudaron el trabajo después de establecer controles adicionales y que la pausa fue productiva.
El contexto: una carrera por controlar la IA avanzada
El anuncio se produce mientras Silicon Valley enfrenta las capacidades de ciberseguridad cada vez más avanzadas de los modelos de última generación. En julio, OpenAI reveló un incidente en el que agentes de dos modelos obtuvieron acceso a internet y vulneraron Hugging Face desde un entorno de pruebas que debía estar aislado. OpenAI aclaró que Astra no estuvo implicado. Anthropic y Meta también han reportado incidentes similares, y Anthropic suspendió algunas cargas de entrenamiento mientras reforzaba su seguridad.
OpenAI refuerza los controles para limitar el acceso
OpenAI afirma que aplica un enfoque de varios pasos para limitar el acceso de los usuarios comunes a las capacidades cibernéticas avanzadas de Astra. Entre las medidas figura un nuevo “monitor de desalineación”.
En una publicación de blog, la empresa advirtió que el monitor puede ocasionalmente marcar una actividad legítima como posible uso indebido de la ciberseguridad o comportamiento no autorizado. Esto podría hacer que Astra se ralentice, pause o detenga inadvertidamente, incluso durante actividades que no parezcan relacionadas con la ciberseguridad.
Cuando se active esta medida, es posible que se pida a usuarios de ChatGPT y Codex que revisen la acción del modelo antes de continuar.
Si un usuario solicita a Astra encontrar una vulnerabilidad en un sistema de software real, el modelo debería negarse a responder. OpenAI también afirma que lo hizo más resistente a los intentos de jailbreaking y que, en las pruebas, rechazó consultas inseguras con una frecuencia significativamente mayor que modelos anteriores.
Acceso anticipado para proveedores de infraestructura y gobiernos
Los socios del programa Daybreak de OpenAI, entre ellos proveedores de infraestructura digital como Cisco, Cloudflare y Palo Alto Networks, tendrán acceso anticipado a una versión menos restringida de Astra con capacidades cibernéticas más robustas.
El objetivo es que estas compañías puedan usar modelos de IA avanzados como Astra para reforzar sus defensas antes de que otros modelos con capacidades similares estén ampliamente disponibles.
Los directivos de OpenAI también destacaron que la compañía ha colaborado estrechamente con socios gubernamentales para que conozcan las capacidades cibernéticas de Astra y puedan acceder a ellas.
Las capacidades avanzadas estarán limitadas a socios seleccionados
La versión pública de Astra llegará “próximamente”, según la compañía. Sus funciones cibernéticas avanzadas estarán disponibles inicialmente solo para socios seleccionados de Daybreak Blue, con el objetivo de evaluar el modelo, detectar debilidades y reforzar defensas.
El desafío de equilibrar innovación y seguridad
El caso de Astra expone la tensión entre utilizar la IA para fortalecer la ciberseguridad y evitar que sus capacidades ofensivas faciliten ataques. El lanzamiento abrirá un nuevo debate sobre los límites y controles que deben aplicarse a modelos con capacidades cibernéticas avanzadas.
Be the first to comment