OpenAI pausa el modelo Astra tras detectar capacidades críticas de ciberseguridad

Evaluaciones internas mostraron que la IA puede identificar y explotar fallas informáticas sin supervisión humana.

0
19

OpenAI resolvió pausar temporalmente las actividades de desarrollo interno y las pruebas de su próximo modelo conocido como Astra, luego de que sus evaluaciones de seguridad identificaran un incremento sustancial en sus capacidades de ciberseguridad y generación de código.

La medida preventiva responde a los lineamientos de su protocolo de gestión de riesgos, denominado Preparedness Framework, el cual exige detener los avances cuando un sistema alcanza un level de peligro calificado como crítico.

Según la información oficial divulgada por la compañía estadounidense, las evaluaciones preliminares demostraron que Astra posee la aptitud de analizar entornos informáticos complejos, descubrir vulnerabilidades de software no documentadas de manera autónoma y ejecutar vectores de intrusión digital sin requerir la asistencia o supervisión de operadores humanos. Ante estos resultados, la firma tecnológica señaló que no es posible descartar que el sistema haya traspasado el umbral de capacidad crítica en el ámbito cibernético.

La organización precisó que Astra no tuvo relación con el incidente de seguridad reportado en la plataforma para desarrolladores Hugging Face, donde modelos de OpenAI lograron identificar una falla de acceso e ingresar al servicio sin instrucciones previas. Sin embargo, especialistas de firmas de auditoría independiente como Palisade Research y CrowdStrike han advertido que estos episodios demuestran la urgencia de reforzar las barreras de confinamiento de los agentes inteligentes. Como respuesta a la clasificación de Astra, OpenAI congeló las tareas internas que no cumplan con protocolos de aislamiento reforzados.

La situación observada en OpenAI refleja una tendencia generalizada en la industria del desarrollo de IA de frontera. Meses atrás, la empresa competidora Anthropic reportó que su modelo Claude Mythos demostró habilidades para localizar de forma independiente miles de vulnerabilidades en sistemas operativos y navegadores web, lo que reduce de manera drástica el costo, el esfuerzo y el nivel de especialización necesarios para ejecutar análisis ofensivos. Estos avances han abierto un debate entre analistas sobre la velocidad del progreso técnico frente a las capacidades de regulación.

Para abordar las dudas del sector, OpenAI anunció que compartirá sus metodologías de prueba y colaborará estrechamente con agencias gubernamentales e institutos de seguridad estatales. El objetivo de este marco colaborativo es someter a Astra a verificaciones independientes antes de evaluar cualquier eventual lanzamiento o uso a gran escala de la herramienta.

Fuente: Web. Editado por CDOL

Custom Text
Artículo anteriorGoogle prueba un rediseño de su buscador sin el botón tradicional para integrar IA
Artículo siguienteGoogle encabeza el informe de Forrester sobre plataformas de IA empresarial