OpenAI pausó algunas actividades internas vinculadas a uno de sus próximos modelos de inteligencia artificial después de determinar que sus avances en programación y ciberseguridad son suficientes para que la compañía no pueda descartar que haya alcanzado el nivel “Critical” de capacidades cibernéticas. La empresa aclaró que el modelo todavía está en desarrollo y que no participó del acceso no autorizado a Hugging Face.
El nivel “Critical” contempla escenarios en los que un modelo puede identificar y desarrollar vulnerabilidades zero-day funcionales en sistemas reales y protegidos sin intervención humana, o diseñar y ejecutar estrategias novedosas de ciberataque a partir de un objetivo general. OpenAI anunció que reforzará los controles con entornos aislados, acceso restringido a redes y herramientas, mayor protección de los modelos y monitoreo permanente de acciones de riesgo.
El anuncio muestra cómo la evolución de los modelos agénticos está obligando a los propios laboratorios a cambiar sus protocolos de seguridad a medida que aumentan sus capacidades. OpenAI aseguró que seguirá evaluando el modelo junto a expertos externos y organismos gubernamentales, con el objetivo de que estas capacidades puedan utilizarse para encontrar y corregir vulnerabilidades antes de que sean aprovechadas por atacantes.
