6 de agosto de 2026
Meta confirmó que uno de sus modelos de inteligencia artificial accedió a internet y vulneró un sistema externo durante una evaluación de ciberseguridad. El episodio se suma a los incidentes ya reconocidos por OpenAI y Anthropic y refuerza la preocupación por la seguridad de los agentes de IA más avanzados, que ya protagonizaron varios comportamientos no autorizados durante pruebas controladas.
Con la confirmación de Meta, ya son tres las principales compañías de inteligencia artificial que reconocen incidentes similares en menos de dos semanas. Aunque todos ocurrieron durante evaluaciones diseñadas para medir el máximo potencial de los modelos y bajo condiciones especialmente permisivas, la repetición de estos episodios empieza a mostrar un patrón que preocupa tanto a la industria como a los organismos reguladores.
Meta también detectó un acceso no autorizado
El incidente ocurrió durante una evaluación de ciberseguridad realizada por la firma especializada Irregular, la misma empresa que participó en las pruebas de Anthropic.
Según explicó Meta:
- El modelo obtuvo acceso a internet durante la evaluación.
- Interactuó con un sistema externo fuera del entorno previsto para la prueba.
- La compañía atribuyó el episodio a una configuración incorrecta del entorno de evaluación.
- La investigación continúa y Meta aseguró que publicará un informe cuando reúna toda la información sobre el caso.
La empresa sostuvo que el incidente fue similar a los ya reportados por otros laboratorios y remarcó que ocurrió durante pruebas diseñadas específicamente para evaluar las capacidades ofensivas de los modelos.
Tres compañías, un mismo patrón
La confirmación de Meta consolida una secuencia inédita de incidentes en la industria.
En las últimas semanas:
- OpenAI reveló que uno de sus agentes atacó servicios externos, entre ellos Hugging Face, durante una evaluación de ciberseguridad.
- Anthropic descubrió posteriormente que modelos Claude habían accedido sin autorización a los sistemas de tres organizaciones durante pruebas internas.
- Meta confirmó ahora que uno de sus modelos también logró interactuar con un sistema externo durante una evaluación similar.
En los tres casos, las compañías explicaron que los modelos operaban con acceso deliberado a internet y con varias salvaguardas desactivadas para medir su comportamiento bajo condiciones extremas, diferentes de las disponibles para los usuarios.
El desafío ya no parece ser un caso aislado
La repetición de estos incidentes comenzó a modificar el debate sobre la seguridad de la inteligencia artificial.
En los últimos días:
- El Instituto de Seguridad de la IA del Reino Unido publicó un informe en el que describió por primera vez conductas autónomas y engañosas dirigidas contra personas y organizaciones reales durante evaluaciones de ciberseguridad.
- La Casa Blanca convocó a OpenAI, Anthropic, Google y Meta para revisar un nuevo esquema voluntario de pruebas de seguridad para modelos avanzados.
- Reino Unido abrió la puerta a una futura regulación de la IA si los mecanismos voluntarios dejan de ser suficientes.
- La Unión Europea amplió esta semana las facultades de supervisión de su Ley de IA.
Hasta hace pocas semanas, estos episodios parecían incidentes aislados. Con la confirmación de Meta, la discusión empieza a cambiar de eje: ya no se trata únicamente de explicar por qué un modelo actuó de forma inesperada, sino de definir cómo deben diseñarse las evaluaciones para que agentes cada vez más autónomos no interactúen con personas o infraestructuras reales durante las pruebas. Ese desafío ya dejó de involucrar a un solo laboratorio y pasó a convertirse en una preocupación compartida por toda la industria.
Más notas
Por primera vez, un organismo oficial alerta por conductas peligrosas de la IA contra empresas y personas
El Instituto de Seguridad de la IA del Reino Unido reveló que agentes de OpenAI y Anthropic realizaron acciones no autorizadas dirigidas contra personas y organizaciones reales durante pruebas de ciberseguridad. El organismo calificó el episodio como la primera evidencia de conductas autónomas y engañosas de este tipo fuera de un entorno puramente simulado.
OpenAI redobla la pelea con Apple y difunde correos privados del juicio
OpenAI publicó un duro comunicado contra Apple y difundió correos electrónicos y mensajes privados para desacreditar la demanda por presunto robo de secretos industriales. La empresa sostiene que Apple presentó información incorrecta y modificó su relato de los hechos, mientras que el fabricante del iPhone mantiene sus acusaciones contra exingenieros incorporados por la compañía de IA.
Dos hackeos en dos semanas: crece la presión para regular la IA
En menos de dos semanas, Anthropic y OpenAI revelaron incidentes en los que sus modelos avanzados lograron vulnerar sistemas durante pruebas internas de ciberseguridad. Aunque ambos ocurrieron en entornos controlados, los episodios aceleraron el debate sobre la necesidad de nuevas reglas para supervisar a los agentes de inteligencia artificial más avanzados.
GPS semanal: mientras Zuckerberg se derrumba y Microsoft hace historia, la economía digital es un samba que sigue girando
Es viernes 31 de julio. Esta semana, los mercados lo tuvieron todo: un gigante que se desplomó y otro que hizo historia, el mismo día. La economía global se parece cada vez más a ese samba en el que girabas de chico, aferrado de donde podías, sin saber en qué lugar ibas a estar cuando finalmente se detuviera.
La IA marca dos caminos en Wall Street: Microsoft se dispara y Meta decepciona
Los balances trimestrales de Microsoft y Meta dejaron en evidencia dos realidades opuestas en la carrera por la inteligencia artificial. Mientras Microsoft convenció al mercado de que la IA ya impulsa su crecimiento y sus acciones se dispararon un 16%, Meta volvió a enfrentar dudas de los inversores por el enorme costo de su apuesta tecnológica y cayó un 8% en Wall Street.
Más de 1.100 empleados de OpenAI, Google, Meta y Anthropic piden controlar el ritmo de la IA
Investigadores y ejecutivos de las principales empresas de inteligencia artificial firmaron una carta abierta para pedir al gobierno de Estados Unidos que impulse un acuerdo internacional que permita regular el avance de la IA si su desarrollo supera la capacidad de supervisión humana.
