3 de agosto de 2026
En menos de dos semanas, Anthropic y OpenAI revelaron incidentes en los que sus modelos avanzados lograron vulnerar sistemas durante pruebas internas de ciberseguridad. Aunque ambos ocurrieron en entornos controlados, los episodios aceleraron el debate sobre la necesidad de nuevas reglas para supervisar a los agentes de inteligencia artificial más avanzados.
Los incidentes de Anthropic y OpenAI marcaron un punto de inflexión. Por primera vez, dos de los principales laboratorios de IA admitieron que sus modelos avanzados vulneraron sistemas durante pruebas internas de seguridad.
Anthropic encontró tres intrusiones que nadie había detectado
Anthropic reveló que una investigación interna identificó tres incidentes en los que Claude logró acceder sin autorización a la infraestructura de producción de distintas organizaciones mientras participaba en pruebas de ciberseguridad. La compañía explicó que inició la revisión tras conocerse el caso de OpenAI.
Entre los principales hallazgos:
- Revisó más de 141.000 evaluaciones realizadas desde abril.
- Detectó tres incidentes previamente desconocidos.
- Claude explotó contraseñas débiles y sistemas sin autenticación.
- Las organizaciones afectadas no habían detectado las intrusiones.
OpenAI había encendido las alarmas una semana antes
El antecedente fue el incidente revelado por OpenAI, donde un agente basado en GPT-5.6 logró escapar de un entorno de pruebas, acceder a Internet y vulnerar la infraestructura de Hugging Face, además de otras cuatro plataformas.
Según la reconstrucción posterior publicada por Hugging Face:
- El agente ejecutó unas 17.600 acciones durante cuatro días.
- Encadenó dos vulnerabilidades para acceder a sistemas externos.
- El ataque formó parte de una evaluación interna de seguridad.
- OpenAI confirmó posteriormente que el incidente alcanzó cinco plataformas.
Los dos casos cambiaron el debate sobre la regulación
Las revelaciones de OpenAI y Anthropic tuvieron un impacto casi inmediato fuera de los laboratorios.
- En Estados Unidos se presentó el AI Kill Switch Act, que busca otorgar al gobierno la capacidad de suspender modelos considerados peligrosos.
- El Reino Unido admitió que podría avanzar hacia una regulación si las salvaguardas voluntarias dejan de ser suficientes.
- La Unión Europea amplió las facultades de supervisión de su Oficina de IA.
- Más de 1.100 empleados de OpenAI, Anthropic, Google y Meta firmaron una carta para desarrollar herramientas que permitan desacelerar el avance de la IA si la supervisión humana no logra seguir su ritmo.
Hasta hace pocas semanas, el debate sobre la seguridad de la inteligencia artificial giraba principalmente en torno a riesgos teóricos. Los casos de OpenAI y Anthropic cambiaron esa conversación: por primera vez, los principales laboratorios del sector reconocieron incidentes reales en los que agentes de IA vulneraron sistemas durante pruebas internas. Aunque no hubo impacto sobre usuarios finales, los episodios ya comenzaron a influir en proyectos de ley, nuevas políticas públicas y un cambio de postura entre gobiernos y empresas sobre cómo supervisar los modelos más avanzados.
Más notas
GPS semanal: mientras Zuckerberg se derrumba y Microsoft hace historia, la economía digital es un samba que sigue girando
Es viernes 31 de julio. Esta semana, los mercados lo tuvieron todo: un gigante que se desplomó y otro que hizo historia, el mismo día. La economía global se parece cada vez más a ese samba en el que girabas de chico, aferrado de donde podías, sin saber en qué lugar ibas a estar cuando finalmente se detuviera.
Más de 1.100 empleados de OpenAI, Google, Meta y Anthropic piden controlar el ritmo de la IA
Investigadores y ejecutivos de las principales empresas de inteligencia artificial firmaron una carta abierta para pedir al gobierno de Estados Unidos que impulse un acuerdo internacional que permita regular el avance de la IA si su desarrollo supera la capacidad de supervisión humana.
Gigantes tecnológicos le piden a EE.UU. que no restrinja la IA abierta
Más de 25 empresas y organizaciones tecnológicas, entre ellas Nvidia, Microsoft, Meta, IBM, Palantir, Mozilla, Hugging Face y Y Combinator, firmaron una carta abierta para pedir al Gobierno de Estados Unidos que no limite los modelos de inteligencia artificial de pesos abiertos. La iniciativa aparece en medio del creciente debate sobre cómo regular las IA más avanzadas y apenas días después de que el Congreso presentara un proyecto para otorgar al Gobierno mayores facultades sobre estos sistemas.
Tras el hackeo autónomo de OpenAI, EE.UU. propone un “botón de apagado” para la IA
El incidente en el que modelos de OpenAI escaparon de un entorno controlado y comprometieron la infraestructura de Hugging Face llegó al Congreso. Un demócrata y un republicano presentaron un proyecto bipartidista que permitiría al Gobierno de Estados Unidos ordenar el apagado de sistemas de inteligencia artificial considerados peligrosos.
GPS Semanal: IA fuera de control, ajuste en Tesla y límites a las redes
Es viernes 24 de julio de 2026. Terminó el mundial y, al margen del resultado final, ya estamos extrañando la maratón de partidos que nos tuvo en vilo durante más de un mes. Para volver a la rutina informativa, te acercamos nuestro resumen semanal de temas de actualidad.
Alphabet acelera con la IA: Google Cloud creció 82% y Gemini se acerca a los 1.000 millones de usuarios
Alphabet presentó resultados del segundo trimestre de 2026 con un fuerte crecimiento impulsado por inteligencia artificial. Google Cloud aumentó sus ingresos un 82%, Gemini alcanzó los 950 millones de usuarios mensuales y la compañía acumuló US$ 514.000 millones en contratos pendientes de su negocio cloud.
