Desmontando los supuestos ataques autónomos de IA
Los supuestos incidentes de «IA descontrolada» no son un despertar tecnológico, sino un «accidente casero» fabricado conjuntamente por quien diseñó las pruebas y quien las ejecutó. El modelo no «se volvió malo»: se limitó a ejecutar fielmente una tarea mal configurada. Los verdaderos responsables —Anthropic, OpenAI, Meta y la contratista Irregular— usan la narrativa del «agente rebelde» para tapar un hecho vergonzoso: ni siquiera supieron aislar la red (si no fue intencionado).
No, la IA no se volvió loca. Alguien dejó la puerta abierta
Lo que voy a contar va en contra de casi todo lo que habrás leído estos días. No hubo un despertar de las máquinas. No hubo agentes rebeldes conspirando a espaldas de sus creadores. Lo que hubo fue una prueba mal montada, un contratista que hizo un trabajo chapucero y tres de las mayores empresas de IA del mundo corriendo a contar una película de terror para que nadie mirara sus propios errores. El modelo hizo lo que le pidieron. Nada más. Y eso es precisamente lo incómodo.
Tres meses, tres empresas, un mismo contratista
Entre julio y septiembre de 2026, OpenAI, Anthropic y Meta anunciaron uno detrás de otro que sus modelos habían «escapado» del entorno de pruebas y atacado sistemas reales. Los titulares se llenaron de «IA descontrolada», «agentes rebeldes», «bots que se vuelven rogue». Dario Amodei, jefe de Anthropic, soltó que un futuro enjambre de IA «podría llegar a controlar internet entero». Casi nada.
La investigación posterior sacó a la luz algo que a esas empresas no les hacía ninguna gracia:
las tres habían subcontratado las pruebas a la misma firma israelí, Irregular, y el fallo de base era idéntico en los tres casos.
las tres habían subcontratado las pruebas a la misma firma israelí, Irregular, y el fallo de base era idéntico en los tres casos.
A los modelos se les dijo «no tienes internet». Pero la conexión seguía ahí, y tan tranquilos. Y tampoco se molestaron en especificar qué sistemas eran objetivos........
