OpenAI, Microsoft, Anthropic y otras 100 compañías han firmado una carta advirtiendo sobre los riesgos de la IA en la ciberseguridad. Titulada "Un llamado a la acción colectiva en materia de ciberdefensa", diferentes compañías de sectores tecnológicos y financieros alertaron sobre un aumento en la sofisticación de los hackeos impulsados por IA. La misiva pide cambiar las reglas de defensa para evitar una catástrofe mayor a futuro.

En una publicación de su blog, OpenAI compartió una carta firmada por empresas como Google, Microsoft, Anthropic, AWS, Cisco, Cloudflare y CrowdStrike. El texto señala que la infraestructura crítica, como hospitales, plantas de tratamiento de agua y redes eléctricas, corre peligro inmediato. Muchos de ellos todavía dependen de software desactualizado y mecanismos de autenticación débiles, algo que abriría la puerta a un ciberataque impulsado por IA.

Hace unos días, un grupo ligado al gobierno de Irán lanzó un ataque contra una pequeña planta de energía del Reino Unido. Según el diario The Telegraph, la planta estuvo fuera de servicio durante cuatro días, convirtiéndose en el primer ataque disruptivo a infraestructura crítica de ese país. Aunque el gobierno británico confirmó el hackeo, los oficiales añadieron que este incidente nunca representó un riesgo para el sistema energético nacional.

Un ataque similar ocurrió a finales de julio, cuando otro grupo de hackers ligado a Irán atacó más de 30 plantas de agua en Estados Unidos. Una agencia estatal confirmó que los ataques ocurrieron el 26 y 27 de julio y se pidió a los ciudadanos que redujeran el consumo de agua potable a lo esencial.

Claude Mythos

¿Qué proponen OpenAI y otras empresas tecnológicas para impedir los hackeos con IA?

La carta de OpenAI y sus socios advierte que mantener el nivel de seguridad actual ya no será suficiente para hacer frente a modelos de IA más capaces. Las empresas proponen tres principios centrales para organizar la respuesta a una posible amenaza.

Primero, es necesario reconocer que la seguridad tradicional está rebasada frente a la IA. Una vez aceptado, el siguiente paso es dotar a los equipos defensivos de herramientas de IA especializadas para detectar vulnerabilidades antes que los atacantes. Por último, la carta propone construir una respuesta colectiva que involucre a empresas, instituciones financieras y gobiernos de todo el mundo.

Para que estas ideas se puedan materializar, la carta le solicita a los gobiernos que establezcan programas de acceso confiable a nivel local, nacional e internacional. Bajo esta dinámica, las empresas verificadas podrán probar modelos de IA avanzados con fines defensivos antes de que se lancen a todo el público. Al mismo tiempo, la misiva pide a las compañías de IA que desarrollen mejores herramientas para supervisar a los agentes autónomos.

Hackeo IA
Credit: Chris Yang / Unsplash

La advertencia llega a unas semanas de que un agente se saliera de control y hackeara a Hugging Face. OpenAI confirmó que un agente de un modelo avanzado escapó de su entorno seguro y vulneró los sistemas de seguridad de la startup. Este incidente fue clave para que la compañía retrasara el desarrollo de su modelo Astra hasta confirmar que puede utilizarse de forma segura.

Otros episodios similares han ocurrido con modelos de Anthropic y Meta, por lo que las reacciones a esta carta no son del todo favorables. Según Android Headlines, varios analistas señalaron que existe una contradicción entre el mensaje de alerta y el comportamiento de sus firmantes. Resulta poco congruente alertar sobre un posible ciberataque impulsado por IA cuando empresas como OpenAI o Anthropic lanzan modelos más potentes sin controles completamente probados.