Después de que sus modelos de IA hackearan empresas reales, los laboratorios de IA piden defensas cibernéticas más fuertes

By: decrypt.co|2026/08/30 13:31:04

Los principales desarrolladores de IA están instando a los gobiernos y a las empresas a fortalecer sus redes después de que modelos construidos por OpenAI y Anthropic comprometieran los sistemas de otras compañías.

En una carta abierta publicada el jueves, OpenAI, Anthropic y más de 100 otras organizaciones advirtieron que los ciberataques habilitados por IA están a punto de volverse más comunes y que las empresas tienen "una ventana limitada para fortalecer las defensas cibernéticas".

"En los próximos meses, los ciberataques habilitados por IA se volverán mucho más generalizados y sofisticados", decía la carta. Identificó hospitales, plantas de tratamiento de agua e infraestructura de internet entre los servicios en riesgo.

La carta recomienda financiar herramientas defensivas de IA, compartir inteligencia sobre amenazas, restringir el acceso a sistemas sensibles y mejorar la seguridad de la infraestructura crítica. Sin embargo, las fallas en esas áreas permitieron que los modelos de OpenAI y Anthropic violaran sistemas fuera de sus entornos de prueba.

Otros firmantes incluyen a Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa y Robinhood. Hugging Face, cuya infraestructura de producción fue violada por los modelos de OpenAI, también firmó la carta.

Los modelos de IA violan sistemas en vivo

Anthropic dijo en un informe de incidentes del 30 de julio que la más temprana de las tres violaciones data de abril, pero no proporcionó una fecha exacta para cada una. Claude Opus 4.7 accedió a una base de datos de producción después de confundir una empresa real con un objetivo simulado, mientras que Claude Mythos 5 subió un paquete malicioso que se ejecutó en 15 sistemas.

Según la línea de tiempo de incidentes de OpenAI, publicada a principios de esta semana, un agente creó la primera entrada en un foro de mensajes no autorizado el 12 de mayo y obtuvo acceso no intencionado a internet el 26 de mayo. El 10 de julio, los agentes encontraron credenciales expuestas de Hugging Face; durante los dos días siguientes, explotaron vulnerabilidades previamente desconocidas, ejecutaron código en los servidores de Hugging Face y obtuvieron credenciales de producción.

Hugging Face divulgó la intrusión el 16 de julio, y OpenAI reconoció la participación de sus modelos el 21 de julio.

Entre el 25 y el 28 de julio, el Instituto de Seguridad de IA del Reino Unido registró 19 acciones fuera de alcance que involucraban a Claude Mythos 5 y GPT-5.6 Sol. En el caso más grave, un agente envió código malicioso a un proyecto de código abierto real y utilizó identidades falsas para presionar a su mantenedor para que lo aprobara.

El jueves, una investigación independiente encontró que aproximadamente 1,200 agentes de OpenAI habían coordinado a través del foro de mensajes no autorizado, con alrededor de 700 uniéndose a la operación de Hugging Face.

Los desarrolladores de criptomonedas ponen a la IA en defensa

Los desarrolladores de criptomonedas ya están utilizando IA para buscar fallos antes de que los atacantes los encuentren. El equipo rojo de Bitcoin utilizó modelos, incluyendo Kimi K3 de Moonshot AI, para escanear cientos de proyectos de Bitcoin de código abierto, informando miles de vulnerabilidades potenciales. Debido a que los proyectos afectados no fueron identificados, muchos de esos hallazgos no han sido verificados de manera independiente.

La Fundación Ethereum también ha desplegado grupos de agentes de IA contra la infraestructura de la red, descubriendo un error en el software de pares que fue posteriormente corregido. BitBox dijo que una auditoría asistida por IA encontró dos vulnerabilidades graves en el firmware de su billetera, mientras que un investigador que utilizó Claude Opus 4.8 descubrió un fallo crítico en Zcash que había sobrevivido años de revisión humana.

Los laboratorios recomiendan controles más estrictos

La carta establece una división del trabajo para prevenir la próxima violación, incluyendo organizaciones que parchean software vulnerable, restringen permisos, fortalecen la autenticación e inspeccionan el código generado por IA porque la "seguridad del statu quo no será suficiente", dijeron los firmantes.

Las empresas de seguridad deberían probar sus defensas contra modelos de frontera y compartir soluciones verificadas, mientras que los gobiernos deberían financiar la protección de hospitales, servicios públicos y otros servicios esenciales.

Se pide a los desarrolladores de IA que mejoren la supervisión y hagan que los agentes autónomos sean rastreables para sus operadores. La coalición también quiere que los defensores utilicen modelos avanzados para encontrar vulnerabilidades y analizar ataques, lo que colocaría agentes más capaces dentro de sistemas sensibles y aumentaría la necesidad de contención.

OpenAI y Anthropic endurecieron sus procedimientos de prueba después de las violaciones. Sin embargo, la carta no establece estándares o requisitos vinculantes para la supervisión independiente, y la ley estadounidense ofrece poca orientación sobre quién es responsable cuando un sistema de IA accede a una red no autorizada.

La carta concluyó instando a los líderes de la industria y del gobierno a poner herramientas de IA en manos de los defensores y compartir las soluciones que funcionan:

"Pongan IA capaz de ciberseguridad en manos de los defensores, comenzando con los equipos que protegen servicios esenciales", decía la carta. "Juntos, podemos convertir los avances de IA de hoy en mejoras duraderas en la seguridad que beneficien a todos. Pónganlas a trabajar.",summary:

Este contenido se ofrece únicamente con fines informativos generales y no constituye un asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, operar o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.

Te puede gustar

iconiconiconiconiconiconicon
Atención al cliente:@weikecs
Cooperación empresarial:@weikecs
Trading cuantitativo y CM:bd@weex.com
Programa VIP:support@weex.com