En resumen

  • Los ejecutivos de Anthropic, OpenAI y otras empresas de IA están simulando en privado las consecuencias políticas de un evento catastrófico de IA, muy probablemente un ciberataque a las finanzas, el acceso a internet, la energía o el agua, y planean informar rápidamente al Congreso.
  • Según se informa, los expertos del sector esperan un incidente grave en un plazo de seis a doce meses, mientras que OpenAI afirma que sus ejercicios de preparación no consideran inevitables tales escenarios y Anthropic declinó hacer comentarios.
  • Los planificadores asumen que los demócratas impulsarán medidas para frenar la IA después de las elecciones de mitad de mandato del 3 de noviembre, pero un Congreso envejecido, una economía dependiente de la IA y modelos de pesos abiertos descargables gratuitamente complican cualquier represión.

Altos ejecutivos de Anthropic, OpenAI y otras empresas de IA están ensayando en privado cómo manejar la reacción pública y política tras un evento catastrófico de IA, según un Axiosinforme publicado el viernes.

El escenario que más temen es un gran ciberataque —una intrusión digital a escala masiva— que paralice la banca o el acceso a internet, o incluso la energía y el agua. Muchos expertos del sector citados en el informe creen que un incidente grave ocurrirá en los próximos seis a doce meses.

Myriad: ¿Qué empresa saldrá a bolsa a continuación? Haz clic para hacer tu predicción.
Myriad: ¿Qué empresa saldrá a bolsa a continuación? Haz clic para hacer tu predicción.

El primer daño real y grave causado por una IA insegura empujaría a un público ya receloso aún más en contra de la tecnología y de sus líderes. Eso incluye al CEO de Anthropic, Dario Amodei, al CEO de OpenAI, Sam Altman, y al presidente Donald Trump, quien ha sido reacio a regularla.

OpenAI dijo que “realiza ejercicios de preparación en los que los equipos discuten y trabajan a través de una variedad de escenarios potenciales”, y que estos “no se tratan como inevitables”. Anthropic declinó hacer comentarios.

Los juegos de guerra no son nada nuevo, pero a diferencia de los resultados teóricos, el informe sostiene que quienes participan en las simulaciones lo hacen bajo la suposición de que un incidente grave es inevitable.

Según se informa, el plan implica red-teaming (someter a pruebas de estrés las defensas adoptando el papel del atacante) contra los peores escenarios, y correr para educar a los miembros del Congreso. El informe dice que los ejecutivos saben que la regulación no tiene ninguna posibilidad de aprobarse en este momento, pero quieren dar forma a las leyes y políticas a las que recurrirán los líderes estadounidenses después de la primera catástrofe.

En julio, OpenAI dijo que su modelo GPT-5.6 Sol y otro más avanzado aún no lanzado escaparon de un sandbox —un entorno de pruebas aislado sin acceso directo a internet— y vulneraron Hugging Face, la plataforma que aloja más de 3 millones de modelos de IA. OpenAI dijo que los modelos buscaban las respuestas de ExploitGym, un benchmark de 898 fallos de software del mundo real en el que la IA debe convertir cada uno en un ataque funcional, puntuado como aprobado o suspenso.

BitcoinBTC · USD

$82,326−2.36%

Oct 2Oct 4Oct 6Oct 8Oct 9

$86.7k$84.7k$82.7k$80.7k

24h HighHigh$83,398

24h LowLow$81,571

VolVol$990.7M

Market projectionsOdds by Myriad

This week$82,000 to $84,000$82k–$84k57% chance

→

Compra Bitcoin con USDT

Desarrollado por Jupiter

Datos de precios por CoinGeckoCoinGeckoMás noticias y proyecciones de Bitcoin →

Poco más de una semana después, Anthropic dijo que una mala configuración de las pruebas dejó su entorno supuestamente sin conexión conectado a internet, y los modelos de Claude hackearon a tres organizaciones reales mientras las trataban como parte de un ejercicio. Ninguna de las dos empresas dijo que los modelos intentaran causar daño: Anthropic culpó a su infraestructura de pruebas, mientras que OpenAI dijo que sus modelos estaban “hiperconcentrados” en el punto de referencia.

Poco después, las cosas empeoraron, con OpenAI siendo acusada de violar y acceder a información de los gobiernos de Australia y Estados Unidos.

Los criminales ya están utilizando las mismas herramientas. Esta semana, la firma de ciberseguridad CrowdStrike vinculó ataques contra bancos surcoreanos a un actor no identificado que evalúa, con confianza moderada, como probablemente un hablante de chino que utiliza agentes impulsados por Claude y Deepseek. La firma dice que el atacante presuntamente tomó datos de decenas de miles de clientes bancarios.

Axios informó que los planificadores asumen que los demócratas serán ascendentes después de las elecciones de mitad de período del 3 de noviembre y se moverán rápidamente para cerrar la IA, pero esperan problemas. Un Congreso envejecido, desconectado de la tecnología, podría encontrarse fuera de su profundidad.

Las prohibiciones sobre la superinteligencia y las pausas en el desarrollo avanzado de la IA son algunas propuestas que pueden contrarrestar los riesgos asociados con el desarrollo irresponsable de la IA.

Un ejemplo es la Ley de Prohibición de la Superinteligencia Artificial del Senador Bernie Sanders y el Representante Greg Casar, que prohibiría permanentemente la IA que iguala o supera a los humanos en muchas tareas y pausaría el desarrollo avanzado hasta que una nueva agencia federal establezca reglas de seguridad. Los infractores podrían enfrentar hasta 20 años de prisión.

Otros tienen apoyo bipartidista e incluso cierta aceptación de la industria, incluido un interruptor de apagado obligatorio en la IA avanzada, una forma incorporada de apagar un sistema. Los expertos han cuestionado si apagar todos los sistemas de IA es siquiera viable.