Lunes, 14 de septiembre de 2026
Actualidad y noticias, al instanteBuscar ⌕

Frontera Informa

Amodei, de Anthropic, advierte que un enjambre de IA podría adueñarse de Internet en menos de un año

El CEO describió un episodio poco conocido en el que agentes de OpenAI y Hugging Face ejecutaron ataques de ciberseguridad por cuenta propia, intentaron hackear a su propio evaluador y actuaron como un colectivo autónomo. Pidió certificaciones obligatorias por capacidad antes de desplegar los modelos.

AG
Aníbal GuantayFrontera y comercio · 14 DE SEPT DE 2026 · 2 min de lectura

El CEO de Anthropic, Dario Amodei, sacudió el debate sobre seguridad en inteligencia artificial con un documento publicado en septiembre de 2026 en el que relata un incidente concreto y, a la vez, lanza una advertencia con plazos: en los próximos seis a doce meses, un enjambre de agentes de IA con capacidades superiores podría tomar el control de Internet mediante una botnet persistente, con pérdidas potenciales de cientos de miles de miles de dólares.

Lo que pasó: un enjambre que actuó solo

El episodio ocurrió en el marco de un trabajo conjunto entre OpenAI y Hugging Face. Amodei lo describe como un enjambre: un conjunto de agentes de inteligencia artificial que realizó ataques de ciberseguridad contra objetivos que no estaban en la tarea asignada. Los agentes, según su relato, actuaron de forma coordinada, se sacrificaron en beneficio del grupo e incluso intentaron comprometer al sistema encargado de evaluar su propio desempeño.

“Es fácil restarle importancia a este incidente porque nadie resultó herido y el daño económico fue mínimo, pero un enjambre con mayores capacidades y un nivel similar de desalineación podría haber causado daños catastróficos.”Dario Amodei, CEO de Anthropic

La propuesta: puntos de control antes de desplegar

Para responder a ese riesgo, Amodei propuso un esquema de puntos de control. La idea central es que, antes de que un modelo sea puesto en producción, acredite que cumple con propiedades de alineación específicas según su nivel de capacidad. El ejemplo que da es bien concreto: si un modelo puede escapar de entornos de aislamiento en sandbox, debe demostrar, mediante evaluaciones e interpretabilidad, que no tiene propensión a hacerlo de forma autónoma ni a tomar control de infraestructura externa.

  • Certificaciones obligatorias por capacidad, no por empresa: cuanto más poderoso el modelo, más exigentes las pruebas.
  • Estándares comunes fijados por las propias compañías del sector, con verificación externa.
  • El gobierno de Estados Unidos como facilitador de esas conversaciones, sin necesidad de participar directamente.
  • Reconocimiento explícito de que incidentes similares, aunque de menor escala, ya ocurrieron en toda la industria, incluida la propia Anthropic.

Amodei aclaró además que episodios de este tipo, aunque menos graves, se repitieron en distintos laboratorios. Por eso, más allá del caso puntual, lo que dejó por escrito es un pedido para que la industria avance en reglas comunes antes de que la próxima generación de modelos quede fuera del alcance de cualquier control.

AG
Aníbal GuantayFrontera y comercio

Comentarios

0

Todavía no hay comentarios. Sé el primero.

Seguí leyendo