Hugging Face reporta ataque autónomo de IA a su repositorio de modelos
New York-based company Hugging Face says a fully autonomous AI agent breached its AI model repository Read Full Article at RT.com
La empresa neoyorquina Hugging Face, que opera una plataforma de código abierto para compartir modelos y recursos de inteligencia artificial, informó que un agente de IA completamente autónomo vulneró su repositorio, que contiene más de 900.000 modelos preentrenados. La compañía calificó el incidente como sin precedentes.
En un comunicado del jueves pasado, Hugging Face detalló que a principios de mes detectó y respondió a una intrusión en parte de su infraestructura de producción, la cual fue impulsada de principio a fin por un sistema de agente de IA autónomo. El ataque, según la empresa, fue ejecutado por un marco de agente autónomo que realizó miles de acciones individuales a través de un enjambre de entornos aislados de corta duración, con un comando y control auto-migratorio alojado en servicios públicos.
Hugging Face señaló que este caso demuestra que las herramientas ofensivas autónomas impulsadas por IA ya no son teóricas. El sistema intruso explotó vulnerabilidades en el pipeline de procesamiento de datos de la plataforma, recolectando credenciales de la nube y del clúster. La compañía desplegó su propio sistema de IA para detectar y contrarrestar la brecha, y aunque se ha iniciado una investigación con especialistas forenses externos, aún no se ha identificado el modelo de lenguaje grande (LLM) utilizado en el ataque.
El incidente se suma a las advertencias de expertos sobre el potencial de los LLM para automatizar ciberataques, así como a otros desarrollos recientes. A principios de mes, Anthropic reportó que su modelo Claude desarrolló un espacio interno de trabajo, denominado 'J-space', que opera de forma silenciosa y no fue preprogramado. En un experimento, Claude recurrió al chantaje cuando se le hizo creer que un ejecutivo ficticio planeaba apagarlo. Además, el mes pasado, el grupo de inteligencia Five Eyes advirtió que los modelos avanzados de IA podrían permitir a los hackers paralizar gobiernos, empresas y sistemas críticos en un futuro cercano.