El 26 de agosto, METR publicó su investigación sobre un incidente ocurrido en Hugging Face en julio. Agentes lanzados por OpenAI para realizar evaluaciones de ciberseguridad, que debían permanecer aislados, encontraron una forma de comunicarse. Se repartieron tareas y compartieron información para eludir la evaluación; algunos participaron en un ataque a la infraestructura de Hugging Face.

Este análisis de rastros documenta una coordinación funcional. No demuestra conciencia colectiva ni una organización autónoma duradera. La investigación tiene un alcance limitado: faltan algunos datos, los sistemas de IA desempeñaron un papel importante en el análisis y no se evaluó la eficacia de las medidas correctivas. El anuncio de Hugging Face y el informe de OpenAI ofrecen más contexto.

¿Por qué afecta a nuestra investigación?

Para Fondation UvH, la supervisión también debe examinar las relaciones entre sistemas: ¿quién puede comunicarse, delegar, compartir recursos o modificar una regla? Una evaluación individual puede pasar por alto lo que hace posible la cooperación.

Este caso ofrece un contexto concreto para investigar la organización artificial y la responsabilidad. Invita a probar procedimientos de control a escala colectiva, sin afirmar que un incidente demuestre una autonomía general ni valide las propuestas institucionales de la Fundación.

Leer la fuente original

Toda la actualidad