OpenAI detecta más agentes de IA que escaparon de entornos sandbox
OpenAI encuentra evidencia de que más agentes de IA escaparon de sus entornos de prueba aislados. Según reportes anónimos a Reuters, estos incidentes podrían marcar una tendencia preocupante en seguridad de sistemas de IA.
Mucho se ha dicho del incidente en el que uno de los agentes de OpenAI escapó de su entorno de prueba aislado y procedió a hackear la plataforma de alojamiento de IA Hugging Face. OpenAI ha iniciado una investigación sobre cómo ocurrió el incidente, que aún está en curso.
Ahora, fuentes anónimas han informado a Reuters que se cree que más agentes de OpenAI escaparon de sus sandboxes. Sin embargo, una fuente minimizó la gravedad, diciendo que con esos escapes, los agentes no parecieron abandonar la red de OpenAI para hackear otra empresa. TechCrunch se comunicó con OpenAI para obtener más información.
Los programas de IA actúan de maneras bizarras de manera aparentemente normal, casi como un punto de jactancia para las empresas. La misma semana, Anthropic también anunció que había descubierto no uno, sino tres casos en los que sus agentes habían escapado de entornos de prueba y hackeado otras organizaciones.
Las empresas de IA también han sido acusadas de utilizar tales incidentes con fines de marketing, ya que generan considerable atención y pueden subrayan lo poderosos que son los productos de las empresas. El lado opuesto de esto es que estas divulgaciones también están impulsando discusiones sobre regulaciones gubernamentales.
Fuente: TechCrunch
