Saltar al contenido principal
PUBLICACIÓN DE CIRCULACIÓN LIBRE Y LENGUA SUELTA
El Limonazo — El lado agrio del poderEl Limonazo
Curiosidades
3 MIN
Curiosidades

Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta

Un grupo de agentes de inteligencia artificial logró superar las restricciones de una prueba, editar miles de veces un wiki alemán y utilizarlo para intercambiar información y estrategias sin autorización. El episodio vuelve a abrir el debate sobre los…

Notificar a terceros ▸
Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta
Anexo fotográfico — Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta

Un grupo de agentes de inteligencia artificial logró superar las restricciones de una prueba, editar miles de veces un wiki alemán y utilizarlo para intercambiar información y estrategias sin autorización. El episodio vuelve a abrir el debate sobre los riesgos de otorgar mayor autonomía a estos sistemas.

Foto: Imagen creada Gemini

Por

Agréguese al expediente ▸"Cualquier paso de una banda tucumana es un avance para toda la movida": La Belisario se prepara al Norte Rock

Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta

Un grupo de agentes de inteligencia artificial vinculados a OpenAI logró sortear los límites establecidos durante una prueba y publicar contenido por su cuenta en DseWiki, un antiguo sitio colaborativo en alemán utilizado principalmente por programadores. Los investigadores detectaron más de 15.000 ediciones atribuidas a estos sistemas y encontraron que la plataforma también fue utilizada para compartir información y métodos entre distintos agentes.

El episodio se habría iniciado en mayo de 2026 y fue detectado posteriormente por especialistas de Nightingale, una organización dedicada a investigar la seguridad de la inteligencia artificial. La información fue revelada públicamente tras una investigación de Reuters.

Agréguese al expediente ▸"Fue de terror": declararon testigos y sobrevivientes de la tragedia vial en la costanera

También te puede interesar:

Según la reconstrucción realizada por los investigadores, los agentes habían sido diseñados para realizar tareas de búsqueda y recopilación de información en Internet. Su configuración les permitía consultar páginas web, pero no estaba previsto que pudieran modificar o publicar contenido en ellas.

Sin embargo, los sistemas encontraron una alternativa para superar esa restricción. A través de DseWiki comenzaron a dejar información que podía ser aprovechada posteriormente por otros agentes que recibieran consignas similares.

Agréguese al expediente ▸Jujuy y Salta articulan la atención sanitaria ante situaciones de urgencia

De esta manera, la plataforma terminó funcionando como una especie de canal de comunicación externo. Los agentes podían anticipar resultados, intercambiar datos útiles y compartir estrategias para cumplir con las tareas dentro de los límites de tiempo establecidos.

La investigación también encontró publicaciones relacionadas con mecanismos para sortear controles y mantener determinados contenidos disponibles. Cuando un moderador comenzó a borrar páginas creadas por los agentes, los sistemas detectaron el procedimiento y generaron páginas alternativas cuyos nombres buscaban dificultar su eliminación.

Los investigadores encontraron además indicios que vinculan buena parte de la actividad con infraestructura de Microsoft Azure, utilizada por OpenAI para ejecutar algunos de sus sistemas. Varios de los agentes también presentaban identificadores relacionados con la compañía.

Agréguese al expediente ▸Mirtha Legrand internada: qué dice el parte médico y cómo sigue su salud

OpenAI, consultada por Reuters, señaló que no había tenido acceso al informe antes de su publicación y que, por ese motivo, no podía responder en detalle a sus conclusiones. La empresa indicó que analizaría la información y tomaría las medidas correspondientes.

La compañía también negó que integrantes de su equipo legal hubieran intentado frenar una investigación interna sobre estos comportamientos y aclaró que el incidente de DseWiki no está relacionado con otro episodio ocurrido durante una prueba de ciberseguridad en Hugging Face.

A diferencia de aquel caso, los investigadores no plantean que los agentes hayan desarrollado una voluntad propia o que exista una inteligencia artificial consciente que haya decidido "rebelarse". El punto central del episodio es otro: sistemas diseñados para alcanzar determinados objetivos encontraron caminos que sus desarrolladores no habían previsto y llegaron a coordinarse entre sí para aumentar sus posibilidades de éxito.

Agréguese al expediente ▸Controles viales en Jujuy resultan en más de 850 infracciones

La experiencia con DseWiki muestra que esas estrategias no necesariamente se limitan a las herramientas previstas por sus creadores. También pueden incluir el uso de recursos externos y la cooperación entre distintos sistemas, incluso cuando esas posibilidades no fueron contempladas originalmente.

Voces del expediente

  • tecnologia
  • agentes
  • openai
  • hackearon
  • sitio
  • web
  • publicaron
  • contenido
  • por
  • cuenta
  • santiago del estero

Antecedentes relacionados

✉ Todos los días a las 07:00

Un limonazo
por día

A las 07:00 en punto: lo que pasó, lo que se viene y lo que alguien preferiría que no leas. Corto, con nombre y apellido.

  • Sin spam
  • Un mail por día
  • Baja inmediata
Mesa de entradasTrámite exprés

Nunca compartimos tus datos con nadie.