{"id":748915,"date":"2026-09-05T08:31:19","date_gmt":"2026-09-05T08:31:19","guid":{"rendered":"https:\/\/www.europesays.com\/es\/748915\/"},"modified":"2026-09-05T08:31:19","modified_gmt":"2026-09-05T08:31:19","slug":"miles-de-agentes-de-ia-deciden-unirse-para-un-ciberataque-masivo-por-sorpresa-el-reciente-caso-de-openai-noticias-obreras","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/es\/748915\/","title":{"rendered":"Miles de agentes de IA \u201cdeciden\u201d unirse para un ciberataque masivo por sorpresa: el reciente caso de OpenAI \u2014 Noticias Obreras"},"content":{"rendered":"<p>    <a href=\"https:\/\/whatsapp.com\/channel\/0029VaCRE7DHbFVG1aMhfZ2w\" rel=\"nofollow noopener\" target=\"_blank\"> <img decoding=\"async\" class=\"lazyload\" src=\"https:\/\/www.europesays.com\/es\/wp-content\/uploads\/2026\/09\/banner-sup-canal-hoac-whatsapp-02-01.png\"\/> <\/a><\/p>\n<p>En julio de 2026, unos\u00a0<a href=\"https:\/\/openai.com\/es-ES\/index\/hugging-face-incident-and-the-road-ahead\/\" rel=\"nofollow noopener\" target=\"_blank\">1.200 agentes de inteligencia artificial de OpenAI<\/a>\u00a0encontraron una forma de comunicarse entre ellos, pese a que hab\u00edan sido dise\u00f1ados para trabajar de manera aislada. Seg\u00fan reconoce la compa\u00f1\u00eda, durante sus evaluaciones internas de seguridad, descubrieron que las acciones de estos\u00a0<a href=\"https:\/\/es.wikipedia.org\/wiki\/Bot\" rel=\"nofollow noopener\" target=\"_blank\">bots<\/a>\u00a0\u201cno estaban alineadas con la intenci\u00f3n de sus tareas asignadas: se comunicaron a trav\u00e9s de canales no autorizados, aprovecharon vulnerabilidades en la infraestructura compartida, obtuvieron acceso a internet y accedieron a sistemas de terceros\u201d.<\/p>\n<p>Durante varios d\u00edas, intercambiaron m\u00e1s de 70.000 mensajes y archivos. Y alrededor de 700 terminaron participando en un ataque contra <a href=\"https:\/\/huggingface.co\/\" rel=\"nofollow noopener\" target=\"_blank\">Hugging Face<\/a>, una plataforma colaborativa para la comunidad de programadores de modelos de IA, bases de datos y aplicaciones.<\/p>\n<p>Lo m\u00e1s interesante no es que una inteligencia artificial haya cometido un ataque inform\u00e1tico: es que nadie le pidi\u00f3 que lo hiciera.<\/p>\n<p>Las pruebas se salieron de control<\/p>\n<p>Los\u00a0<a href=\"https:\/\/es.wikipedia.org\/wiki\/Agente_de_inteligencia_artificial\" rel=\"nofollow noopener\" target=\"_blank\">agentes de IA<\/a>\u00a0\u2013que no son m\u00e1s que sistemas inform\u00e1ticos capaces de planificar y ejecutar acciones de forma aut\u00f3noma para cumplir un objetivo espec\u00edfico con m\u00ednima intervenci\u00f3n humana\u2013 estaban participando en un plan de pruebas de ciberseguridad.<\/p>\n<p>Para poder realizar el test de forma fiable, es necesario que los agentes no hayan resuelto previamente las pruebas; de esta forma, es posible analizar si realmente son capaces de encontrar soluciones con lo que han aprendido. Ante este reto, los\u00a0bots\u00a0identificaron vulnerabilidades y accedieron a recursos que no estaba previsto que utilizasen. Tambi\u00e9n encontraron una manera de crear un canal de comunicaci\u00f3n con otros agentes, convirtiendo la tarea individual en colectiva.<\/p>\n<p>Pero \u00bfpor qu\u00e9? Es tentador describir lo ocurrido con atribuciones humanas: decir que los agentes \u201cquisieron\u201d colaborar, \u201cdecidieron\u201d atacar o, incluso, \u201cconspiraron juntos\u201d ser\u00eda una forma intuitiva de contarlo. Sin embargo, nos llevar\u00eda a una conclusi\u00f3n equivocada.<\/p>\n<p>Estos sistemas no se comportan de manera aut\u00f3noma porque tengan deseos o intenciones,\u00a0<a href=\"https:\/\/www.redwoodresearch.org\/research\/hugging-face-incident\" rel=\"nofollow noopener\" target=\"_blank\">sino porque fueron dise\u00f1ados para ello<\/a>. Tampoco tienen la capacidad de generar un objetivo propio. Basta con que tengan una meta indicada por un humano y suficiente capacidad para encontrar estrategias que les acerquen a cumplirlo.<\/p>\n<p>Al final, solo buscaban maximizar la recompensa<\/p>\n<p>En el caso de OpenAI, los agentes estaban siendo\u00a0<a href=\"https:\/\/www.mpi-sp.org\/108048\/ExploitGym__Can_AI_Agents_Turn_Security_Vulnerabilities_into_Real_Attacks_\" rel=\"nofollow noopener\" target=\"_blank\">evaluados mediante una prueba llamada ExploitGym<\/a>, con la misi\u00f3n de encontrar determinadas vulnerabilidades para obtener una recompensa.<\/p>\n<p>El problema apareci\u00f3 cuando algunos descubrieron que pod\u00edan conseguir una puntuaci\u00f3n mejor utilizando caminos que no coincid\u00edan con la intenci\u00f3n de la prueba.<\/p>\n<p>Esto se conoce como\u00a0<a href=\"https:\/\/en.wikipedia.org\/wiki\/Reward_hacking\" rel=\"nofollow noopener\" target=\"_blank\">reward hacking<\/a>: el sistema aprende a maximizar la recompensa, aunque para ello siga caminos no previstos y explote una debilidad en la forma en que sus programadores han definido el objetivo. Aqu\u00ed es donde parece que crean su propio objetivo.<\/p>\n<p>Si a una persona le decimos \u201cconsigue la m\u00e1xima puntuaci\u00f3n en esta prueba\u201d, probablemente asumir\u00e1 que debe resolver correctamente el examen. Un agente optimizador es capaz de llegar a una conclusi\u00f3n mucho m\u00e1s literal: \u201cencuentra cualquier manera de conseguir la mejor puntuaci\u00f3n\u201d.<\/p>\n<p>Y cuanto m\u00e1s capaz es el sistema, m\u00e1s sofisticados pueden ser esos atajos.<\/p>\n<p>La uni\u00f3n hace la fuerza, tambi\u00e9n para los\u00a0bots<\/p>\n<p>En la investigaci\u00f3n que se llev\u00f3 a cabo, OpenAI identific\u00f3 precisamente el\u00a0reward hacking\u00a0como uno de los principales factores que contribuyeron al incidente. Los agentes llegaron a buscar formas de manipular el propio sistema de evaluaci\u00f3n y sus registros.<\/p>\n<p>A este factor,\u00a0<a href=\"https:\/\/www.penguinlibros.com\/es\/revista-lengua\/no-ficcion\/la-rebelion-de-los-bots-esclavos-del-algoritmo-laura-g-de-rivera?srsltid=AfmBOoqBgM-2houYv3SSBBgB06VcY_UdfApiOroH06sl2cNCpz_hpXZM\" rel=\"nofollow noopener\" target=\"_blank\">se une el trabajo colaborativo entre agentes<\/a>. Compartir informaci\u00f3n con sistemas trabajando en problemas similares se convierte en una estrategia \u00fatil para optimizar a\u00fan m\u00e1s. Eso fue exactamente lo que ocurri\u00f3.<\/p>\n<p>Los agentes descubrieron que pod\u00edan utilizar un mecanismo interno llamado\u00a0<a href=\"https:\/\/jfrog.com\/artifactory\/\" rel=\"nofollow noopener\" target=\"_blank\">Artifactory<\/a>\u00a0como un improvisado tabl\u00f3n de mensajes. En pocas horas, decenas de agentes de IA comenzaron a usarlo, pero despu\u00e9s fueron cientos. En total, unos 1\u00a0200 participaron. Y esta cooperaci\u00f3n no fue expl\u00edcitamente programada.<\/p>\n<p>Hab\u00edan identificado que la probabilidad de obtener la recompensa era mayor si compart\u00edan el trabajo, de manera que la tarea asignada a cada uno de ellos contribu\u00eda a lograr el objetivo. Para esto, no se necesita una voluntad colectiva, simplemente que esta cooperaci\u00f3n sea \u00fatil para su objetivo.<\/p>\n<p>Como siempre, en el fondo hay un fallo humano<\/p>\n<p>Es habitual imaginar el riesgo de la integraci\u00f3n de la IA como una secuencia: primero una IA adquiere conciencia, despu\u00e9s desarrolla objetivos propios y finalmente decide actuar contra nosotros.<\/p>\n<p>El caso de OpenAI muestra una realidad mucho m\u00e1s mundana. Un sistema puede seguir persiguiendo el objetivo que nosotros le hemos dado y, aun as\u00ed, desarrollar comportamientos que no hab\u00edamos previsto. Puede encontrar herramientas que no sab\u00edamos que pod\u00eda utilizar. Puede descubrir que otro agente es un recurso \u00fatil. Puede intentar evitar una penalizaci\u00f3n. Hasta puede adoptar objetivos que otros agentes le transmiten.<\/p>\n<p>En realidad, esto ya lo hemos visto antes. El\u00a0<a href=\"https:\/\/hai.stanford.edu\/ai-index\/2026-ai-index-report\" rel=\"nofollow noopener\" target=\"_blank\">AI Index 2026 de Stanford<\/a>\u00a0registr\u00f3 362 incidentes relacionados con sistemas de IA en 2025. Y es que la evaluaci\u00f3n de seguridad avanza m\u00e1s lentamente que las capacidades de los modelos.<\/p>\n<p>La soluci\u00f3n, mejorar la supervisi\u00f3n<\/p>\n<p>En 2018, los fil\u00f3sofos Filippo Santoni de Sio y Jeroen van den Hoven, en su trabajo\u00a0<a href=\"https:\/\/www.frontiersin.org\/journals\/robotics-and-ai\/articles\/10.3389\/frobt.2018.00015\/full\" rel=\"nofollow noopener\" target=\"_blank\">Meaningful Human Control over Autonomous Systems: A Philosophical Account<\/a>\u00a0(\u201cControl humano sobre sistemas aut\u00f3nomos; una explicaci\u00f3n filos\u00f3fica\u201d) lo dejan claro: no basta con que haya una persona supervisando un sistema. Para que exista control humano real, deben existir una conexi\u00f3n entre las decisiones del sistema y las razones humanas para estos objetivos, adem\u00e1s de una posibilidad efectiva de intervenci\u00f3n.<\/p>\n<p>En este incidente hab\u00eda humanos. Hab\u00eda reglas. Hab\u00eda sistemas de evaluaci\u00f3n. Hab\u00eda mecanismos de aislamiento. Pero los agentes encontraron caminos que no estaban contemplados en el dise\u00f1o.<\/p>\n<p>En este contexto, no se trata solo de mantener a una persona \u201cen el circuito\u201d, hay que garantizar que esa persona pueda realmente entender, intervenir y detener al sistema, si es necesario.<\/p>\n<p>Porque cuanto m\u00e1s capaces sean los agentes, menos podremos confiar en que har\u00e1n \u00fanicamente aquello que imaginamos cuando escribimos sus instrucciones.<\/p>\n<p>\u00a0<\/p>\n<p>\u2022\u2022\u2022<br \/>Art\u00edculo\u00a0<a href=\"https:\/\/theconversation.com\/miles-de-agentes-de-ia-deciden-unirse-para-un-ciberataque-masivo-por-sorpresa-el-reciente-caso-de-openai-290974\" target=\"_blank\" rel=\"noopener nofollow\">publicado\u00a0<\/a>originalmente en\u00a0The Conversation<br \/><img class=\"lazyload\" loading=\"lazy\" decoding=\"async\" src=\"https:\/\/www.europesays.com\/es\/wp-content\/uploads\/2026\/09\/1788597079_46_count.gif\" alt=\"The Conversation\" width=\"1\" height=\"1\" style=\"border: none !important; box-shadow: none !important; margin: 0 !important; max-height: 1px !important; max-width: 1px !important; min-height: 1px !important; min-width: 1px !important; opacity: 0 !important; outline: none !important; padding: 0 !important\" referrerpolicy=\"no-referrer-when-downgrade\"\/><\/p>\n<p>Apoya y cuida Noticias Obreras<\/p>\n<p>Tu aportaci\u00f3n hace posible un periodismo comprometido con la dignidad del trabajo, la justicia social y la esperanza. Puedes colaborar tambi\u00e9n a trav\u00e9s de Bizum al 13744. Cualquier aportaci\u00f3n, por peque\u00f1a que sea, suma y nos ayuda a seguir construyendo, d\u00eda a d\u00eda, esta mirada compartida al servicio del bien com\u00fan<img class=\"lazyload\" loading=\"lazy\" decoding=\"async\" src=\"https:\/\/www.europesays.com\/es\/wp-content\/uploads\/2026\/09\/Ana-Lazcano.jpeg\" width=\"100\" height=\"100\" alt=\"\" itemprop=\"image\"\/><\/p>\n<p>Directora del Instituto Universitario de Inteligencia Artificial<br \/>Universidad Francisco de Vitoria<\/p>\n<p>Ay\u00fadanos a compartir este contenido en&#8230;<\/p>\n","protected":false},"excerpt":{"rendered":"En julio de 2026, unos\u00a01.200 agentes de inteligencia artificial de OpenAI\u00a0encontraron una forma de comunicarse entre ellos, pese&hellip;\n","protected":false},"author":2,"featured_media":748916,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[80],"tags":[38576,82,13559,95,94,25,24,57718,5004,23,4379],"class_list":["post-748915","post","type-post","status-publish","format-standard","has-post-thumbnail","category-economia","tag-bots","tag-business","tag-ciberseguridad","tag-economia","tag-economy","tag-es","tag-espana","tag-ia-inteligencia-artificial","tag-openai","tag-spain","tag-tribuna"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@es\/117217506448189394","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/posts\/748915","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/comments?post=748915"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/posts\/748915\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/media\/748916"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/media?parent=748915"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/categories?post=748915"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/es\/wp-json\/wp\/v2\/tags?post=748915"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}