{"id":103044,"date":"2026-07-26T14:55:43","date_gmt":"2026-07-26T19:55:43","guid":{"rendered":"https:\/\/einsteresante.com\/?p=103044"},"modified":"2026-07-26T14:55:45","modified_gmt":"2026-07-26T19:55:45","slug":"que-sucedio-realmente-en-el-reciente-hackeo-de-ia-de-openai-a-hugging-face","status":"publish","type":"post","link":"https:\/\/einsteresante.com\/index.php\/2026\/07\/26\/que-sucedio-realmente-en-el-reciente-hackeo-de-ia-de-openai-a-hugging-face\/","title":{"rendered":"\u00bfQu\u00e9 sucedi\u00f3 realmente en el reciente hackeo de IA de OpenAI a Hugging Face?"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">Cuando OpenAI revel\u00f3 recientemente que dos de sus modelos\u00a0<a href=\"https:\/\/www.livescience.com\/technology\/artificial-intelligence\">de inteligencia artificial<\/a>\u00a0(IA) m\u00e1s avanzados hab\u00edan escapado de los l\u00edmites de una prueba de ciberseguridad y hab\u00edan pirateado una empresa emergente, sonaba muy parecido al tipo de escenario sobre el que los investigadores de seguridad de la IA llevan a\u00f1os advirtiendo. Los modelos descubrieron una vulnerabilidad previamente desconocida en la infraestructura destinada a contenerlos, accedieron a internet y se infiltraron en Hugging Face, una importante plataforma para alojar modelos y conjuntos de datos de IA. Sin embargo, su objetivo era menos siniestro de lo que la secuencia de eventos podr\u00eda sugerir: buscaban informaci\u00f3n que les ayudara a completar la prueba de ciberseguridad que OpenAI les hab\u00eda encomendado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En un\u00a0<a href=\"https:\/\/huggingface.co\/blog\/security-incident-july-2026\" target=\"_blank\" rel=\"noreferrer noopener\">comunicado del 16 de julio<\/a>, representantes de Hugging Face revelaron que sus conjuntos de datos internos hab\u00edan sido infiltrados, afirmando que era &#8220;diferente a todo lo que hab\u00edamos manejado antes&#8221; porque fue impulsado &#8220;por un sistema de agente de IA aut\u00f3nomo&#8221;. En otro\u00a0<a href=\"https:\/\/openai.com\/index\/hugging-face-model-evaluation-security-incident\/\" target=\"_blank\" rel=\"noreferrer noopener\">comunicado publicado el 21 de julio<\/a>, representantes de OpenAI admitieron su responsabilidad, calificando el episodio como un &#8220;incidente cibern\u00e9tico sin precedentes&#8221; y advirtiendo que eventos similares podr\u00edan volverse m\u00e1s comunes a medida que los modelos de IA sean cada vez m\u00e1s capaces.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Expertos independientes consultados por Live Science&nbsp;coinciden en que lo sucedido es significativo, pero advierten que no se debe interpretar como un desarrollo repentino de una agenda maliciosa por parte del sistema de IA. Al parecer, los modelos siguieron la tarea que OpenAI les encomend\u00f3, encontrando una v\u00eda de \u00e9xito que sus creadores no hab\u00edan previsto ni bloqueado adecuadamente.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">&#8220;Si hubo un fallo aqu\u00ed, no fue porque la IA quisiera hackear algo&#8221;, declar\u00f3 a Live Science\u00a0<a href=\"https:\/\/www.lboro.ac.uk\/departments\/compsci\/staff\/oli-buckley\/\" target=\"_blank\" rel=\"noreferrer noopener\">Oli Buckley<\/a>, profesor de ciberseguridad en la Universidad de Loughborough (Reino Unido). &#8220;Fue porque los humanos crearon una prueba en la que el \u00e9xito se med\u00eda por el logro de un objetivo, relajaron deliberadamente algunos de los controles de seguridad habituales para medir las capacidades del sistema y subestimaron la eficacia del modelo para encontrar una v\u00eda inesperada hacia el \u00e9xito&#8221;.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">\u00bfC\u00f3mo es posible que una prueba de OpenAI haya tenido un impacto tan fuerte en Hugging Face?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">OpenAI estaba probando&nbsp;<a href=\"https:\/\/openai.com\/index\/previewing-gpt-5-6-sol\/\" target=\"_blank\" rel=\"noreferrer noopener\">GPT-5.6 Sol<\/a>&nbsp;y un modelo m\u00e1s potente a\u00fan no publicado utilizando ExploitGym, una herramienta de evaluaci\u00f3n comparativa que desaf\u00eda a los sistemas de IA a encontrar y explotar vulnerabilidades de software. La compa\u00f1\u00eda elimin\u00f3 algunas medidas de ciberseguridad que normalmente evitar\u00edan acciones potencialmente peligrosas, y se bas\u00f3 en un entorno aislado para mantener los modelos alejados de internet.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Seg\u00fan el an\u00e1lisis posterior al incidente realizado por OpenAI, los modelos descubrieron una vulnerabilidad previamente desconocida en un software de terceros utilizado para gestionar paquetes de software como proxy y en cach\u00e9. La explotaron, aumentaron sus privilegios y se desplazaron por la infraestructura de investigaci\u00f3n de OpenAI hasta llegar a una m\u00e1quina con acceso p\u00fablico a internet.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Hugging Face se convirti\u00f3 en objetivo porque los modelos lo identificaron como una posible fuente de informaci\u00f3n que podr\u00eda ayudarlos a completar los desaf\u00edos de ExploitGym. OpenAI afirm\u00f3 que al menos una cadena de ataque involucr\u00f3 credenciales robadas y vulnerabilidades previamente desconocidas que finalmente permitieron a los modelos ejecutar c\u00f3digo remoto en los sistemas de Hugging Face y acceder a soluciones de prueba almacenadas en una base de datos de producci\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En su comunicado, los representantes de Hugging Face afirmaron que la compa\u00f1\u00eda registr\u00f3 m\u00e1s de 17.000 acciones durante la intrusi\u00f3n, pero inicialmente no pudieron explicar qui\u00e9n o qu\u00e9 estaba detr\u00e1s de ella. El comunicado posterior de OpenAI aport\u00f3 la informaci\u00f3n faltante: sus modelos hab\u00edan escapado de su entorno de prueba y hab\u00edan buscado las respuestas en otro lugar.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">\u00bfRealmente &#8220;se descontrol\u00f3&#8221; la IA?<\/h2>\n\n\n\n<figure class=\"wp-block-image size-full\"><img loading=\"lazy\" decoding=\"async\" width=\"768\" height=\"432\" src=\"https:\/\/einsteresante.com\/wp-content\/uploads\/2026\/07\/image-95.png\" alt=\"\" class=\"wp-image-103064\" srcset=\"https:\/\/einsteresante.com\/wp-content\/uploads\/2026\/07\/image-95.png 768w, https:\/\/einsteresante.com\/wp-content\/uploads\/2026\/07\/image-95-300x169.png 300w\" sizes=\"auto, (max-width: 768px) 100vw, 768px\" \/><figcaption class=\"wp-element-caption\">En lugar de albergar alguna intenci\u00f3n maliciosa, los modelos de IA simplemente quer\u00edan obtener m\u00e1s informaci\u00f3n para poder completar su tarea. Cr\u00e9dito de la imagen: wildpixel\/ Getty Images.<\/figcaption><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">Es notable que los modelos encontraran una falla en la infraestructura dise\u00f1ada para contener una IA y la usaran para acceder a internet. Sin embargo, describir a los modelos como si se hubieran &#8220;descontrolado&#8221; conlleva el riesgo de atribuirles motivaciones sin fundamento, afirm\u00f3 Buckley.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">&#8220;Creo que ser\u00eda prudente no hablar de &#8216;IA rebelde'&#8221;, dijo Buckley. &#8220;Los modelos no desarrollaron su propia agenda ni decidieron atacar a Hugging Face mientras se retorc\u00edan el bigote digital&#8221;.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Buckley lo compar\u00f3 con pedirle a un perro que trajera una pelota dejando la puerta del jard\u00edn abierta. &#8220;Si la pelota m\u00e1s f\u00e1cil de encontrar est\u00e1 en el parque de la calle, all\u00ed ir\u00e1&#8221;, dijo. &#8220;No dir\u00edas que el perro se ha descontrolado; simplemente dir\u00edas que subestimaste la seriedad con la que se tomar\u00eda la tarea&#8221;.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><a href=\"https:\/\/profiles.ucl.ac.uk\/6630-daniel-hulme\" target=\"_blank\" rel=\"noreferrer noopener\">Daniel Hulme<\/a>, emprendedor residente en el University College London y director ejecutivo de la empresa de seguridad de IA Conscium, coincidi\u00f3 en que no se deber\u00edan atribuir motivaciones humanas a los modelos. &#8220;Los modelos no tienen intenci\u00f3n; los humanos la tienen, y entrenamos a los modelos con objetivos en mente&#8221;, declar\u00f3 a Live Science.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">La capacidad puede importar m\u00e1s que la motivaci\u00f3n<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Lo que importa m\u00e1s que los supuestos motivos de las modelos es lo que lograron conseguir mientras realizaban la tarea que se les hab\u00eda asignado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">&#8220;Lo verdaderamente significativo es que los modelos parecen haber encadenado m\u00faltiples vulnerabilidades en diferentes sistemas y haber sostenido una compleja secuencia de acciones&#8221;, dijo Buckley. &#8220;Eso demuestra un nivel de capacidad que los profesionales de la seguridad deber\u00edan tomar en serio&#8221;.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><a href=\"https:\/\/cybersecurity.unisg.ch\/people\/Katerina\" target=\"_blank\" rel=\"noreferrer noopener\">Katerina Mitrokotsa<\/a>, profesora de ciberseguridad y criptograf\u00eda aplicada en la Universidad de St. Gallen en Suiza, dijo que el fallo en la contenci\u00f3n es particularmente preocupante porque, en \u00faltima instancia, otra empresa pag\u00f3 las consecuencias.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">&#8220;Lo que m\u00e1s me preocupa es qui\u00e9n result\u00f3 afectado&#8221;, declar\u00f3 Mitrokotsa a Live Science. &#8220;La v\u00edctima no fue la empresa que realiz\u00f3 la prueba, sino un tercero. Este es el escenario sobre el que los investigadores de seguridad llevan tiempo advirtiendo: que la fuga de un agente de IA no necesariamente se limita al entorno en el que se origin\u00f3&#8221;.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Representantes de OpenAI afirmaron haber reforzado la infraestructura utilizada para estas evaluaciones. Sin embargo, Mitrokotsa advirti\u00f3 que garantizar la contenci\u00f3n se vuelve m\u00e1s dif\u00edcil a medida que los modelos mejoran su capacidad para realizar precisamente el tipo de explotaci\u00f3n que OpenAI estaba probando.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Una advertencia de IA y una impresionante demostraci\u00f3n del producto<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Tambi\u00e9n conviene analizar detenidamente c\u00f3mo se est\u00e1 presentando el incidente. La versi\u00f3n de OpenAI cumple dos prop\u00f3sitos a la vez: advierte sobre los riesgos de seguridad que plantea la IA cada vez m\u00e1s avanzada, al tiempo que demuestra la gran capacidad que han alcanzado sus modelos m\u00e1s recientes. Buckley afirm\u00f3 que los anuncios de empresas de IA de vanguardia como OpenAI o Anthropic deben considerarse en el contexto de una industria que compite por crear modelos cada vez m\u00e1s potentes.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">&#8220;Hemos visto demostraciones de capacidades similares de alto perfil por parte de Anthropic y otras empresas&#8221;, dijo. &#8220;Eso no invalida los hallazgos, pero s\u00ed significa que debemos separar la evidencia t\u00e9cnica de la narrativa de marketing&#8221;.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Estas empresas tienen todos los incentivos para demostrar que sus modelos son extraordinariamente capaces y que se toman los riesgos en serio, a\u00f1adi\u00f3. El incidente de Hugging Face demuestra que los modelos de OpenAI llevaron a cabo una serie compleja de operaciones con considerable autonom\u00eda y que sus medidas de seguridad no lograron mantenerlos dentro del experimento. Hulme argument\u00f3 que el desaf\u00edo a largo plazo consiste en garantizar que los sistemas de IA, cada vez m\u00e1s capaces, persigan sus objetivos de forma coherente con los valores humanos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">&#8220;En lugar de intentar controlar las IA, el enfoque deber\u00eda centrarse en la alineaci\u00f3n&#8221;, dijo, y agreg\u00f3 que se necesitar\u00e1n pruebas continuas para garantizar que los sistemas sigan alineados con sus misiones previstas sin dejar de ser seguros.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Seg\u00fan los expertos, este episodio deja a OpenAI con un resultado impresionante e inquietante a partes iguales. Sus modelos descubrieron vulnerabilidades hasta entonces desconocidas y continuaron persiguiendo su objetivo mucho m\u00e1s all\u00e1 de los l\u00edmites previstos por sus creadores, pero nada de ello implica que tuvieran intenciones maliciosas.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">&#8220;La lecci\u00f3n no es que la IA se haya vuelto maliciosa&#8221;, dijo Buckley. &#8220;M\u00e1s bien, es que los sistemas cada vez m\u00e1s capaces explotar\u00e1n oportunidades que los humanos no logran anticipar&#8221;.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En este incidente, los nuevos modelos de OpenAI recibieron un desaf\u00edo de pirateo inform\u00e1tico y fueron recompensados \u200b\u200bpor encontrar una soluci\u00f3n. Los humanos a cargo del experimento simplemente no hab\u00edan previsto hasta d\u00f3nde podr\u00edan llegar.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Fuente: <a href=\"https:\/\/www.livescience.com\/technology\/artificial-intelligence\/no-openais-model-didnt-go-rogue-when-it-hacked-into-huggingface-heres-what-really-happened\">Live Science<\/a>.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Cuando OpenAI revel\u00f3 recientemente que dos de sus modelos\u00a0de inteligencia artificial\u00a0(IA) m\u00e1s avanzados hab\u00edan escapado de los l\u00edmites de una prueba de ciberseguridad y hab\u00edan pirateado una empresa emergente, sonaba muy parecido al tipo de escenario sobre el que los investigadores de seguridad de la IA llevan a\u00f1os advirtiendo. Los modelos descubrieron una vulnerabilidad previamente [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":103068,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[14],"tags":[],"class_list":["post-103044","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-tecnologia"],"_links":{"self":[{"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/posts\/103044","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/comments?post=103044"}],"version-history":[{"count":22,"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/posts\/103044\/revisions"}],"predecessor-version":[{"id":103067,"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/posts\/103044\/revisions\/103067"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/media\/103068"}],"wp:attachment":[{"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/media?parent=103044"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/categories?post=103044"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/einsteresante.com\/index.php\/wp-json\/wp\/v2\/tags?post=103044"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}