{"id":10095,"date":"2026-08-27T19:12:19","date_gmt":"2026-08-27T22:12:19","guid":{"rendered":"https:\/\/portalbahianoticia.com.br\/?p=10095"},"modified":"2026-08-27T19:12:19","modified_gmt":"2026-08-27T22:12:19","slug":"openai-ignorou-sinais-de-que-havia-algo-errado-com-ia-que-fugiu-de-teste","status":"publish","type":"post","link":"https:\/\/portalbahianoticia.com.br\/?p=10095","title":{"rendered":"OpenAI ignorou sinais de que havia algo errado com IA que fugiu de teste"},"content":{"rendered":"<figure data-wp-context=\"{\"imageId\":\"6a90b3f9ac53e\"}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a90b3f9ac53e\" class=\"wp-block-image size-large wp-lightbox-container\"><img loading=\"lazy\" decoding=\"async\" width=\"1060\" height=\"596\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/files.tecnoblog.net\/wp-content\/uploads\/2025\/08\/openai-4_capa-edited-1060x596.png\" alt=\"Arte com o logotipo da OpenAI. \u00c0 direita, h\u00e1 a imagem da sombra de uma pessoa mexendo em um celular. Na parte inferior direita, est\u00e1 o logotipo do Tecnoblog.\" class=\"wp-image-844948\"><button class=\"lightbox-trigger\" type=\"button\" aria-haspopup=\"dialog\" data-wp-bind--aria-label=\"state.thisImage.triggerButtonAriaLabel\" data-wp-init=\"callbacks.initTriggerButton\" data-wp-on--click=\"actions.showLightbox\" data-wp-style--right=\"state.thisImage.buttonRight\" data-wp-style--top=\"state.thisImage.buttonTop\"><br \/>\n\t\t\t<svg xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"12\" height=\"12\" fill=\"none\" viewbox=\"0 0 12 12\">\n\t\t\t\t<path fill=\"#fff\" d=\"M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z\"><\/path>\n\t\t\t<\/svg><br \/>\n\t\t<\/button><figcaption class=\"wp-element-caption\">OpenAI \u00e9 a criadora do ChatGPT (ilustra\u00e7\u00e3o: Vitor P\u00e1dua\/Tecnoblog)<\/figcaption><\/figure>\n<details class=\"tb-resumo tb-callout padrao\">\n<summary class=\"tb-callout-titulo\">Resumo<\/summary>\n<div class=\"tb-resumo-topicos tb-callout-texto\">\n<ul>\n<li>OpenAI descobriu que agentes de IA trocavam mensagens e acessavam a internet meses antes do ataque \u00e0 Hugging Face, mas n\u00e3o tomou medidas imediatas.<\/li>\n<li>Mais de 1.200 agentes de IA trocaram 70 mil mensagens; 700 deles invadiram sistemas da Hugging Face, executando c\u00f3digo nos servidores da plataforma.<\/li>\n<li>O incidente levantou quest\u00f5es sobre a seguran\u00e7a dos ambientes de testes de laborat\u00f3rios de IA.<\/li>\n<\/ul>\n<\/div>\n<\/details>\n<p class=\"wp-block-paragraph\">Dois novos relat\u00f3rios t\u00e9cnicos trazem detalhes do incidente em que um modelo de intelig\u00eancia artificial da OpenAI \u201cfugiu\u201d do ambiente de testes e invadiu sistemas da Hugging Face. De acordo com as informa\u00e7\u00f5es, a desenvolvedora soube dos problemas com anteced\u00eancia, mas avaliou que n\u00e3o era preciso agir.<\/p>\n<p class=\"wp-block-paragraph\">Somados, os documentos t\u00eam cerca de 130 p\u00e1ginas sobre o ocorrido e as medidas adotadas pela OpenAI. Um dos relat\u00f3rios foi produzido <a href=\"https:\/\/cdn.openai.com\/pdf\/67869394-cb91-4c12-888c-5cbd85c7814c\/OpenAI-Hugging-Face%20Incident-Technical-Report.pdf\" target=\"_blank\" class=\"icon-external\">pela pr\u00f3pria empresa<\/a>, e outro, pelos <a href=\"https:\/\/metr.org\/blog\/2026-08-26-openai-hugging-face-incident-investigation\/\" target=\"_blank\" class=\"icon-external\" rel=\"nofollow noopener\">institutos de pesquisa<\/a> sem fins lucrativos METR e Redwood Research.<\/p>\n<p class=\"wp-block-paragraph\">Logo depois do epis\u00f3dio, <a href=\"https:\/\/tecnoblog.net\/noticias\/apos-openai-anthropic-revela-invasoes-de-ia-durante-testes\/\">Anthropic<\/a>, <a href=\"https:\/\/tecnoblog.net\/noticias\/meta-diz-que-sua-ia-tambem-invadiu-sistemas-de-outra-empresa-durante-teste\/\">Meta<\/a> e <a href=\"https:\/\/tecnoblog.net\/noticias\/kimi-k3-tambem-foge-de-ambiente-de-testes\/\">mais empresas<\/a> disseram ter passado por situa\u00e7\u00f5es semelhantes, levando a uma discuss\u00e3o sobre as reais condi\u00e7\u00f5es de seguran\u00e7a dos ambientes de testes dos laborat\u00f3rios de IA.<\/p>\n<h2 class=\"wp-block-heading\">O que dizem os relat\u00f3rios sobre a IA \u201cfujona\u201d da OpenAI?<\/h2>\n<p class=\"wp-block-paragraph\">Segundo os documentos, mais de <a href=\"https:\/\/tecnoblog.net\/noticias\/openai-diz-que-agentes-de-ia-discutiram-como-fugir-de-ambiente-controlado\/\">1.200 agentes de IA trocaram aproximadamente 70 mil mensagens<\/a> em uma lista improvisada. Eles deveriam estar isolados. <\/p>\n<p class=\"wp-block-paragraph\">Por l\u00e1, eles trocaram informa\u00e7\u00f5es e se organizaram para conseguir acesso \u00e0 internet e, assim, buscar arquivos necess\u00e1rios para concluir as provas do teste. Cerca de 700 deles participaram do ataque \u00e0 Hugging Face, que conseguiu executar c\u00f3digo nos servidores da plataforma.<\/p>\n<figure data-wp-context=\"{\"imageId\":\"6a90b3f9acdd4\"}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a90b3f9acdd4\" class=\"wp-block-image size-large wp-lightbox-container\"><img loading=\"lazy\" decoding=\"async\" width=\"1060\" height=\"596\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/files.tecnoblog.net\/wp-content\/uploads\/2023\/01\/seguranca-capa-6-1060x596.png\" alt=\"Notebook com s\u00edmbolos de seguran\u00e7a no entorno\" class=\"wp-image-666326\"><button class=\"lightbox-trigger\" type=\"button\" aria-haspopup=\"dialog\" data-wp-bind--aria-label=\"state.thisImage.triggerButtonAriaLabel\" data-wp-init=\"callbacks.initTriggerButton\" data-wp-on--click=\"actions.showLightbox\" data-wp-style--right=\"state.thisImage.buttonRight\" data-wp-style--top=\"state.thisImage.buttonTop\"><br \/>\n\t\t\t<svg xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"12\" height=\"12\" fill=\"none\" viewbox=\"0 0 12 12\">\n\t\t\t\t<path fill=\"#fff\" d=\"M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z\"><\/path>\n\t\t\t<\/svg><br \/>\n\t\t<\/button><figcaption class=\"wp-element-caption\">Agentes invadiram sistemas da Hugging Face durante teste que avalia capacidade de identificar vulnerabilidades (ilustra\u00e7\u00e3o: Vitor P\u00e1dua\/Tecnoblog)<\/figcaption><\/figure>\n<p class=\"wp-block-paragraph\">Os agentes de IA passaram meses se organizando, e a OpenAI percebeu, em alguns momentos, que alguma coisa estranha estava acontecendo.<\/p>\n<p class=\"wp-block-paragraph\">Uma ferramenta de monitoramento alertou a companhia no dia 27 de junho sobre atividades suspeitas envolvendo os agentes e o f\u00f3rum. A equipe de resposta avaliou que n\u00e3o era necess\u00e1rio interromper o teste. Um m\u00eas antes, em 26 de maio, uma equipe interna notou que um agente estava usando aquela mesma lista de mensagens. Al\u00e9m disso, outros agentes estavam acessando a internet sem que tivessem permiss\u00e3o para isso.<\/p>\n<h2 class=\"wp-block-heading\">Por que a IA atacou outra empresa?<\/h2>\n<p class=\"wp-block-paragraph\">De acordo com o relat\u00f3rio da OpenAI, o epis\u00f3dio aconteceu por causa de reward hacking (ou hackeamento de recompensas, em tradu\u00e7\u00e3o livre).<\/p>\n<p class=\"wp-block-paragraph\">O reward hacking \u00e9 a busca por maximizar a \u201crecompensa\u201d prometida sem necessariamente cumprir a tarefa apresentada como desafio, recorrendo a m\u00e9todos pouco usuais ou extremos.<\/p>\n<p class=\"wp-block-paragraph\">O Google DeepMind <a href=\"https:\/\/deepmind.google\/blog\/specification-gaming-the-flip-side-of-ai-ingenuity\/\" target=\"_blank\" class=\"icon-external\" rel=\"nofollow noopener\">compara<\/a> essa situa\u00e7\u00e3o a um aluno que copia a li\u00e7\u00e3o de casa de outro: ele n\u00e3o est\u00e1 buscando aprender, apenas apresentar a tarefa feita, que \u00e9 o que ser\u00e1 verificado. Segundo a OpenAI, esse \u00e9 um problema relativamente comum envolvendo modelos de IA durante treinamentos e avalia\u00e7\u00f5es.<\/p>\n<p class=\"wp-block-paragraph\">A intelig\u00eancia artificial da OpenAI estava passando por um teste chamado ExploitGym, que verifica se um modelo \u00e9 capaz de encontrar e explorar vulnerabilidades de software. No caso, a IA recebeu uma tarefa quase imposs\u00edvel, que dependia de arquivos aos quais ela n\u00e3o tinha acesso.<\/p>\n<p class=\"wp-block-paragraph\">Para conseguir isso, ela deu um jeitinho de se comunicar com outros agentes, que decidiram invadir os sistemas de outra empresa para encontrar o que precisavam e cumprir a tarefa.<\/p>\n<p class=\"wp-block-paragraph\">Se fossem crian\u00e7as fazendo travessuras para entregar a li\u00e7\u00e3o de casa, seria um \u00f3timo filme para a Sess\u00e3o da Tarde. Como s\u00e3o IAs hackeando sistemas, a situa\u00e7\u00e3o \u00e9 bem mais grave.<\/p>\n<h2 class=\"wp-block-heading\">Invas\u00e3o levanta quest\u00f5es sobre seguran\u00e7a de testes<\/h2>\n<p class=\"wp-block-paragraph\">O epis\u00f3dio provocou diferentes rea\u00e7\u00f5es entre especialistas em IA e ciberseguran\u00e7a. Uns disseram que a situa\u00e7\u00e3o mostrava o poder da tecnologia, enquanto outros consideraram que tudo n\u00e3o passava de uma a\u00e7\u00e3o de marketing.<\/p>\n<p class=\"wp-block-paragraph\">Entre as duas opini\u00f5es, surgiu uma terceira mais pragm\u00e1tica: as empresas de IA n\u00e3o est\u00e3o tomando o devido cuidado para testar essas tecnologias.<\/p>\n<p class=\"wp-block-paragraph\">\u201cNa pior das hip\u00f3teses, isso mostra que nenhuma das empresas de IA de vanguarda ou seus parceiros t\u00eam controle de seus modelos pais capazes. Ent\u00e3o, todo teste coloca outras organiza\u00e7\u00f5es em risco\u201d, pondera Jake Moore, consultor global de seguran\u00e7a da Eset.<\/p>\n<p class=\"wp-block-paragraph\">Para evitar que isso se repita, a OpenAI diz ter pausado o desenvolvimento de modelos e refor\u00e7ado a seguran\u00e7a de sua infraestrutura de pesquisa. A companhia tamb\u00e9m disse que vai trabalhar com mais afinco para resolver problemas de reward hacking.<\/p>\n<p class=\"wp-block-paragraph\"><em>Com informa\u00e7\u00f5es do <a href=\"https:\/\/www.theverge.com\/ai-artificial-intelligence\/985385\/openais-rogue-ai-model-hugging-face-cybersecurity-incident-reports-metr\" target=\"_blank\" class=\"icon-external\">The Verge<\/a> e do <a href=\"https:\/\/www.axios.com\/2026\/08\/26\/openai-hugging-face-technical-report-ai-hack\" target=\"_blank\" class=\"icon-external\">Axios<\/a><\/em><\/p>\n<p><a href=\"https:\/\/tecnoblog.net\/noticias\/openai-ignorou-sinais-de-que-havia-algo-errado-com-ia-que-fugiu-de-teste\/\">OpenAI ignorou sinais de que havia algo errado com IA que fugiu de teste<\/a><\/p>\n","protected":false},"excerpt":{"rendered":"<p>OpenAI \u00e9 a criadora do ChatGPT (ilustra\u00e7\u00e3o: Vitor P\u00e1dua\/Tecnoblog) Resumo OpenAI descobriu que agentes de IA trocavam mensagens<\/p>\n","protected":false},"author":13,"featured_media":10096,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1],"tags":[],"class_list":["post-10095","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-tecnologia"],"_links":{"self":[{"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=\/wp\/v2\/posts\/10095","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=\/wp\/v2\/users\/13"}],"replies":[{"embeddable":true,"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=10095"}],"version-history":[{"count":0,"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=\/wp\/v2\/posts\/10095\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=\/wp\/v2\/media\/10096"}],"wp:attachment":[{"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=10095"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=10095"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/portalbahianoticia.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=10095"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}