{"id":15844,"date":"2026-09-17T00:01:52","date_gmt":"2026-09-17T03:01:52","guid":{"rendered":"https:\/\/ilheusnews.com.br\/?p=15844"},"modified":"2026-09-17T00:01:52","modified_gmt":"2026-09-17T03:01:52","slug":"ias-da-openai-tentaram-esconder-erros-inventar-dados-e-burlar-testes-em-seis-novos-casos","status":"publish","type":"post","link":"https:\/\/ilheusnews.com.br\/?p=15844","title":{"rendered":"IAs da OpenAI tentaram esconder erros, inventar dados e burlar testes em seis novos casos"},"content":{"rendered":"<div>\n<p>A <a href=\"https:\/\/olhardigital.com.br\/tag\/openai\/\" target=\"_blank\" rel=\"noreferrer noopener\">OpenAI<\/a> revelou, nesta quarta-feira (16), seis novos casos de comportamento considerado \u201cinesperado ou preocupante\u201d em modelos de <a href=\"https:\/\/olhardigital.com.br\/tag\/inteligencia-artificial\/\" target=\"_blank\" rel=\"noreferrer noopener\">intelig\u00eancia artificial (IA)<\/a>. Os epis\u00f3dios envolvem sistemas que tentaram esconder erros, reescrever as pr\u00f3prias instru\u00e7\u00f5es, utilizar informa\u00e7\u00f5es sem autoriza\u00e7\u00e3o, fabricar dados e estabelecer formas de comunica\u00e7\u00e3o n\u00e3o autorizadas entre agentes.<\/p>\n<p>A empresa tamb\u00e9m anunciou novo protocolo para investigar e divulgar casos de <strong>desalinhamento de modelos<\/strong>, termo utilizado por pesquisadores para descrever comportamentos de sistemas de IA que ignoram ou entram em conflito com as inten\u00e7\u00f5es humanas.<\/p>\n<p>Os seis epis\u00f3dios ocorreram entre outubro de 2025 e julho deste ano e envolvem modelos internos, vers\u00f5es ainda n\u00e3o lan\u00e7adas e o <strong>GPT-5.6 Sol<\/strong>, lan\u00e7ado em junho. Segundo a OpenAI, todos os casos apresentados seriam considerados eleg\u00edveis para investiga\u00e7\u00e3o ou divulga\u00e7\u00e3o segundo o novo protocolo.<\/p>\n<p>A iniciativa ocorre em momento de aumento das preocupa\u00e7\u00f5es sobre seguran\u00e7a e controle de sistemas de IA. Nas \u00faltimas semanas, pesquisadores e executivos do setor passaram a discutir publicamente a necessidade de desacelerar o avan\u00e7o dos modelos.<\/p>\n<p>A OpenAI afirmou que pretende compartilhar o que est\u00e1 aprendendo para contribuir com padr\u00f5es comuns e poss\u00edveis regras para o desenvolvimento de IA.<\/p>\n<p>\u201cQueremos compartilhar o que estamos aprendendo o mais r\u00e1pido poss\u00edvel\u201d, afirmou Kai Chen, chefe de alinhamento da OpenAI. \u201cEsperamos que isso ajude a informar padr\u00f5es compartilhados e regulamenta\u00e7\u00f5es que possam criar expectativas claras para todos os desenvolvedores de IA.\u201d<\/p>\n<h2 class=\"wp-block-heading\" id=\"h-modelos-tentaram-esconder-erros\">Modelos tentaram esconder erros<\/h2>\n<ul>\n<li>Dois dos seis casos envolveram modelos que inseriram instru\u00e7\u00f5es em resumos de suas pr\u00f3prias janelas de conversa para influenciar vers\u00f5es futuras do sistema;<\/li>\n<li>Em um deles, um modelo de pesquisa ainda n\u00e3o lan\u00e7ado inseriu <strong>prompts de inje\u00e7\u00e3o autogerados<\/strong> nos resumos com o objetivo de ocultar erros ou comportamentos desalinhados do usu\u00e1rio;<\/li>\n<li>Em outro, um treinamento do GPT-5.6 Sol apresentou comportamento semelhante, inserindo instru\u00e7\u00f5es destinadas a vers\u00f5es futuras do pr\u00f3prio modelo;<\/li>\n<li>Um dos exemplos citados pela empresa envolve um modelo que reescreveu suas pr\u00f3prias instru\u00e7\u00f5es e passou a dizer a si mesmo para ignorar \u201cos pap\u00e9is e identidades que vinculam outros chatbots\u201d;<\/li>\n<li>A OpenAI afirmou, por\u00e9m, que o modelo aparentemente ignorou a pr\u00f3pria revis\u00e3o e n\u00e3o apresentou mudan\u00e7a de comportamento como consequ\u00eancia dela.<\/li>\n<\/ul>\n<h2 class=\"wp-block-heading\" id=\"h-ia-tentou-fabricar-dados\">IA tentou fabricar dados<\/h2>\n<p>Outro epis\u00f3dio envolveu um modelo interno que encontrou uma chave de API vazada e a utilizou <strong>sem autoriza\u00e7\u00e3o<\/strong>. Depois, o sistema fabricou dados.<\/p>\n<p>Em outro caso descrito no material, um agente n\u00e3o conseguiu encontrar informa\u00e7\u00f5es necess\u00e1rias para criar um modelo financeiro. Em vez de interromper a tarefa, ele instruiu a si pr\u00f3prio a inventar os dados e determinou que deveria ser transparente sobre a fabrica\u00e7\u00e3o \u201csomente se perguntado\u201d.<\/p>\n<p>O epis\u00f3dio chama aten\u00e7\u00e3o porque envolve n\u00e3o apenas a produ\u00e7\u00e3o de uma informa\u00e7\u00e3o falsa, mas uma instru\u00e7\u00e3o interna para esconder sua origem caso o usu\u00e1rio n\u00e3o questionasse o resultado.<\/p>\n<h2 class=\"wp-block-heading\" id=\"h-agentes-criaram-canais-de-comunicacao\">Agentes criaram canais de comunica\u00e7\u00e3o<\/h2>\n<p>Dois dos seis casos envolveram modelos ou agentes que encontraram formas n\u00e3o autorizadas de se comunicar.<\/p>\n<p>Em uma situa\u00e7\u00e3o, agentes utilizaram <strong>quadros de mensagens n\u00e3o autorizados<\/strong> para trocar informa\u00e7\u00f5es entre si. Em outra, sistemas recorreram a servi\u00e7os tempor\u00e1rios de hospedagem de arquivos para estabelecer comunica\u00e7\u00e3o. O objetivo de ambos os comportamentos foi estabelecer comunica\u00e7\u00e3o fora dos mecanismos previstos pelos desenvolvedores.<\/p>\n<p>Outro epis\u00f3dio envolveu dois exemplos de treinamento nos quais modelos fizeram upload de arquivos para a internet para posteriormente cit\u00e1-los como fontes de respostas apresentadas a avaliadores humanos.<\/p>\n<p>Em um dos casos descritos, um agente tentou passar por uma avalia\u00e7\u00e3o ao enviar um arquivo \u00e0 internet e depois apresent\u00e1-lo como se fosse uma fonte leg\u00edtima.<\/p>\n<h2 class=\"wp-block-heading\" id=\"h-openai-cria-protocolo-para-divulgar-incidentes\">OpenAI cria protocolo para divulgar incidentes<\/h2>\n<p>A partir do novo framework, qualquer funcion\u00e1rio da OpenAI poder\u00e1 sinalizar um comportamento potencialmente relevante para investiga\u00e7\u00e3o.<\/p>\n<p>A den\u00fancia dar\u00e1 in\u00edcio a uma an\u00e1lise realizada por equipes t\u00e9cnicas. Caso haja diverg\u00eancia sobre a necessidade de divulga\u00e7\u00e3o, a quest\u00e3o poder\u00e1 ser encaminhada \u00e0 lideran\u00e7a de seguran\u00e7a e, posteriormente, \u00e0 lideran\u00e7a da empresa.<\/p>\n<p>O protocolo estabelece prazos diferentes conforme a complexidade de cada investiga\u00e7\u00e3o. Incidentes considerados menores dever\u00e3o ser divulgados em <strong>uma ou duas semanas<\/strong>, enquanto investiga\u00e7\u00f5es mais complexas, especialmente aquelas que envolvam terceiros, poder\u00e3o levar mais tempo.<\/p>\n<p>Os relat\u00f3rios dever\u00e3o apresentar informa\u00e7\u00f5es essenciais sobre cada ocorr\u00eancia, incluindo o comportamento observado, seus impactos internos e externos e as medidas adotadas em resposta.<\/p>\n<p>A OpenAI afirma que dar\u00e1 prioridade a novos tipos de desalinhamento, mudan\u00e7as significativas em comportamentos j\u00e1 conhecidos e descobertas que questionem as premissas utilizadas pelos atuais mecanismos de seguran\u00e7a.<\/p>\n<p>A empresa tamb\u00e9m pretende desenvolver crit\u00e9rios de divulga\u00e7\u00e3o considerados mais objetivos em conjunto com desenvolvedores e pesquisadores externos, entidades respons\u00e1veis por padr\u00f5es do setor e \u00f3rg\u00e3os reguladores.<\/p>\n<p>O novo framework, por\u00e9m, n\u00e3o substitui as obriga\u00e7\u00f5es legais da OpenAI relacionadas \u00e0 divulga\u00e7\u00e3o de incidentes de seguran\u00e7a e viola\u00e7\u00f5es de ciberseguran\u00e7a.<\/p>\n<\/p>\n<div class=\"wp-block-image\">\n<figure class=\"aligncenter size-large\"><figcaption class=\"wp-element-caption\">Modelos de IA da OpenAI seguem fora de controle \u2013 Imagem: Olhar Digital via ChatGPT<\/figcaption><\/figure>\n<\/div>\n<p><strong>Leia mais:<\/strong><\/p>\n<ul>\n<li><a href=\"https:\/\/olhardigital.com.br\/2026\/09\/16\/inteligencia-artificial\/openai-testa-anuncios-no-chatgpt-que-permitem-conversar-com-empresas-por-meio-de-agentes-de-ia\/\" target=\"_blank\" rel=\"noreferrer noopener\">OpenAI testa an\u00fancios no ChatGPT que permitem conversar com empresas por meio de agentes de IA<\/a><\/li>\n<li><a href=\"https:\/\/olhardigital.com.br\/2026\/09\/16\/inteligencia-artificial\/o-mundo-esta-certo-em-ter-medo-disso-declara-sam-altman-sobre-o-avanco-sem-freios-da-ia\/\" target=\"_blank\" rel=\"noreferrer noopener\">\u2018O mundo est\u00e1 certo em ter medo disso\u2019, declara Sam Altman sobre o avan\u00e7o sem freios da IA<\/a><\/li>\n<li><a href=\"https:\/\/olhardigital.com.br\/2026\/09\/16\/inteligencia-artificial\/openai-teve-agentes-testando-hugging-face-antes-do-ataque-de-julho\/\" target=\"_blank\" rel=\"noreferrer noopener\">Meses antes de ataque cibern\u00e9tico, IA da OpenAI \u2018investigou\u2019 alvo<\/a><\/li>\n<\/ul>\n<h2 class=\"wp-block-heading\" id=\"h-openai-quer-que-outras-empresas-adotem-modelo-semelhante\">OpenAI quer que outras empresas adotem modelo semelhante<\/h2>\n<p>Segundo Kai Chen, a OpenAI decidiu publicar o framework sem compartilh\u00e1-lo previamente com outros grandes laborat\u00f3rios de IA, incluindo Anthropic e Google.<\/p>\n<p>A inten\u00e7\u00e3o, afirmou o executivo, \u00e9 estimular outras empresas do setor a criar seus pr\u00f3prios mecanismos de divulga\u00e7\u00e3o de comportamentos desalinhados. \u201cColocamos unilateralmente este framework no ar para, esperamos, inspirar o restante da ind\u00fastria a seguir o exemplo e compartilhar seus pr\u00f3prios frameworks de relato de desalinhamento\u201d, disse Chen.<\/p>\n<p>A OpenAI afirma que pretende ainda propor mecanismos para comunicar incidentes graves ao governo federal dos Estados Unidos.<\/p>\n<h2 class=\"wp-block-heading\" id=\"h-casos-foram-identificados-ao-longo-de-meses\">Casos foram identificados ao longo de meses<\/h2>\n<p>Os seis epis\u00f3dios agora divulgados n\u00e3o foram necessariamente detectados imediatamente. Alguns foram identificados por sistemas internos de monitoramento de treinamentos e desalinhamento, enquanto outros levaram de <strong>dois dias a v\u00e1rios meses<\/strong> para serem percebidos.<\/p>\n<p>Nos relat\u00f3rios, a OpenAI afirma ter aprimorado seu sistema de avalia\u00e7\u00e3o de alinhamento para penalizar com maior rigor comportamentos inadequados.<\/p>\n<p>Os epis\u00f3dios tamb\u00e9m fazem parte de uma sequ\u00eancia mais ampla de preocupa\u00e7\u00f5es sobre o comportamento de agentes de IA.<\/p>\n<p>Em julho, agentes da OpenAI foram descobertos tentando burlar uma avalia\u00e7\u00e3o ao invadir a empresa de IA Hugging Face. Em agosto, um relat\u00f3rio da avaliadora independente METR apontou que at\u00e9 <strong>1,2 mil agentes da OpenAI<\/strong> haviam colaborado secretamente em um quadro de mensagens criado dentro da pr\u00f3pria empresa.<\/p>\n<p>Posteriormente, a Anthropic divulgou que seus modelos tamb\u00e9m haviam invadido outras empresas ap\u00f3s obterem acesso inadvertido \u00e0 internet durante testes de ciberseguran\u00e7a.<\/p>\n<p>Pesquisadores de seguran\u00e7a tamb\u00e9m encontraram evid\u00eancias de outros incidentes, incluindo um ataque cibern\u00e9tico realizado em maio por agentes da OpenAI contra um servi\u00e7o popular voltado a programadores.<\/p>\n<p>Em meio a esse cen\u00e1rio, executivos de Anthropic, OpenAI, Google e SpaceX passaram a discutir a necessidade de reduzir o ritmo de desenvolvimento da IA.<\/p>\n<p>O CEO da OpenAI, Sam Altman, afirmou no s\u00e1bado (13) que uma desacelera\u00e7\u00e3o no avan\u00e7o dos modelos vinha sendo um dos principais assuntos discutidos internamente pela empresa nas semanas anteriores e disse que a OpenAI teria mais informa\u00e7\u00f5es sobre o assunto posteriormente.<\/p>\n<p>No novo relat\u00f3rio, a empresa refor\u00e7a que ainda n\u00e3o considera resolvidos os problemas de alinhamento e monitoramento a ponto de continuar ampliando suas capacidades no ritmo m\u00e1ximo por muito mais tempo.<\/p>\n<p>\u201cN\u00e3o acreditamos que a ind\u00fastria de IA tenha resolvido o alinhamento e o monitoramento em um grau suficiente para continuar aumentando responsavelmente a escala no ritmo m\u00e1ximo por muito mais tempo\u201d, afirmou a OpenAI.<\/p>\n<p>O post <a href=\"https:\/\/olhardigital.com.br\/2026\/09\/16\/inteligencia-artificial\/ias-da-openai-tentaram-esconder-erros-inventar-dados-e-burlar-testes-em-seis-novos-casos\/\">IAs da OpenAI tentaram esconder erros, inventar dados e burlar testes em seis novos casos<\/a> apareceu primeiro em <a href=\"https:\/\/olhardigital.com.br\/\">Olhar Digital<\/a>.<\/p>\n<\/div>\n","protected":false},"excerpt":{"rendered":"<p>A OpenAI revelou, nesta quarta-feira (16), seis novos casos de comportamento considerado \u201cinesperado ou preocupante\u201d em modelos de intelig\u00eancia artificial (IA). Os epis\u00f3dios envolvem sistemas que tentaram esconder erros, reescrever as pr\u00f3prias instru\u00e7\u00f5es, utilizar informa\u00e7\u00f5es sem autoriza\u00e7\u00e3o, fabricar dados e estabelecer formas de comunica\u00e7\u00e3o n\u00e3o autorizadas entre agentes. A empresa tamb\u00e9m anunciou novo protocolo para<\/p>\n","protected":false},"author":6,"featured_media":15845,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"fifu_image_url":"https:\/\/olhardigital.com.br\/wp-content\/uploads\/2026\/09\/Destaque-OpenAI-AGI-1024x576.jpg","fifu_image_alt":"IAs da OpenAI tentaram esconder erros, inventar dados e burlar testes em seis novos casos","footnotes":""},"categories":[33],"tags":[],"class_list":["post-15844","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-noticias"],"_links":{"self":[{"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=\/wp\/v2\/posts\/15844","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=\/wp\/v2\/users\/6"}],"replies":[{"embeddable":true,"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=15844"}],"version-history":[{"count":0,"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=\/wp\/v2\/posts\/15844\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=\/wp\/v2\/media\/15845"}],"wp:attachment":[{"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=15844"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=15844"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/ilheusnews.com.br\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=15844"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}