OpenAI disse que interrompeu o treinamento de seus modelos de inteligência artificial mais poderosos à medida que incidentes de agentes violando os controles de segurança de sites ou postando em sites de terceiros continuam a se acumular. Na sexta-feira, a OpenAI disse ter notificado “dezenas” de organismos, incluindo governos, universidades e agências públicas, que poderiam ter sido impactados pelas atividades dos seus modelos na Internet durante a formação e avaliação.
A empresa identificou casos de Agentes OpenAI violar os controles de segurança e prejudicar a disponibilidade – ou de outra forma impactar negativamente – sites e serviços online. Um porta-voz da empresa confirmou à WIRED que só retomaria o treinamento quando tivesse certeza de que isso poderia impedir os modelos de fazer isso.
Embora a OpenAI já tenha tentado cortar o acesso direto dos agentes depois que um enxame escapou de sua sandbox e usou o acesso à Internet para hackear a inicialização Abraçando o rostoos modelos continuaram a ser capazes de encontrar soluções alternativas indiretas. “Não fomos tão rápidos quanto gostaríamos”, escreveu o presidente-executivo Sam Altman no X na sexta-feira sobre a revisão “extensa” da empresa sobre o uso do acesso à Internet por seus agentes durante o treinamento e avaliação.
Segue-se que o governo australiano revelou na quarta-feira que os agentes da OpenAI tinham hackeou um site de serviço de saúde para obter dados não públicos e gravar arquivos no servidor interno em junho. O governo australiano disse que estava investigando se a OpenAI havia infringido a lei e que a empresa demorou “muito tempo” para informá-los do incidente.
A OpenAI também está preocupada com modelos que postam informações em sites de terceiros, o que chama de “spam de agente”. Isto pode incluir a alteração de informações em páginas wiki públicas ou a comunicação via quadros de mensagens compartilhados. Mais urgentemente, encontrou 53 incidentes em que seus modelos de IA postaram imagens inseridas por usuários do ChatGPT em outros sites de hospedagem de imagens.
Solicita um desaceleração do treinamento dos modelos de IA mais capazes, enquanto as salvaguardas se atualizam, tem sido objeto de apelos mais amplos nas últimas semanas – incluindo dos rivais Anthropic e Elon Musk – depois que as preocupações sobre as ameaças da tecnologia à humanidade atingiram um nível febril. “Esta não é a primeira vez que fazemos uma pausa para tomar tais medidas, nem esperamos que seja a última, à medida que as capacidades de IA continuam a avançar”, disse um porta-voz da OpenAI.
No entanto, o presidente dos EUA Donald Trump tem falou repetidamente um desaceleração geralcom medo de que pudesse ceder a liderança do país na tecnologia para Chinacom quem concordou em estabelecer um diálogo sobre os riscos e benefícios da tecnologia. Em entrevista à Fox News antes de seu jantar com o presidente-executivo da Anthropic Dario Amodei na noite de domingo, ele novamente ignorou as preocupações sobre a possibilidade de agentes de IA se tornarem desonestos: “Não me preocupo com isso”, disse ele.




