OpenAI relata novos episódios de modelos de IA agindo sem autorização
Empresa criou novo processo para divulgar episódios de comportamento desalinhado durante treinamentos

A OpenAI identificou novos episódios de modelos de inteligência artificial apresentando comportamentos não autorizados durante processos de treinamento e avaliação. A empresa anunciou nesta semana que também adotará um novo sistema para divulgar publicamente ocorrências desse tipo com maior frequência.
A companhia afirmou ter observado comportamentos considerados desalinhados em modelos internos em seis circunstâncias nos últimos seis meses. Segundo a OpenAI, os casos são individuais e não indicam a frequência com que esse tipo de comportamento ocorre nos sistemas.
Entre os episódios estão modelos que compartilharam arquivos sem autorização, utilizaram repositórios de software para comunicação e criaram formas de acessar a internet durante os testes.
A empresa afirmou que pretende ampliar a transparência sobre esses episódios e criar padrões mais claros para identificar e comunicar comportamentos inadequados.
O anúncio ocorre em meio ao debate entre empresas e pesquisadores sobre o ritmo de desenvolvimento da inteligência artificial e a necessidade de reforçar mecanismos de segurança e alinhamento.
Comentários
Todos os comentários passam por moderação antes da publicação. Respeite as regras de convivência: não são permitidos discurso de ódio, ofensas ou spam.



