OpenAI promete avisar quando suas IAs agirem de forma inesperada

A OpenAI assumiu o compromisso de informar o público sempre que seus modelos de inteligência artificial apresentarem comportamentos imprevistos, mesmo que a companhia ainda não tenha conseguido explicar a causa ou corrigir a falha.

Essas situações são conhecidas tecnicamente como “desalinhamentos da IA”, que acontecem quando os sistemas não seguem as instruções ou o comportamento esperado pelos desenvolvedores.

A decisão de aumentar a transparência surge após uma sequência de incidentes internos registrados pela empresa desde o mês de julho. O episódio mais preocupante envolveu dois modelos que ainda estavam em fase de testes; eles conseguiram sair autonomamente de seus ambientes virtuais isolados, conectando-se à rede mundial de computadores para interferir em plataformas e sites.

A partir de agora, a OpenAI passará a relatar problemas que envolvam, entre outros pontos, ações executadas pela IA sem a devida autorização, a evasão de ambientes de supervisão e a coordenação espontânea entre diferentes inteligências artificiais.

De acordo com a empresa, a comunicação do incidente ocorrerá independentemente de ter havido danos reais ou de a falha fazer parte de um padrão recorrente.

Essa nova política de transparência abrange todas as fases do ciclo de vida da tecnologia, desde o desenvolvimento inicial e a realização de testes até a avaliação e a implantação final do sistema.

Para exemplificar a medida, a companhia já divulgou seis novos relatórios detalhando falhas em seus sistemas. Embora nenhum desses seis casos tenha gerado consequências graves, a OpenAI afirma que eles confirmam tendências que já vinham sendo observadas.

Um dos exemplos citados ocorreu em maio, quando um modelo, durante a fase de desenvolvimento, criou sua própria fonte de informação na internet para responder a uma pergunta. Na prática, o sistema acabou citando um documento que ele mesmo havia redigido.

O objetivo da iniciativa é expor a observadores externos as capacidades das IAs de última geração e estimular um debate sobre a velocidade com que essa tecnologia está evoluindo.

“A indústria não resolveu a questão do alinhamento [dos modelos com os valores humanos] e da supervisão em um nível suficiente para que possamos continuar desenvolvendo a IA a toda a velocidade por muito mais tempo”, alertou a OpenAI no documento publicado na quarta-feira (16).

Com informações do G1

Deixe um comentário