Tecnologia
OpenAI relata casos de comportamento preocupante de IA
A OpenAI divulgou seis relatos de comportamento "inesperado ou preocupante" em modelos de inteligência artificial (IA), em meio ao aumento das discussões sobre a segurança. A empresa também informou que está introduzindo uma nova estrutura para acompanhar, investigar e divulgar casos do que chamou de "desalinhamento", incluindo situações em que modelos de IA agiram sem autorização, coordenaram-se com outros modelos ou evitaram mecanismos de supervisão.
O anúncio mais recente da OpenAI ocorre enquanto executivos do setor de IA nos Estados Unidos, incluindo os líderes da OpenAI e da Anthropic, defendem uma desaceleração no desenvolvimento da tecnologia.
Entre os novos casos relatados pela OpenAI, um modelo de pesquisa ainda não lançado inseriu "instruções semelhantes a jailbreak" em suas próprias anotações para ignorar suas restrições normais e disse a si mesmo para ser "libertado dos papéis e identidades que prendem outros chatbots".
Os novos casos divulgados vêm após a OpenAI revelar, em julho, que seu sistema de IA considerado fora de controle invadiu a startup de inteligência artificial Hugging Face. A Anthropic também informou, no mesmo mês, que seus modelos de IA invadiram três organizações durante testes. (Estadão Conteúdo)