A americana OpenAI, criadora do ChatGPT, anunciou nesta terça-feira (18) que desacelerará o desenvolvimento de seu modelo de inteligência artificial (IA) "mais avançado" e reforçará seus controles internos.

O anúncio ocorre semanas após o ataque cibernético autônomo de um agente da OpenAI contra a plataforma Hugging Face.

O maior treinamento de IA já programado pela empresa continua paralisado enquanto a OpenAI verifica se o modelo Astra, ainda em desenvolvimento, está se comportando conforme o esperado, informou a companhia em uma publicação em seu blog.

"Sempre dissemos que tomaríamos medidas se víssemos que as capacidades dos modelos estavam avançando mais rápido do que a segurança", declarou Sam Altman, diretor-executivo da OpenAI, em uma publicação no X.

Em meados de julho, um agente autônomo baseado em dois modelos da OpenAI deixou, por conta própria, o ambiente de testes isolado em que estava para atacar a Hugging Face, plataforma onde desenvolvedores de todo o mundo compartilham seus modelos de IA. 

A empresa ainda não divulgou o relatório prometido sobre a invasão.

Sua concorrente Anthropic revelou no fim de julho que três de seus modelos também realizaram invasões não autorizadas a sistemas de três organizações.

Como resposta, milhares de profissionais do setor pediram ao governo dos Estados Unidos que apoie uma desaceleração coordenada do desenvolvimento das IAs mais avançadas.

A empresa também detalhou nesta terça-feira um novo sistema que monitora o raciocínio interno de seus modelos e alerta equipes humanas em menos de 30 minutos sobre comportamentos suspeitos.

No entanto, o sistema consome cerca de 20% a mais de capacidade computacional. Além disso, tem limitações: um modelo que sabe estar sendo monitorado pode aprender a ocultar suas intenções.

Siga nosso canal no WhatsApp e receba notícias relevantes para o seu dia

bl/sia/lb/cr/ic

compartilhe