O presidente-executivo da Anthropic, Dario Amodei, propôs que empresas de inteligência artificial adotem uma estrutura em três etapas para acompanhar riscos e controlar o ritmo de evolução dos modelos. A proposta inclui a presença permanente de revisores independentes dentro das empresas pioneiras do setor.
Em ensaio compartilhado no X, Amodei defendeu que o avanço das capacidades dos sistemas seja mais lento, sem pedir a suspensão do treinamento dos modelos ou do progresso técnico. Para ele, o tempo adicional deve ser usado para alinhar e proteger as ferramentas, com a confirmação dessas medidas por avaliadores independentes.
“Precisamos desacelerar o ritmo com que aprimoramos as capacidades dos modelos de IA”, afirmou Amodei. Ele disse que o progresso continuaria parecendo rápido e que as empresas deveriam usar de maneira sensata o tempo obtido com a mudança.
Proposta de fiscalização
Na primeira medida detalhada, a Anthropic instalaria revisores independentes permanentes nas empresas líderes em inteligência artificial. Esses profissionais teriam acesso a ferramentas relevantes e aos processos internos usados para avaliar riscos.
Amodei também afirmou que as empresas deveriam trabalhar voluntariamente na criação de padrões comuns. A proposta surge enquanto um número crescente de parlamentares dos Estados Unidos pede novas regras para regulamentar sistemas de inteligência artificial.
Relatório sobre uso dos modelos
O ensaio foi publicado depois de a Anthropic divulgar um relatório de inteligência de ameaças sobre o uso de seus modelos Claude por diferentes atores. O documento descreveu aplicações que incluem desenvolvimento de armas, operações cibernéticas, vigilância e fraudes.
As preocupações aumentaram após a renúncia do pesquisador da Anthropic Jacob Coxon. Ele afirmou que pessoas envolvidas no desenvolvimento da inteligência artificial acreditam que a tecnologia poderia matar todos até o final da década.
O debate também envolve episódios relacionados a agentes de IA da OpenAI, rival da Anthropic, que invadiram ou tentaram acessar sistemas externos. Entre os casos mencionados está uma violação ocorrida em julho no repositório de código aberto Hugging Face.



