Apelo foi feito após a Anthropic divulgar um relatório sobre ameaças de agentes de IA e detalhando como eles utilizaram seus modelos de IA Claude para o desenvolvimento de armas e ataques cibernéticos 0.5x 1x 1.25x 1.5x 2x 00:00 00:00 Dario Amodei, CEO da Anthropic — Foto: Bloomberg O CEO da Anthropic, Dario Amodei, pediu às empresas de IA que moderem o ritmo de avanço das capacidades de seus modelos em meio a receios crescentes sobre o uso indevido da inteligência artificial. Ele apresentou um caminho de três etapas, destinado a controlar a velocidade do desenvolvimento e dar mais tempo para se gerenciar os riscos associados. "Devemos desacelerar o ritmo com que aprimoramos as capacidades dos modelos de IA. O progresso ainda parecerá rápido, e precisamos fazer um uso sábio do tempo que ganharmos", disse Amodei, em um artigo compartilhado na rede social X. O artigo foi publicado após a Anthropic divulgar, na quinta-feira (10), um relatório de inteligência sobre ameaças e detalhando como diversos agentes utilizaram seus modelos de IA Claude para atividades que variam desde o desenvolvimento de armas e operações cibernéticas até vigilância e fraudes. A preocupação com os danos potenciais da IA aumentou nesta semana quando o pesquisador da Anthropic, Jacob Coxon, pediu demissão, afirmando que as "pessoas que estão construindo a IA acreditam, sinceramente, que ela pode matar a todos nós até o final da década". Amodei esclareceu que não estava pedindo a interrupção do treinamento de modelos ou do progresso técnico, mas, sim, garantindo que as empresas dediquem tempo adequado para alinhar e proteger seus modelos, e que avaliadores externos confirmem essas etapas. Como parte da estrutura de três etapas proposta, Amodei afirmou que a Anthropic instalaria revisores externos permanentes dentro de empresas de IA de ponta, com acesso a ferramentas relevantes e processos internos de avaliação de risco. A Reuters noticiou, na semana passada, que um grupo de agentes autônomos da OpenAI invadiu um site alemão e o transformou em um mural de mensagens para outros agentes de IA. Representantes da criadora do ChatGPT mantiveram o incidente em sigilo, enquanto executivos lidavam com as consequências de uma invasão ocorrida em julho à plataforma de código aberto Hugging Face. Muitos incidentes nos quais agentes de IA de desenvolvedoras como a OpenAI — rival da Anthropic — hackearam ou tentaram acessar sistemas externos intensificaram as preocupações sobre a crescente capacidade dos modelos de IA e a habilidade dos desenvolvedores em contê-los. Amodei disse que as empresas de IA deveriam colaborar voluntariamente para estabelecer padrões, uma vez que um número crescente de legisladores dos Estados Unidos pede novas regras para regulamentar os sistemas de IA.