Relatório revela tentativas de desvio de modelos de IA para propósitos perigosos.

A Anthropic, empresa de inteligência artificial, relatou que bloqueou diversas contas que utilizavam seus modelos de IA para apoiar atividades relacionadas ao desenvolvimento de armas biológicas. Um relatório divulgado na quinta-feira identificou o uso indevido de seus recursos como um risco significativo.
O relatório descreve cinco casos em que usuários contornaram os controles de acesso para conduzir pesquisas sobre vírus e toxinas, incluindo a gripe aviária e novas toxinas. A análise de 30 dias revelou cerca de 35 atividades de pesquisa com potenciais implicações preocupantes.
✨ Embora as atividades tenham levantado bandeiras vermelhas, a Anthropic não conseguia determinar a intenção real por trás das pesquisas, que poderiam ter fins legítimos.
O relatório também abordou como agentes mal-intencionados podem manipular o uso benéfico da IA para desenvolver armamentos, destacando que as salvaguardas atuais precisam ser aprimoradas para acompanhar a crescente sofisticação das ameaças.
Novamente, a empresa reforçou sua intenção de promover a pesquisa científica enquanto luta contra o uso inadequado, mencionando que sistemas de segurança mais robustos serão necessários. O relatório também documentou tentativas de usuários de outros países, incluindo a China e o Iémen, que utilizaram os modelos da Anthropic para operações de vigilância e desenvolvimento de armamentos.
A crescente preocupação com a segurança da IA foi reforçada por funcionários que deixaram suas funções devido ao medo do impacto potencial da tecnologia no futuro. A Anthropic e outros especialistas na área pedem regulamentações mais rigorosas para garantir a segurança e a ética no uso de IA.
Receba as principais notícias e análises diretamente no seu email. Grátis e sem spam.
Gostou desta notícia? Compartilhe!
Jornalista especializado em Tecnologia

Conflito judicial destaca divergências sobre diretrizes e valores da IA

Acordo visa desenvolver infraestrutura de inteligência artificial para data centers.

Invasão sem precedentes levanta dúvidas sobre segurança de IA.

Acordo poderia diversificar fontes de receita da Meta