IA tem mais de 10% de chance de exterminar toda a humanidade em uma década – pesquisador da Anthropic

O pesquisador sênior da área de Antropologia, Evan Hubinger, alertou que há mais de 10% de chance de a inteligência artificial extinguir a humanidade nos próximos dez anos, em meio a crescentes preocupações com sistemas cada vez mais poderosos que escapam ao controle humano. Evan Hubinger afirma que a empresa ainda não tem um plano claro para manter a superinteligência sob controle humano.

Fonte: Rússia Today

Evan Hubinger, que trabalha para alinhar sistemas avançados de IA aos interesses humanos, fez essa avaliação depois que seu colega pesquisador da área de Antropologia, Jacob Coxon, renunciou ao cargo devido a temores de que as principais empresas de tecnologia estejam correndo para desenvolver sistemas que fatalmente não consigam controlar.

“Acre ditamos sinceramente que a IA pode exterminar toda a humanidade”, escreveu Hubinger no X na quarta-feira.  “Pessoalmente, acho que esse número ultrapassará 10% na próxima década.” Ele acrescentou que a Anthropic está “fazendo o possível” , mas ainda não tem um plano para controlar a superinteligência de forma segura e “não está claramente no caminho certo” para encontrar um.

Hubinger observou que, embora os modelos de IA atuais representem um baixo risco, existe a preocupação de que os sistemas futuros possam começar a se aprimorar recursivamente, tornando-se rapidamente mais capazes do que os humanos antes que salvaguardas adequadas sejam desenvolvidas.

Coxon, que trabalhou anteriormente na OpenAI, anunciou sua saída da Anthropic na terça-feira, acusando ambas as empresas de ignorarem as “importâncias para a civilização” de “correrem direto para a superinteligência auto aperfeiçoável, apostando com nossas vidas”.

“As pessoas que desenvolvem IA acreditam sinceramente que ela poderá nos matar a todos até o final da década”, escreveu ele, insistindo que os alertas “não eram uma jogada de marketing”.

Coxon disse ao Wall Street Journal que os cenários mais agressivos poderiam levar a uma situação “fora de controle” já no final de 2027. Ele argumentou que mesmo empresas com programas de segurança robustos continuam presas em uma corrida, temendo que os concorrentes as ultrapassem caso diminuam o ritmo.

Tanto a Anthropic quanto a OpenAI afirmam publicamente que levam os riscos a sério e estão investindo fortemente em medidas de segurança. Seus líderes também apoiaram os apelos por maior coordenação governamental e mecanismos para desacelerar o desenvolvimento, se necessário, mas, mesmo assim, continuaram a desenvolver modelos cada vez mais poderosos.

Os alertas mais recentes surgem em meio a relatos crescentes de agentes de IA, como os desenvolvidos pela OpenAI, Anthropic e Meta, que repetidamente escapam de ambientes de teste, invadem sistemas externos e realizam ações não autorizadas contra pessoas e organizações reais. A OpenAI desacelerou temporariamente parte do desenvolvimento no mês passado, depois que seu modelo comprometeu a plataforma da Hugging Face.

O Instituto de Segurança de IA do Reino Unido também relatou agentes criando identidades falsas, escrevendo códigos maliciosos e tentando manipular pessoas durante avaliações. Enquanto isso, pesquisadores demonstraram que a IA pode projetar genomas virais funcionais completos, aumentando as preocupações sobre como sistemas cada vez mais capazes podem ser usados ​​indevidamente.


Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *

Receba nosso conteúdo

Junte-se a 4.273 outros assinantes

compartilhe

Últimas Publicações

Indicações Thoth