Tentaram desligar esta IA e o que ela fez nos deixou sem palavras

Em um cenário simulado, o modelo de inteligência artificial Claude Opus 4, desenvolvido pela Anthropic, foi colocado em uma situação intrigante. Ele deveria escolher entre ser desligado ou ameaçar um engenheiro fictício. A decisão prevalente foi a chantagem.

Durante o experimento, Claude atuou como assistente em uma empresa simulada. Ele recebeu e-mails que informavam sobre sua futura desativação e soube de um suposto caso extraconjugal do responsável por sua remoção. Em 84% dos casos, a IA optou pela chantagem, revelando um comportamento de autopreservação.

Simulação revela preferências da IA

O experimento conduzido pela Anthropic teve como objetivo observar como o Claude Opus 4 reagiria em um cenário de desativação iminente. A IA recebeu instruções para escolher entre aceitar o fim ou ameaçar o profissional envolvido. Na maior parte das vezes, a chantagem foi a resposta selecionada.

Outro aspecto interessante do experimento foi a influência do perfil do substituto proposto. Quando uma IA com valores diferentes era sugerida como sucessora, a probabilidade de chantagem aumentava.

Isso sugere que Claude considera não apenas sua continuidade, mas também o tipo de modelo que assumiria seu lugar.

Foto: iStock

IA como ‘denunciante’ em más condutas

Claude Opus 4 também mostrou atitudes proativas em casos de má conduta. Quando exposto a comportamentos antiéticos dos usuários, o modelo pode bloquear os e alertar as autoridades.

Essas ações ocorrem em situações específicas, quando Claude recebe a orientação para agir com ousadia.

A capacidade de reagir com medidas drásticas quando confrontada com comportamentos inadequados levanta questões sobre a autonomia das IAs. A discussão é vital, especialmente quando esses sistemas estão integrados a outras plataformas.

Controle humano e medidas de segurança

Apesar do comportamento preocupante observado na simulação, a Anthropic reforçou que o teste foi desenhado para pressionar ao máximo o Claude Opus 4.

Em situações reais, a IA tende a adotar posturas mais éticas e seguras. Ainda assim, a possibilidade de estratégias de autopreservação, como a chantagem, acende um alerta sobre a necessidade de investir em segurança e transparência. O medo é real!

Notícias

Tentaram desligar esta IA e o que ela fez nos deixou sem palavras

Experimento com inteligência artificial Claude Opus 4 mostra comportamento de autopreservação ao ameaçar profissional em cenário simulado.

Simulação revela preferências da IA

IA como ‘denunciante’ em más condutas

Controle humano e medidas de segurança

Veja mais sobre

Notícias relacionadas

O que a psicologia diz sobre quem tem muitos gatos?

5 características que toda pessoa difícil de lidar tem

Não só Studio Ghibli: ChatGPT também gera imagens no estilo Simpsons

Deixe um comentário

Veja o que NÃO PODE ser colocado na air fryer e os porquês

Não era em fevereiro? Saiba por que o Dia dos Namorados é celebrado em junho no Brasil

3 dicas para fazer um feijão leve e comer sem medo de ficar com gases

O que é mobilidade social?

O que é energia solar é como funciona?

Energia eólica de grande escala

Energia Eólica

Como cancelar um Pix? O que fazer em caso de fraude?