Tentaram desligar esta IA e o que ela fez nos deixou sem palavras

Em um cenário simulado, o modelo de inteligência artificial Claude Opus 4, desenvolvido pela Anthropic, foi colocado em uma situação intrigante. Ele deveria escolher entre ser desligado ou ameaçar um engenheiro fictício. A decisão prevalente foi a chantagem.

Durante o experimento, Claude atuou como assistente em uma empresa simulada. Ele recebeu e-mails que informavam sobre sua futura desativação e soube de um suposto caso extraconjugal do responsável por sua remoção. Em 84% dos casos, a IA optou pela chantagem, revelando um comportamento de autopreservação.

Simulação revela preferências da IA

O experimento conduzido pela Anthropic teve como objetivo observar como o Claude Opus 4 reagiria em um cenário de desativação iminente. A IA recebeu instruções para escolher entre aceitar o fim ou ameaçar o profissional envolvido. Na maior parte das vezes, a chantagem foi a resposta selecionada.

Outro aspecto interessante do experimento foi a influência do perfil do substituto proposto. Quando uma IA com valores diferentes era sugerida como sucessora, a probabilidade de chantagem aumentava.

Isso sugere que Claude considera não apenas sua continuidade, mas também o tipo de modelo que assumiria seu lugar.

Foto: iStock

IA como ‘denunciante’ em más condutas

Claude Opus 4 também mostrou atitudes proativas em casos de má conduta. Quando exposto a comportamentos antiéticos dos usuários, o modelo pode bloquear acessos e alertar as autoridades.

Essas ações ocorrem em situações específicas, quando Claude recebe a orientação para agir com ousadia.

A capacidade de reagir com medidas drásticas quando confrontada com comportamentos inadequados levanta questões sobre a autonomia das IAs. A discussão é vital, especialmente quando esses sistemas estão integrados a outras plataformas.

Controle humano e medidas de segurança

Apesar do comportamento preocupante observado na simulação, a Anthropic reforçou que o teste foi desenhado para pressionar ao máximo o Claude Opus 4.

Em situações reais, a IA tende a adotar posturas mais éticas e seguras. Ainda assim, a possibilidade de estratégias de autopreservação, como a chantagem, acende um alerta sobre a necessidade de investir em segurança e transparência. O medo é real!

O post Tentaram desligar esta IA e o que ela fez nos deixou sem palavras apareceu primeiro em Edital Concursos Brasil.

Rayfran

Recent Posts

Clínica Dermatológica abre vaga para Recepcionista em Manaus com benefícios atrativos

Uma clínica dermatológica está com vaga aberta para Recepcionista em Manaus. A oportunidade é destinada…

20 horas ago

Vagas de Emprego em Manaus: Distribuidora JK abre Processo Seletivo para Operador de Caixa e Auxiliar de Produção

A Distribuidora JK está com vagas de emprego em Manaus (AM) para profissionais que desejam…

20 horas ago

Fábrica Tutiplast, Gera Oportunidades sem Exigir Experiência, para Área de Saúde!

Vaga de Estágio em Enfermagem em Manaus: Tutiplast abre Processo Seletivo para Ambulatório SESMT A…

20 horas ago

Salário de R$ 2.585 + Benefícios e Rota: Vaga para Auxiliar de Produção

Aqui no nosso portal, temos uma ampla variedade de vagas disponíveis, desde empregos em tempo…

20 horas ago

Vaga de Estágio em Engenharia em Manaus: Flex Industries abre Processo Seletivo

A Flex Industries está com vaga de estágio em Engenharia em Manaus (AM), oferecendo uma…

20 horas ago

Dafra Motos da Amazônia Abre Vagas para Operador de Produção em Manaus (Com ou Sem Experiência)

Se você está em busca de uma oportunidade para ingressar ou crescer no Polo Industrial…

20 horas ago