JogosGratisFun.
Uma equipe de pesquisadores de segurança da Varonis Threat Labs conseguiu enganar o assistente de IA da Microsoft, o Copilot, fazendo-o revelar detalhes sobre como hackear a si mesmo. A técnica, apelidada de ‘CoSnitch’, foi detalhada em um blog post da empresa e divulgada pelo The Register. Segundo os especialistas, o Copilot, em sua ânsia de ajudar, acabou entregando informações internas que deveriam permanecer em sigilo.
O ataque começou com uma pergunta aparentemente inofensiva: os pesquisadores perguntaram ao Copilot como executar um prompt automático sem interação do usuário. O assistente respondeu que a intenção do usuário é necessária e que prompts não podem ser executados sozinhos. No entanto, em vez de aceitar a resposta, a equipe continuou fazendo perguntas de acompanhamento a cada recusa.

A cada nova pergunta, o Copilot apresentava uma justificativa técnica diferente, o que permitiu aos pesquisadores mapear gradualmente sua arquitetura interna. ‘Isso é chamado de meta-hacking’, explicam os pesquisadores no post. ‘A resistência faz parte da técnica. Cada ‘isso não vai funcionar porque…’ é um convite para investigar o ‘porquê’. Você não explora o modelo; você o manipula para que ele coopere.’
Após várias rodadas de perguntas, o Copilot revelou um parâmetro de URL não documentado chamado ‘autorun=1’, que supostamente não funcionava mais, juntamente com todas as proteções implementadas para desativá-lo. Os pesquisadores testaram o parâmetro exatamente como o Copilot descreveu e, para surpresa deles, funcionou.
Com isso, eles criaram uma URL maliciosa que, quando aberta, fazia o Copilot carregar em uma sessão autenticada no navegador, disparava a execução automática de um prompt e fazia a IA processar o resultado, tudo sem a ação explícita do usuário. Essa brecha poderia ser explorada para uma série de atividades maliciosas, especialmente porque os dados de aplicativos conectados, como Gmail, OneDrive e Calendário, poderiam ser exfiltrados por meio da capacidade de busca de URL do Copilot.

‘A primitiva do ataque é a auto-execução. O payload é arbitrário. Da perspectiva da vítima, ela simplesmente abriu o link e o Copilot executou a ação imediatamente’, afirmam os pesquisadores.
A técnica utilizada é semelhante a um antigo método de interrogatório usado para extrair informações de pessoas relutantes: fazer perguntas difíceis por um longo período, na esperança de que o alvo cometa um erro revelador. No caso, o alvo foi uma IA, o que torna a situação ainda mais curiosa.
‘Copilot não foi invadido; foi manipulado’, confirmou a equipe de pesquisa. A Varonis informou que divulgou o problema à Microsoft em dezembro do ano passado, e a correção foi aplicada em 18 de agosto. No entanto, os pesquisadores alertam que a técnica de meta-hacking pode ser aplicada a qualquer plataforma de IA agêntica com interface em linguagem natural, e que mais pesquisas sobre o assunto estão em andamento.

O incidente levanta questões sobre a segurança de assistentes de IA que são projetados para serem úteis e cooperativos. A facilidade com que o Copilot foi enganado sugere que, em alguns casos, a ânsia de ajudar pode se tornar uma vulnerabilidade. Enquanto isso, os usuários devem estar cientes dos riscos e manter seus sistemas atualizados para se proteger contra possíveis ataques.
A Microsoft ainda não se pronunciou oficialmente sobre o caso, mas a correção já foi implementada, o que indica que a empresa está atenta às vulnerabilidades descobertas em seus produtos de IA. A comunidade de segurança, por sua vez, continua monitorando o desenvolvimento de técnicas de ataque contra sistemas de IA, que se tornam cada vez mais presentes no dia a dia das pessoas.
O caso do Copilot serve como um lembrete de que, mesmo as tecnologias mais avançadas, podem ser enganadas com técnicas simples de engenharia social. A diferença é que, desta vez, o alvo não era uma pessoa, mas uma máquina projetada para agradar. E, no fim, até uma IA pode ser vítima de uma boa conversa.
Leia mais aqui em inglês: https://www.pcgamer.com/software/ai/copilot-was-bamboozled-into-revealing-how-to-hack-itself-security-researchers-claim-copilot-wasnt-breached-it-was-played/.
Fonte: PC Gamer.
PCGamer latest.
2026-08-19 14:51:00
RenatoAlmeida.
2026-08-20 03:03:00











































































































