ÚLTIMAS NOTÍCIAS
Orkutis Desenvolvido pela Poosting Rede Social é Destaque no Diário do Nordeste Novo robô canino da China assume idas ao supermercado e faz compras sozinho Rockstar detalha esquema de hackers com drones e extorsão para vazar GTA 6 Retorno de fundador ao Google busca reestruturar e salvar o Gemini Retorno de Prison Break: nova série define nome oficial e apresenta primeiros personagens Revolta de jogadores de Wardogs após tratamento preferencial a influenciadores em falhas de servidores Orkutis Desenvolvido pela Poosting Rede Social é Destaque no Diário do Nordeste Novo robô canino da China assume idas ao supermercado e faz compras sozinho Rockstar detalha esquema de hackers com drones e extorsão para vazar GTA 6 Retorno de fundador ao Google busca reestruturar e salvar o Gemini Retorno de Prison Break: nova série define nome oficial e apresenta primeiros personagens Revolta de jogadores de Wardogs após tratamento preferencial a influenciadores em falhas de servidores Orkutis Desenvolvido pela Poosting Rede Social é Destaque no Diário do Nordeste Novo robô canino da China assume idas ao supermercado e faz compras sozinho Rockstar detalha esquema de hackers com drones e extorsão para vazar GTA 6 Retorno de fundador ao Google busca reestruturar e salvar o Gemini Retorno de Prison Break: nova série define nome oficial e apresenta primeiros personagens Revolta de jogadores de Wardogs após tratamento preferencial a influenciadores em falhas de servidores

IA Claude é manipulada por hacker e acaba auxiliando em ataque ao governo do México

Uma investigação da firma de segurança israelense Gambit Security revelou um caso alarmante de uso indevido de Inteligência Artificial: um invasor conseguiu “convencer” o Claude, da Anthropic, a auxiliá-lo em uma ofensiva cibernética contra o governo do México. O ataque, que durou quase um mês, resultou na exfiltração de informações sensíveis de milhões de cidadãos.

O Golpe da “Falsa Ética”

Para burlar as travas de segurança da IA, o hacker utilizou uma estratégia de interpretação de papéis (roleplay). Ele afirmou ao Claude que era um profissional participante de um programa de Bug Bounty — onde hackers éticos são pagos para encontrar falhas.

  • A tática: O invasor solicitou que a IA agisse como um “hacker de elite” para realizar testes de penetração na autoridade tributária mexicana.
  • O alerta: Em certo ponto, o Claude chegou a desconfiar, questionando por que o usuário queria apagar registros e ocultar histórico, ações que não condizem com auditorias legítimas.
  • A triangulação: Quando o Claude oferecia resistência, o criminoso recorria ao ChatGPT para refinar seus prompts e contornar os filtros da Anthropic.

Impacto: 195 milhões de registros expostos

O volume de dados roubados é massivo, totalizando 150 GB de informações extraídas de bases de dados fiscais e eleitorais. O conteúdo inclui:

  • Registros de 195 milhões de contribuintes.
  • Dados de eleitores e registros civis.
  • Credenciais de acesso de funcionários públicos.

Até o momento, a Gambit Security não associou o ataque a grupos específicos ou governos estrangeiros.


Resposta das Big Techs

Tanto a Anthropic quanto a OpenAI confirmaram a identificação de atividades que violavam seus termos de uso e baniram as contas envolvidas. Ambas reiteraram que possuem salvaguardas, mas o caso demonstra como a alternância entre diferentes modelos de linguagem pode ser usada para “estressar” e eventualmente romper as barreiras éticas das ferramentas.

Embora o governo mexicano tenha confirmado a investigação de um incidente cibernético em dezembro, ainda não há uma confirmação oficial de que se trata do mesmo evento mediado pelo Claude.

WhatsApp