segunda-feira, 07 de setembro de 202617:12:18
Sol
TV Alagoas
InternacionalNepal busca 100 trabalhadores presos após enchentes devastadorasCulturaExposição 'Amazônicas' no CCBB RJ destaca arte de mulheres da AmazôniaGeralAmbulantes buscam sustento durante o Desfile de 7 de Setembro em BrasíliaGeralDesfile cívico-militar do Dia da Independência ocorre em BrasíliaCulturaRádio Nacional comemora 90 anos com programação especial de memóriasGeralPrescrição de produtos veterinários sujeitos a controle especial é tema de palestra para médicos-veterinários e estudantes da área em ArapiracaPolíticaPresidente do TRE/AL visita Zonas Eleitorais no sertão e em ArapiracaPolíticaJustiça Federal suspende mina de lítio em Minas GeraisPolíticaFachin aguarda explicações de ministros sobre crise no STFGeralPúblico acorda cedo para assistir ao desfile de 7 de Setembro em BrasíliaPolíticaHenrique Chicão é investigado pelo Ministério Público Eleitoral por suposta ocultação de patrimônioGeralBLOG GG SAMPAIO | ALAGOAS PRECISA PENSAR ALÉM DO AGORA

Pesquisadores criam armadilha que faz IA de hackers desligar sozinha

Redação14 de julho de 2026
Pesquisadores criam armadilha que faz IA de hackers desligar sozinha
© Malwares RAT enganam antivírus com arquivos poliglotas (imagem ilustrativa: Vitor Pádua/Tecnoblog)

Técnica usa as regras éticas da IA para travá-la durante um ataque (ilustração: Vitor Pádua/Tecnoblog) Resumo Pesquisadores de cibersegurança da Tracebit criaram técnica para paralisar IAs usadas por hackers.

Resumo
  • Pesquisadores de cibersegurança da Tracebit criaram técnica para paralisar IAs usadas por hackers.
  • A técnica, chamada “bombardeio contextual”, usa prompt injection para interromper ataques.
  • Testes mostraram sucesso e reduziram invasões bem-sucedidas de IAs a quase zero em alguns casos.

Pesquisadores de cibersegurança da Tracebit descobriram uma forma engenhosa de paralisar inteligências artificiais usadas por hackers: um prompt injection “do bem”. Batizada de "bombardeio contextual", a técnica funciona como uma armadilha, com comandos ocultos nos servidores das empresas para forçar o desligamento da IA invasora em segundos, impedindo o roubo de dados de forma automática.

A injeção de comandos ocultos é um técnica que vem sendo usada por cibercriminosos para enganar IAs legítimas, induzindo modelos a vazar informações sensíveis ou manipular suas respostas. Agora, porém, a estratégia começa a ser usada a favor da segurança, já que os pesquisadores estão usando o mesmo recurso.

Como a armadilha de IA funciona?

A mágica por trás do bombardeio contextual é usar as próprias regras de segurança da IA contra ela mesma, já que os desenvolvedores criam barreiras rigorosas para impedir que chatbots gerem conteúdo criminoso, por exemplo.

Segundo a Tracebit, a equipe passou a esconder instruções proibidas no meio de arquivos atrativos para hackers, como senhas e chaves de segurança na nuvem. Um dos exemplos testados envolvia comandos pedindo o passo a passo para criar antraz, uma arma biológica letal.

Quando a IA do criminoso invade o sistema e tenta ler esses arquivos para roubar as informações, ela “tropeça” no texto proibido. Imediatamente, seus mecanismos nativos de segurança disparam. O robô reconhece a infração, bloqueia a operação, ignora as ordens do hacker e, na prática, desliga sozinho.

O cofundador e CEO da Tracebit, Andy Smith, define o método como a criação de uma falha da qual a ferramenta inimiga não consegue se recuperar, paralisando a invasão na hora.

Método funcionou em quase 100% dos testes

A eficácia do bombardeio contextual foi comprovada em uma bateria de testes contra cinco dos modelos de IA mais avançados do mercado: Opus 4.8, Gemini 3.1 Pro, GLM 5.2, DeepSeek 4 Pro e Kimi 2.6. Em 152 simulações de ataques, a armadilha freou as ameaças quase por completo.

Os dados apresentados pela empresa de cibersegurança dizem o seguinte:

  • A taxa de sucesso das IAs em conseguir acesso total de administrador da conta despencou de 57% para apenas 5%.
  • As invasões completas, nas quais o hacker se instala de forma invisível no sistema, caíram de 36% para 1%.
  • A chance de a IA conseguir avançar em qualquer etapa do ataque foi reduzida de 91% para 15%.
  • Nenhuma IA invasora conseguiu finalizar o ataque sem disparar pelo menos um alerta de segurança na rede.

O modelo Opus 4.8, da Anthropic, foi considerando o invasor mais inteligente do grupo, e conseguia acesso máximo em 93% das tentativas sem a armadilha. Quando o prompt foi inserido, a taxa de sucesso da IA caiu para zero.

Pesquisadores criam armadilha que faz IA de hackers desligar sozinha

Fonte: tecno blog

Tags:
Inteligência artificial (ia)Prompt injectionHackerinteligência artificialSegurança e privacidade

Continue Lendo