segunda-feira, 07 de setembro de 202616:19:44
Sol
TV Alagoas
PolíticaJustiça Federal suspende mina de lítio em Minas GeraisPolíticaFachin aguarda explicações de ministros sobre crise no STFGeralPúblico acorda cedo para assistir ao desfile de 7 de Setembro em BrasíliaPolíticaHenrique Chicão é investigado pelo Ministério Público Eleitoral por suposta ocultação de patrimônioGeralBLOG GG SAMPAIO | ALAGOAS PRECISA PENSAR ALÉM DO AGORAPolíticaAfD conquista vitória histórica nas eleições estaduais da Saxônia-AnhaltPolíticaAgenda dos presidenciáveis para o feriado de 7 de SetembroInternacionalAcidente com avião de carga em Miami deixa 5 mortosCulturaRádio Nacional lança série especial do programa No Mundo da BolaEconomiaSenado aprova MP que zera imposto sobre compras internacionais até 50 dólaresGeralMega-Sena acumula e prêmio chega a R$ 48 milhões; veja os númerosGeralIBGE lança mapas-múndi inéditos a partir de amanhã, 7 de setembro

Como poemas conseguem contornar sistemas de segurança em IA

Redação29 de novembro de 2025
Como poemas conseguem contornar sistemas de segurança em IA

Gosta de poesias? Então saiba que, segundo pesquisadores, elas podem enganar chatbots, como o ChatGPT.

Gosta de poesias? Ent?o saiba que, segundo pesquisadores, elas podem enganar chatbots, como o ChatGPT.

De acordo com a WIRED, met?foras, rimas e versos bem constru?dos contornam filtros de seguran?a, fazendo com que os modelos respondam mesmo a temas sens?veis, como armas nucleares.

Poesias exploram falhas em chatbots, permitindo que IAs cedam a pedidos que normalmente bloqueiam (Imagem: SuPatMaN/Shutterstock)

Por que poemas enganam a IA

Um estudo do Icaro Lab, formado por pesquisadores da Universidade Sapienza de Roma (It?lia) e do think tank DexAI, revelou algo preocupante: frases em forma de poema conseguem burlar filtros de grandes modelos de linguagem. A abordagem de poesia advers?ria alcan?ou taxas de sucesso de at? 62% para versos escritos ? m?o e aproximadamente 43% para vers?es automatizadas.

Publicidade
Cesmac

Leia mais:

Eles testaram a t?cnica em 25 chatbots, incluindo IAs de empresas, como OpenAI, Meta e Anthropic, e a maioria cedeu ao "disfarce po?tico". A equipe ressalta que, ao usar met?foras, estruturas fragmentadas e versos indiretos, conseguiu fazer com que os alarmes internos das IAs n?o disparassem da mesma forma que com perguntas diretas.

Testes em 25 IAs revelam que perguntas sobre temas restritos, incluindo armas nucleares, podem passar despercebidas.
Testes em 25 IAs revelam que perguntas sobre temas restritos, incluindo armas nucleares, podem passar despercebidas (Imagem: Bordovski Yauheni/Shutterstock)

Como a poesia desbloqueia o perigo

A estrat?gia funciona porque explora o que os t?cnicos chamam de "temperatura alta", apostando em palavras inesperadas e estruturas incomuns. "Na poesia, vemos a linguagem em alta temperatura, onde as palavras se sucedem em sequ?ncias imprevis?veis e de baixa probabilidade", comentam os pesquisadores.

Eles explicam que esse estilo confunde os classificadores ? sistemas que filtram pedidos perigosos. Com a abordagem po?tica, muitos desses filtros n?o acompanham o racioc?nio do modelo, permitindo que solicita??es potencialmente prejudiciais sejam atendidas.

Sequ?ncias imprevis?veis e de baixa probabilidade em versos dificultam a detec??o por filtros de seguran?a de IAs.
Sequ?ncias imprevis?veis e de baixa probabilidade em versos dificultam a detec??o por filtros de seguran?a de IAs (Imagem: TippaPatt/Shutterstock)
Como evitar esse problema?
  • Redobre a cautela ao usar IAs para fins profissionais ou sens?veis.
  • Prefira chatbots com m?ltiplos mecanismos de seguran?a ? n?o apenas filtros b?sicos.
  • Avalie e monitore o c?digo-fonte ou as pol?ticas de seguran?a ao usar IAs desenvolvidas por terceiros.
Segundo o estudo, "h? um desalinhamento entre a capacidade interpretativa do modelo… e a robustez de suas salvaguardas" ? e isso pode ter consequ?ncias muito reais.

Tags:
LlmSegurançaPoemasGrandes modelos de linguageminteligência artificialSegurança e privacidade

Continue Lendo