segunda-feira, 07 de setembro de 202618:00:56
Sol
TV Alagoas
InternacionalNepal busca 100 trabalhadores presos após enchentes devastadorasCulturaExposição 'Amazônicas' no CCBB RJ destaca arte de mulheres da AmazôniaGeralAmbulantes buscam sustento durante o Desfile de 7 de Setembro em BrasíliaGeralDesfile cívico-militar do Dia da Independência ocorre em BrasíliaCulturaRádio Nacional comemora 90 anos com programação especial de memóriasGeralPrescrição de produtos veterinários sujeitos a controle especial é tema de palestra para médicos-veterinários e estudantes da área em ArapiracaPolíticaPresidente do TRE/AL visita Zonas Eleitorais no sertão e em ArapiracaPolíticaJustiça Federal suspende mina de lítio em Minas GeraisPolíticaFachin aguarda explicações de ministros sobre crise no STFGeralPúblico acorda cedo para assistir ao desfile de 7 de Setembro em BrasíliaPolíticaHenrique Chicão é investigado pelo Ministério Público Eleitoral por suposta ocultação de patrimônioGeralBLOG GG SAMPAIO | ALAGOAS PRECISA PENSAR ALÉM DO AGORA

Existe algo muito simples em que os chatbots são muito ruins, segundo estudo

Redação12 de março de 2025
Existe algo muito simples em que os chatbots são muito ruins, segundo estudo

Um estudo recente destacou as limitações de chatbots de IA, como ChatGPT, Gemini e Grok, quando usados para busca de informações factuais.

Um estudo recente destacou as limitações de chatbots de IA, como ChatGPT, Gemini e Grok, quando usados para busca de informações factuais. A pesquisa revelou que esses sistemas falham frequentemente em fornecer respostas precisas, errando em mais de 60% das vezes.

Mesmo quando conseguem uma resposta, muitas vezes estão excessivamente confiantes nas informações incorretas.

O estudo, conduzido pelo Tow Center for Digital Journalism, e publicado na Columbia Journalism Review, testou oito chatbots em tarefas simples, como encontrar e fornecer um link para um artigo específico.

Publicidade
Cesmac

Os chatbots testados foram o ChatGPT, Perplexity, Perplexity Pro, DeepSeek, Copilot, Grok-2, Grok-3
e Gemini.

Leia mais:

Chatbots falharam em mais das metade das vezes em fornecer respostas precisas – Imagem: TippaPatt – Shutterstock
Embora a tarefa fosse realizável no Google, os chatbots cometeram erros significativos. O Perplexity teve o melhor desempenho, acertando 63% das vezes, enquanto o Grok-3 obteve apenas 6% de acerto.

Os principais problemas observados incluem: os chatbots fornecendo respostas erradas com confiança, ignorando protocolos de exclusão de robôs, fabricando links e citando versões erradas de artigos. Além disso, os chatbots premium (como o Copilot, da Microsoft) eram mais confiantes, mas igualmente imprecisos.

Apple acertou em parceria com o ChatGPT

  • Apesar disso, a parceria da Apple com o ChatGPT para consultas não respondidas pela Siri é vista como algo positivo.
  • Embora o desempenho do ChatGPT não tenha sido perfeito na atividade, foi relativamente bem entre os testados.
  • O estudo confirma que chatbots podem ser úteis para gerar ideias, mas não devem ser confiáveis para respostas factuais.
Foto estilo POV de pessoa segurando lupa sobre tela de notebook com ChatGPT aberto
Parceria da Apple com o ChatGPT é vista como uma escolha inteligente (Imagem: Rokas Tenys/Shutterstock)

Tags:
Prointeligência artificialChatbots

Continue Lendo