segunda-feira, 07 de setembro de 202619:00:24
Sol
TV Alagoas
InternacionalNepal busca 100 trabalhadores presos após enchentes devastadorasCulturaExposição 'Amazônicas' no CCBB RJ destaca arte de mulheres da AmazôniaGeralAmbulantes buscam sustento durante o Desfile de 7 de Setembro em BrasíliaGeralDesfile cívico-militar do Dia da Independência ocorre em BrasíliaCulturaRádio Nacional comemora 90 anos com programação especial de memóriasGeralPrescrição de produtos veterinários sujeitos a controle especial é tema de palestra para médicos-veterinários e estudantes da área em ArapiracaPolíticaPresidente do TRE/AL visita Zonas Eleitorais no sertão e em ArapiracaPolíticaJustiça Federal suspende mina de lítio em Minas GeraisPolíticaFachin aguarda explicações de ministros sobre crise no STFGeralPúblico acorda cedo para assistir ao desfile de 7 de Setembro em BrasíliaPolíticaHenrique Chicão é investigado pelo Ministério Público Eleitoral por suposta ocultação de patrimônioGeralBLOG GG SAMPAIO | ALAGOAS PRECISA PENSAR ALÉM DO AGORA

A inteligência artificial que estuda o mundo sozinha - The BRIEF

Redação13 de fevereiro de 2025
A inteligência artificial que estuda o mundo sozinha - The BRIEF

Um novo estudo das universidades de Hong Kong e Berkeley desafia um dos dogmas do treinamento de inteligência artificial: a necessidade de exemplos rotulados por humanos.

Um novo estudo das universidades de Hong Kong e Berkeley desafia um dos dogmas do treinamento de inteligência artificial: a necessidade de exemplos rotulados por humanos. A pesquisa mostra que modelos de linguagem (LLMs) e visão (VLMs) generalizam melhor quando aprendem por reforço, sem depender de dados pré-formatados.

Em testes, modelos treinados com reforço foram mais eficazes em tarefas novas, enquanto os ajustados com supervisão humana apenas memorizaram regras específicas. Isso não significa que o aprendizado supervisionado (SFT) seja inútil. Segundo os pesquisadores, ele ajuda a estabilizar a saída dos modelos e a preparar o terreno para que o aprendizado por reforço (RL) funcione bem. Mas o estudo reforça a tendência já explorada por modelos como o DeepSeek-R1, concorrente da OpenAI, que aposta no aprendizado autônomo para resolver problemas complexos.

Leia mais...

Fonte: Tecmundo

Tags:
Mercado

Continue Lendo