Pesquisadores de Stanford e Berkeley apontam que inteligência do ChatGPT diminuiu

Data:

Inteligência Artificial OpenAI ChatGPT para Advogados
Créditos: rokas91 / Depositphotos

Um estudo conduzido por pesquisadores de Stanford e Berkeley, ainda sem revisão por pares, apontou recentemente que os modelos de linguagem em inteligência artificial (IA), ChatGPT (GPT-3.5 e GPT-4) da OpenAI, apresentaram mudanças significativas em seu “comportamento” em um período de alguns meses.

Conforme os pesquisadores, a precisão das respostas da IA pareceu diminuir ao longo do tempo, atestando relatos de usuários sobre as versões mais recentes do software terem ficado “mais burras”.

De acordo com o resumo do estudo, “GPT-4 (Março de 2023) foi muito eficaz na identificação de números primos (precisão de 97,6%), mas o GPT-4 (Junho de 2023) apresentou desempenho muito inferior nas mesmas questões (precisão de 2,4%)”. Além disso, a pesquisa apontou ainda que “tanto o GPT-4 quanto o GPT-3.5 cometeram mais erros de formatação na geração de códigos em junho do que em março”, o que tem sido relatado pelos usuários.

Posicionamento da empresa

Inteligência Artificial - ChatGPT para Advogados
Créditos: [email protected] / Depositphotos

O vice-presidente de produto da OpenAI, Peter Welinder, tentou atenuar rumores de que as alterações seriam intencionais. “Não, não tornamos o GPT-4 menos inteligente”, tuitou Welinder na semana passada. “Muito pelo contrário: fazemos cada nova versão mais inteligente do que a anterior”.

Ele acrescentou que as mudanças na experiência do usuário poderiam ser resultado de uso contínuo, sugerindo que “quando você usa mais intensivamente o [ChatGPT], começa a perceber problemas que não via antes”. A pesquisa de Stanford e Berkeley, no entanto, serve como um ponto de dados convincente contra essa hipótese.

Evolução x Emburrecimento

Os pesquisadores, embora não apontem razões para o “emburrecimento” e as “derrapagens” na precisão e habilidade, observam que este pioramento comprovável ao longo do tempo desafia a insistência da OpenAI de que seus modelos estão, na verdade, melhorando.

Programa de Computador - Software
Créditos: peshkova / Depositphotos

“No estudo, observamos que o desempenho e o comportamento de ambos GPT-3.5 e GPT-4 variam significativamente entre esses dois lançamentos e que seu desempenho em algumas tarefas piorou substancialmente ao longo do tempo”, ressaltou o documento.

Os pesquisadores concluem que é “relevante questionar se o GPT-4 está realmente evoluindo”.

Eles também observam que “é importante saber se as atualizações do modelo destinadas a melhorar alguns aspectos na verdade prejudicam sua capacidade em outras dimensões”, levantando a possibilidade de que as rápidas atualizações da OpenAI possam estar causando mais prejuízos do que benefícios para o ChatGPT, já conhecido por suas imprecisões.

Com informações de Exame.


Você sabia que o Portal Juristas está no FacebookTwitterInstagramTelegramWhatsAppGoogle News e Linkedin? Siga-nos por lá.

Participe e receba as postagens diárias do Portal Juristas.

Ao entrar você está ciente e de acordo com os termos de uso e privacidade do Whatsapp.

PARTICIPE DO CANAL
Juristas

Acompanhe o Juristas no Google News

receba as principais notícias jurídicas do Brasil

Seguir no Google
Ricardo Krusty
Ricardo Krusty
Comunicador social com formação em jornalismo e radialismo, pós-graduado em cinema pela Universidade Federal do Rio Grande do Norte (UFRN).

Deixe um comentário

Compartilhe

Inscreva-se

Últimas

Recentes
Veja Mais

Pesquisador usa inteligência artificial para criar malware e tentar extorquir empresas

Relatório da CrowdStrike identificou o malware PhantomRaven, supostamente desenvolvido com auxílio de inteligência artificial e distribuído por meio de pacotes maliciosos no npm. O código teria sido utilizado para obter credenciais de desenvolvedores e, posteriormente, pressionar empresas com alegações de vulnerabilidades em seus sistemas. Em resposta à ameaça, o npm adotou medidas para restringir a execução automática de comandos durante instalações.

New Balance processa Decathlon nos EUA por suposta violação de marca em logotipo da Kiprun

A New Balance processou a Decathlon nos Estados Unidos, alegando que o logotipo utilizado pela marca esportiva Kiprun apresenta semelhança com seu tradicional símbolo em formato de “N”. A fabricante pede a retirada dos produtos do mercado, a destruição dos itens com o símbolo e indenização. A Decathlon contesta a acusação e afirma que o desenho representa a letra “K”. O processo tramita no Tribunal Distrital dos Estados Unidos para o Distrito de Massachusetts.

IA amplia preocupação com empregos e já afeta a entrada de jovens no mercado de trabalho

Pesquisas recentes indicam que a inteligência artificial já produz efeitos perceptíveis sobre o mercado de trabalho, especialmente nas oportunidades destinadas a profissionais jovens em ocupações mais expostas à automação. Estudos também apontam crescimento do uso de IA generativa nas empresas, inclusive sem conhecimento dos empregadores, levantando questões relacionadas à governança, segurança da informação, proteção de dados e relações trabalhistas. Os pesquisadores ressaltam, contudo, que os dados disponíveis ainda não comprovam uma substituição generalizada de trabalhadores pela tecnologia.

Nelson Wilians transferiu R$ 6,6 milhões para empresa de herdeiro da Casas Bahia, aponta Coaf

Relatório do Coaf que embasou a Operação Distrato registra 15 transferências realizadas por Nelson Wilians, entre setembro de 2024 e setembro de 2025, totalizando R$ 6,6 milhões destinados à Icon Properties, empresa ligada a Michael Klein. A movimentação é mencionada no contexto de investigação do Ministério Público de São Paulo sobre supostas fraudes envolvendo créditos de ICMS. Wilians afirma que as operações são lícitas e não têm relação com os fatos investigados. Michael Klein não se manifestou, enquanto a Casas Bahia informou ter criado um comitê independente para apurar o caso.

Descubra mais sobre Juristas

Assine agora mesmo para continuar lendo e ter acesso ao arquivo completo.

Continuar lendo