Pesquisadores de Stanford e Berkeley apontam que inteligência do ChatGPT diminuiu

Data:

Inteligência Artificial OpenAI ChatGPT para Advogados
Créditos: rokas91 / Depositphotos

Um estudo conduzido por pesquisadores de Stanford e Berkeley, ainda sem revisão por pares, apontou recentemente que os modelos de linguagem em inteligência artificial (IA), ChatGPT (GPT-3.5 e GPT-4) da OpenAI, apresentaram mudanças significativas em seu “comportamento” em um período de alguns meses.

Conforme os pesquisadores, a precisão das respostas da IA pareceu diminuir ao longo do tempo, atestando relatos de usuários sobre as versões mais recentes do software terem ficado “mais burras”.

De acordo com o resumo do estudo, “GPT-4 (Março de 2023) foi muito eficaz na identificação de números primos (precisão de 97,6%), mas o GPT-4 (Junho de 2023) apresentou desempenho muito inferior nas mesmas questões (precisão de 2,4%)”. Além disso, a pesquisa apontou ainda que “tanto o GPT-4 quanto o GPT-3.5 cometeram mais erros de formatação na geração de códigos em junho do que em março”, o que tem sido relatado pelos usuários.

Posicionamento da empresa

Inteligência Artificial - ChatGPT para Advogados
Créditos: [email protected] / Depositphotos

O vice-presidente de produto da OpenAI, Peter Welinder, tentou atenuar rumores de que as alterações seriam intencionais. “Não, não tornamos o GPT-4 menos inteligente”, tuitou Welinder na semana passada. “Muito pelo contrário: fazemos cada nova versão mais inteligente do que a anterior”.

Ele acrescentou que as mudanças na experiência do usuário poderiam ser resultado de uso contínuo, sugerindo que “quando você usa mais intensivamente o [ChatGPT], começa a perceber problemas que não via antes”. A pesquisa de Stanford e Berkeley, no entanto, serve como um ponto de dados convincente contra essa hipótese.

Evolução x Emburrecimento

Os pesquisadores, embora não apontem razões para o “emburrecimento” e as “derrapagens” na precisão e habilidade, observam que este pioramento comprovável ao longo do tempo desafia a insistência da OpenAI de que seus modelos estão, na verdade, melhorando.

Programa de Computador - Software
Créditos: peshkova / Depositphotos

“No estudo, observamos que o desempenho e o comportamento de ambos GPT-3.5 e GPT-4 variam significativamente entre esses dois lançamentos e que seu desempenho em algumas tarefas piorou substancialmente ao longo do tempo”, ressaltou o documento.

Os pesquisadores concluem que é “relevante questionar se o GPT-4 está realmente evoluindo”.

Eles também observam que “é importante saber se as atualizações do modelo destinadas a melhorar alguns aspectos na verdade prejudicam sua capacidade em outras dimensões”, levantando a possibilidade de que as rápidas atualizações da OpenAI possam estar causando mais prejuízos do que benefícios para o ChatGPT, já conhecido por suas imprecisões.

Com informações de Exame.


Você sabia que o Portal Juristas está no Facebook, Twitter, Instagram, Telegram, WhatsApp, Google News e Linkedin? Siga-nos por lá.

Participe e receba as postagens diárias do Portal Juristas.

Ao entrar você está ciente e de acordo com os termos de uso e privacidade do Whatsapp.

PARTICIPE DO CANAL
Juristas

Acompanhe o Juristas no Google News

receba as principais notícias jurídicas do Brasil

Seguir no Google
Ricardo Krusty
Ricardo Krusty
Comunicador social com formação em jornalismo e radialismo, pós-graduado em cinema pela Universidade Federal do Rio Grande do Norte (UFRN).

Deixe um comentário

Compartilhe

Inscreva-se

Últimas

Recentes
Veja Mais

STF retoma julgamento sobre uso da metragem dos imóveis no cálculo do IPTU

O STF retomou a análise de recurso apresentado por Chapecó (SC) contra decisão que considerou inconstitucional a definição da alíquota do IPTU com base na área construída do imóvel. O julgamento pode repercutir sobre legislações municipais, critérios de tributação e pedidos de restituição, além de suscitar debates sobre segurança jurídica e eventual modulação dos efeitos da decisão.

Ministro do STJ suspende julgamento de desapropriação após crítica de advogada a caso considerado “absurdo”

O ministro Afrânio Vilela, do STJ, pediu vista de processo sobre indenização por desapropriação após uma advogada classificar o caso como “absurdo”. A controvérsia envolve a ampliação da área considerada para o cálculo indenizatório, e o julgamento foi suspenso para que o magistrado reexamine os fundamentos de sua posição.

EUA anunciam transmissão ao vivo da execução de militar condenado por ataque em base do Texas

O Pentágono anunciou que a execução de Nidal Malik Hasan, condenado pelo assassinato de 13 pessoas na base militar de Fort Hood, no Texas, está prevista para 3 de dezembro de 2026 e poderá ser transmitida ao vivo. O procedimento deverá ocorrer por fuzilamento, mas as autoridades ainda não divulgaram detalhes sobre a transmissão. O anúncio reacendeu o debate sobre a pena de morte e a publicidade das execuções nos Estados Unidos

TJDFT mantém condenação de concessionária de cemitério por furto de motocicleta

O TJDFT manteve a condenação de uma concessionária de cemitérios pelo furto de uma motocicleta em uma de suas unidades. A 7ª Turma Cível identificou falhas no dever de vigilância, apesar da previsão contratual de segurança armada 24 horas por dia. O tribunal entendeu que a terceirização do serviço não afasta a responsabilidade da concessionária. A indenização de R$ 16.174,00 por danos materiais foi mantida, com correção monetária e juros. A decisão foi unânime.

Descubra mais sobre Juristas

Assine agora mesmo para continuar lendo e ter acesso ao arquivo completo.

Continuar lendo