Inteligência artificial supera teste de Turing pela primeira vez, aponta estudo da Universidade da Califórnia
Pesquisa da University of California San Diego revela que modelos avançados de IA, como GPT-4.5 e LLaMa-3.1-405B, passaram no teste de Turing, confundindo participantes humanos em mais de 70% das interações. Estudo publicado na revista Proceedings of the National Academy of Sciences marca um marco histórico na evolução da inteligência artificial.
Detalhes do estudo e metodologia
O estudo conduzido pela University of California San Diego avaliou a capacidade de modelos de IA em passar no teste de Turing, proposto em 1950 por Alan Turing. Participantes humanos conversaram simultaneamente com uma pessoa real e um sistema de IA, tentando identificar qual dos interlocutores era humano. Foram realizados experimentos com quase 500 pessoas, divididas em dois grupos: estudantes da UC San Diego e participantes recrutados pela plataforma Prolific. Quatro modelos de linguagem foram testados: GPT-4.5, LLaMa-3.1-405B, GPT-4o e o chatbot clássico ELIZA, criado nos anos 1960.
Resultados surpreendentes
Os resultados mostraram que o GPT-4.5 foi identificado como humano em 73% das interações, superando a taxa de escolha dos próprios participantes humanos. O LLaMa-3.1-405B também obteve desempenho notável, sendo considerado humano em 56% das vezes, estatisticamente equivalente ao desempenho de pessoas reais. Em contraste, o ELIZA e o GPT-4o tiveram desempenhos inferiores, com 23% e resultados abaixo do esperado, respectivamente. Os pesquisadores destacaram que esta é a primeira vez que modelos de linguagem avançados alcançam resultados tão próximos — ou superiores — aos de humanos no teste de Turing.