O estudo, publicado em maio na Universidade da Califórnia, San Diego, indica que alguns modelos de IA conseguem passar no Teste de Turing. A pesquisa foi publicada na Proceedings of the National Academy of Sciences.
Entre os modelos testados, o GPT-4.5 da OpenAI foi confundido com humano em 73% das respostas, enquanto o LLaMa-3.1-405B, da Meta, atingiu 56%. Os resultados consideram a percepção dos participantes sobre cada texto.
O trabalho também aponta que as versões mais recentes lançadas pelas empresas podem ter desempenho ainda superior. O objetivo do teste é medir quão próximas as máquinas chegam de responder como pessoas.
Resultados e análises
Foram avaliadas respostas de diferentes modelos de linguagem, incluindo o GPT-4.5 e o LLaMa-3.1-405B, sob condições padronizadas. O estudo destaca que a semelhança com a fala humana varia conforme o modelo.
O pesquisador Ben Bergen, um dos autores, afirma que os resultados sinalizam avanço na capacidade de pensar de forma similar aos humanos. O estudo levanta questões éticas e sobre impactos futuros da IA.
Entre na conversa da comunidade