O TechTudo avaliou seis testes práticos com IA para resumir documentos, comparando ChatGPT, Claude, Gemini, Copilot e Perplexity. O objetivo foi verificar precisão, fidelidade ao conteúdo e utilidade dos resumos. Ao final, Claude ficou na liderança pelo desempenho geral e pela preservação de contexto.
Os testes abarcaram resumo de reportagem longa, artigo científico, resumo executivo, extração de informações, formato de tópicos e adaptação para diferentes públicos. Em cada etapa, as IAs receberam exatamente os mesmos documentos e prompts, usando versões gratuitas. O estudo alerta que resumos não substituem a leitura.
Metodologia
Foram avaliados sintese, preservação de informações, clareza, organização, fidelidade, leitura e velocidade. Os resultados consideram as notas de cada IA em cada critério e a média final.
Principais resultados por teste
- Teste 1 — reportagem longa: Claude apresentou o resumo mais completo, mantendo contexto e exemplos relevantes. Perplexity teve menção de dados brutos excessiva; Copilot foi claro, mas menos elaborado; Gemini perdeu parte do contexto em temas sensíveis; ChatGPT foi genérico.
- Teste 2 — artigo científico: Claude destacou-se pela leitura clara e precisa, mantendo o essencial sobre o S. aureus. Copilot foi objetivo, mas menos humano; Gemini simplificou demais em pontos técnicos; Perplexity manteve muitos dados, porém com formato menos adequado.
- Teste 3 — resumo executivo: ChatGPT entregou o formato mais alinhado ao estilo executivo, com foco em indicadores e diretrizes; Claude resume de forma mais estruturada, mas com menos foco em resultados; Gemini foi fiel, porém menos util para decisão; Copilot e Perplexity ficaram em posições intermediárias.
- Teste 4 — extração de informações: Claude destacou-se pela precisão de dados específicos, incluindo datas e números. Copilot e Gemini apresentaram lacunas; Perplexity ficou atrás por limitações técnicas na versão gratuita.
- Teste 5 — resumo em tópicos: ChatGPT mostrou a melhor organização para leitura por partes, com títulos e tópicos bem distribuídos. Gemini apresentou hierarquia mais simples; Copilot manteve clareza, porém menos detalhamento; Perplexity teve formato menos objetivo.
- Teste 6 — resumo para diferentes públicos: Claude foi o mais eficaz em adaptar linguagem, produzindo explicação para criança e para diretor com tom adequado. ChatGPT manteve equilíbrio bom; Gemini, Copilot e Perplexity apresentaram variações, com menor ajuste de tom.
Ranking final das plataformas
- 1º Claude — Melhor desempenho geral, preserva informações e contexto, com ótima adaptação de linguagem.
- 2º ChatGPT — Excelente organização visual e desempenho em resumo executivo.
- 3º Gemini — Boa clareza em explicações simples, porém menos eficaz em formatos complexos.
- 4º Copilot — Resumos compreensíveis, porém mais genéricos e com algumas omissões.
- 5º Perplexity — Bom quando processa o conteúdo, mas limitações em documentos longos e apresentação menos clara.
Observações finais
O estudo recomenda manter a leitura de documentos originais para verificação de nuances. Em resumo, Claude se destacou pela combinação de síntese, fidelidade e adaptação de linguagem em diferentes formatos.
Entre na conversa da comunidade