Já usou esta ferramenta? Avalie-a
Já usou esta ferramenta? Avalie-a
O Copyleaks é uma plataforma de integridade de conteúdo que responde a duas perguntas relacionadas sobre um texto: se alguma parte foi produzida por um modelo generativo e se alguma parte já existe noutro lugar. O produto parte da ideia de que essas duas perguntas pertencem a um mesmo fluxo de trabalho e não a duas ferramentas separadas. Fundada em 2015, a empresa começou como serviço de deteção de plágio e alargou-se à deteção de IA e a ferramentas de conformidade à medida que os grandes modelos de linguagem entraram na escrita quotidiana. Esse percurso importa na avaliação: o lado do plágio assenta numa base de comparação e em técnicas de correspondência apuradas ao longo de cerca de uma década, ao passo que o lado da deteção de IA assenta em classificadores estatísticos bem mais recentes e, como esta página detalha, consideravelmente mais contestados.
Na prática, o produto resume-se a uma análise e a um relatório. Submete um texto pela aplicação web, por uma extensão de navegador, por um suplemento do Google Docs, por uma chamada de API ou por um sistema de gestão de aprendizagem, e recebe uma vista do documento com passagens realçadas e uma percentagem. A integridade do conteúdo é verificada por duas vias: do lado do plágio, o relatório mostra as fontes correspondentes. Do lado da IA, mostra que passagens carregam a assinatura estatística de geração automática. A análise de texto devolve a avaliação de IA e a comparação de plágio num único relatório, mas a deteção de imagem apenas julga a presença de IA e não verifica plágio de imagem, pelo que o relatório unificado é uma propriedade específica da análise textual.
A quem serve depende da metade que lhe interessa. Universidades e escolas usam-no como camada de integridade académica ligada ao seu LMS. Editoras e equipas de conteúdo verificam se um texto recebido é original e se se lê como produção automática. As empresas aplicam-no à conformidade em propriedade intelectual, à governação da IA generativa e à verificação de que os dados de treino foram escritos por pessoas. Os particulares usam o plafond gratuito para rever o próprio trabalho antes de o entregar. A empresa declara presença em mais de 100 países, mais de 500 empresas e instituições de ensino e mais de 30 milhões de análises por mês — números autodeclarados e não auditados.
As contas novas incluem um número limitado de créditos gratuitos, suficiente para passar documentos reais e julgar os relatórios antes de pagar. Não existe um nível gratuito permanente com volume significativo, pelo que o plafond gratuito deve ser entendido como mecanismo de avaliação.
Os planos individuais pagos são subscrições faturadas por créditos. O Personal custa 16,99 $ por mês ou 13,99 $ por mês com faturação anual, e o Pro custa 99,99 $ por mês ou 74,99 $ por mês em anual, acrescentando o Pro 25 lugares de utilizador, filtros de deteção avançados, análise de sites completos por mapa do site, deteção de plágio entre idiomas e um painel de analíticas. A faturação assenta em créditos unificados, em que um crédito cobre até 250 palavras ou uma imagem: um artigo de 5 000 palavras consome 20 créditos, e o número de créditos anunciado equivale a cerca de 250 vezes esse valor em palavras. Os planos Enterprise e Education são orçamentados à medida; o preço para o ensino baseia-se no número de estudantes a tempo inteiro, e tanto o acesso à API como a integração com LMS só existem nesses níveis.
Há três condições comerciais que merecem atenção antes de subscrever, porque passam facilmente despercebidas e saem caras quando descobertas tarde. Os planos não se acumulam: mudar de plano sobrepõe-se ao atual e faz perder os créditos restantes. Os reembolsos só são considerados se pedidos nos primeiros 10 dias do ciclo de faturação e se nenhum crédito tiver sido usado. Todos os planos se renovam automaticamente até serem cancelados. Se o seu uso for sazonal — um semestre em vez de um ano —, confirme no processo de pagamento que a faturação mensal está de facto disponível antes de assumir um ano.
Esta secção merece mais peso do que a equivalente na maioria das ferramentas, porque a precisão da deteção de IA é uma questão onde as afirmações comerciais e a evidência independente divergem nitidamente, e porque as consequências de uma resposta errada recaem sobre pessoas concretas.
O número de precisão é uma autodeclaração do fornecedor. O Copyleaks anuncia mais de 99 % de precisão, mas esse número traz uma nota de rodapé a esclarecer que a avaliação assenta em testes internos sobre conjuntos de dados em inglês, o que faz dele um dado autodeclarado e não um resultado auditado de forma independente. Não é uma acusação de má-fé: a nota está na própria página. Mas 99 % obtidos por uma empresa com o seu próprio conjunto de testes em inglês não devem ler-se como garantia sobre o seu documento no seu idioma.
O desempenho fora do inglês é claramente mais fraco segundo os próprios números do fornecedor. A tabela oficial por idioma mostra um gradiente nítido: o valor do lado da IA desce de 99,20 % em inglês para 95,63 % em alemão e 93,08 % em português. Uma diferença de cerca de 7 pontos em português significa bastantes mais deteções falhadas do que o número principal sugere. Note ainda que a deteção de IA cobre mais de 30 idiomas enquanto a de plágio cobre mais de 100: os dois números não são intermutáveis.
A investigação académica independente contradiz o discurso comercial da categoria. Um estudo com revisão por pares de Weber-Wulff e colegas, publicado no International Journal for Educational Integrity, testou 14 ferramentas de deteção e concluiu que as ferramentas disponíveis não são exatas nem fiáveis e enviesam no sentido de classificar o material como escrito por humanos. O mesmo trabalho concluiu que técnicas de ofuscação degradam significativamente o seu desempenho. Impõe-se uma precisão: o Copyleaks surge nesse artigo apenas na revisão de estudos anteriores e não entre as 14 ferramentas testadas pelos autores, pelo que se trata de evidência sobre a categoria e não de medição direta deste produto.
Cuidado com a fórmula «estudo de Cornell». A afirmação de que um estudo da Universidade de Cornell apontou o Copyleaks como o detetor mais exato circula largamente, mas o arXiv é uma plataforma de pré-publicações operada pela Cornell Tech, pelo que publicar ali não constitui resultado nem aval da Universidade de Cornell. As pré-publicações também não passaram necessariamente por revisão por pares. Em qualquer detetor, verifique quem conduziu o estudo citado, sobre que conjunto de testes e se foi revisto.
Os falsos positivos atingem com mais força quem não tem o inglês como língua materna. Segundo uma investigação do The Markup, sete detetores assinalaram como gerados por IA os textos de falantes não nativos em 61 % dos casos, e em cerca de 20 % dos trabalhos esse erro foi unânime, ao passo que na escrita de nativos quase nunca ocorria a mesma falha. O mecanismo é simples: os detetores premeiam a imprevisibilidade linguística, e quem escreve numa segunda língua produz muitas vezes a prosa formal e pouco variada que a sua formação premiou. Qualquer instituição que implemente deteção sem ter isto em conta está a construir um processo discriminatório, seja qual for o fornecedor escolhido.
A opinião dos utilizadores é má e concentra-se exatamente neste ponto. O Trustpilot mostra 2,6 em 5 com 344 avaliações, das quais 49 % de uma estrela, e a empresa ocupa o 80.º lugar entre 85 na categoria Software Vendor. A queixa dominante é a de trabalhos escritos por pessoas pontuados como gerados por IA, apresentada, entre outros, por avaliadores que se descrevem como militar reformado e como estudantes de pós-graduação. Uma ressalva de leitura: as plataformas de avaliações selecionam quem se sente lesado, e alguém assinalado por erro tem muito mais motivo para escrever do que alguém cuja análise confirmou o esperado. A pontuação deve ler-se como evidência sobre a forma da falha e não como medida da precisão global.
A posição do próprio fornecedor é mais contida do que a sua publicidade. Nas respostas públicas a empresa reconhece que escrita humana muito formulaica pode ocasionalmente imitar padrões de IA e aconselha tratar a pontuação de IA como indicador forte, deixando o juízo humano como decisão final. O conselho é sensato, e vale a pena exigir que a publicidade se lhe ajuste.
Interferências conhecidas e restrições operacionais. Auxiliares de escrita comuns podem provocar marcas, os mínimos de comprimento tornam instáveis as passagens curtas, e diferenças de configuração produzem pontuações distintas para o mesmo documento: há utilizadores que descrevem repetidamente o mesmo texto a pontuar de forma diferente do lado do estudante e do docente, algo que a empresa atribui a definições de análise distintas.
A empresa anuncia mais de 99 % de precisão e 0,03 % de falsos positivos, mas esse número provém de testes internos com dados em inglês, como indica a nota do seu próprio site. A investigação independente com revisão por pares sobre a categoria conclui que as ferramentas de deteção em geral não são exatas nem fiáveis. A resposta honesta é que tem um desempenho comparativamente bom dentro de uma classe de ferramentas cuja fiabilidade de fundo está em disputa, e que nenhum detetor atual justifica tratar o seu resultado como prova.
As contas novas recebem um plafond limitado de créditos gratuitos, suficiente para avaliar o produto com documentos reais. O uso continuado exige um plano pago: Personal a 16,99 $ por mês ou 13,99 $ com faturação anual, e Pro a 99,99 $ ou 74,99 $ respetivamente.
Em texto sim: ambos surgem num único relatório. Em imagens não: a análise de imagem deteta apenas presença de IA e não faz comparação de plágio.
A deteção de IA cobre mais de 30 idiomas e a de plágio mais de 100. A precisão publicada por idioma é mais alta em inglês e desce de forma mensurável nos restantes, pelo que os resultados noutros idiomas merecem cautela acrescida.
É possível. O Copyleaks refere diretamente que plataformas como o Grammarly usam ChatGPT e outros modelos generativos em algumas funções e que essa saída pode ser assinalada como conteúdo potencialmente gerado por IA. As correções básicas de ortografia e gramática não deverão ativar marcas, mas as funções de reescrita generativa podem.
Sim, através de conetores nativos para Canvas, Moodle, D2L Brightspace, Blackboard, Schoology, Edsby e Sakai. A integração com LMS só está disponível nos planos Education e Enterprise, não nas subscrições individuais.
Pode subir de plano ou comprar créditos avulsos adicionais. Tenha presente que os planos não se acumulam — mudar de plano sobrepõe-se ao atual e faz perder os créditos restantes —, pelo que uma subida a meio do ciclo pode custar-lhe o plafond não utilizado.
Abra o relatório em vez de ficar pela pontuação e observe que passagens foram assinaladas e para onde aponta o AI Source Match. Reúna provas do seu processo: histórico de rascunhos, versões, notas. Se está a ser avaliado por esse resultado, pergunte que configuração de análise foi usada, já que o mesmo documento pode pontuar de forma diferente com definições distintas. Quem não tem o inglês como língua materna deve saber que a investigação documentou um enviesamento substancial contra este grupo nos detetores em geral, e é um argumento legítimo a invocar.
A empresa declara possuir PCI DSS, SOC 2, SOC 3 e conformidade com o RGPD. Os clientes empresariais e de ensino podem escolher alojamento local ou em nuvem privada com opções de armazenamento regional, a via a seguir se a residência de dados for um requisito. Os planos individuais funcionam sobre o serviço alojado padrão.
Os reembolsos não são garantidos. A política publicada só os concede se forem pedidos nos primeiros 10 dias do ciclo de faturação e se nenhum crédito tiver sido usado, pelo que deve avaliar com os créditos gratuitos antes de subscrever e não depois.