Guias de deteção de IA

O detetor de IA do Grammarly é fiável?

O detetor de IA do Grammarly pode ter um desempenho muito forte em benchmarks padronizados, mas a pontuação não prova como um documento foi escrito. O Grammarly chama à percentagem uma estimativa média de quanto texto parece gerado por IA, afirma que a funcionalidade não é 100% precisa e nota que os trechos curtos são mais difíceis de medir. A evidência independente aponta no mesmo sentido: bom desempenho num grande benchmark partilhado, enquanto um estudo académico de 2025 registou percentagens muito abaixo das de outro detetor nas mesmas introduções escritas por IA. Uma pontuação do Grammarly é um sinal. Quando o resultado importa, compara o mesmo trecho com outro detetor e lê tu o texto marcado. O Detetor de IA do AI-2-Human dá-te essa segunda leitura.

AI-2-HumanPublicado 15 min de leitura
Uma amostra de texto ao lado do AI-2-Human num portátil e relatórios ilustrativos do Grammarly e do AI-2-Human com pontuações de IA diferentes.
Ilustração de uma segunda opinião: o mesmo trecho lido por dois detetores. As pontuações mostradas são ilustrativas, não resultados medidos num documento concreto.

O que é o detetor de IA do Grammarly?

O detetor de IA do Grammarly estima que parte de um texto parece gerada por IA. O Grammarly explica o mecanismo na sua documentação: o texto é dividido em secções, cada secção é comparada com um modelo de aprendizagem automática que procura padrões típicos de IA, como padrões de linguagem, sintaxe e complexidade, e depois devolve uma percentagem. O modelo é descrito como treinado com centenas de milhares de textos humanos e de IA.

A funcionalidade não é um site à parte que visitas uma vez. O Grammarly integra-a no produto: o agente AI Detector nas suas superfícies de escrita, a verificação de IA no Google Docs através da extensão e as aplicações de ambiente de trabalho para o Word, e é paga na maioria dos planos. Existe uma versão gratuita na página pública AI Detector, onde colas texto ou carregas um documento.

Grammarly: guia de utilizador do detetor de IA (em inglês)

Então, qual é a precisão do detetor de IA do Grammarly?

Não há uma percentagem única de precisão que descreva cada análise. O que se pode dizer é mais concreto: o detetor separa texto de IA de texto humano com muita fiabilidade em condições de benchmark, e a investigação independente mostra que as percentagens devolvidas podem ficar bem abaixo do nível real de envolvimento da IA.

As palavras do próprio Grammarly definem melhor as expectativas do que qualquer resumo externo. O guia de utilizador chama à pontuação uma estimativa média de quanto texto gerado por IA um documento contém provavelmente, diz que os testes garantiram que o modelo acerta na direção, nota que os trechos curtos são mais difíceis de medir e afirma que a funcionalidade não é 100% precisa e não deve ser usada como avaliação definitiva. Outro artigo acrescenta que nenhum detetor atual consegue determinar de forma conclusiva se houve uso de IA e que estas ferramentas são um dado, não a única fonte de prova.

Grammarly: o uso do Grammarly ativa detetores de IA? (em inglês)

  • Estilo de escrita: prosa formal e muito regular aproxima-se dos padrões que os detetores associam à máquina.
  • Comprimento do texto: trechos curtos são mais difíceis de medir do que longos, segundo o Grammarly.
  • Modelo gerador: cada modelo deixa rastos diferentes e os detetores são afinados para famílias concretas.
  • Edição humana: texto gerado e depois muito reescrito já não parece saída bruta de um modelo.
  • Autoria mista: juntar redação humana, ajuda de IA e revisão manual é o caso mais difícil.
  • Versão e dados: cada cifra publicada depende do género e do comprimento do material de teste.

O que significa de facto a percentagem de IA do Grammarly?

Uma pontuação de 40% não significa que o Grammarly tenha estabelecido que exatamente 40% do documento foi escrito por IA. Significa que o modelo encontrou padrões que fazem essa parte do texto parecer escrita por IA. O Grammarly usa de propósito as palavras estimativa e média e repete a ressalva: a pontuação é uma estimativa média e não uma avaliação percentual definitiva, nem uma fonte objetiva de verdade, porque qualquer deteção de IA pode errar.

O desenho por secções explica parte dessa ambiguidade. Analisar por secções mostra que partes provocaram o resultado, mas uma única percentagem comprime vários juízos locais num só número: um documento com três parágrafos formulaicos e quatro pessoais pode ficar numa pontuação intermédia que não descreve bem nenhuma das metades.

O que o benchmark RAID diz sobre o Grammarly

O RAID é um benchmark partilhado criado para avaliar detetores em condições comuns: mais de 10 milhões de documentos com 11 modelos de linguagem, 11 géneros, quatro estratégias de descodificação e ataques adversariais como paráfrase, troca de sinónimos e homoglifos. Todos os detetores participantes são pontuados com o mesmo material e o mesmo script, o que faz dele a comparação pública mais justa disponível e a mais difícil de transformar numa promessa sobre um ensaio concreto.

RAID: um benchmark partilhado para a avaliação robusta de detetores de texto gerado por máquina (em inglês)

O Grammarly anuncia o seu desempenho nesse benchmark diretamente. A página de produto do detetor afirma que o produto alcança 99% de precisão de deteção e ocupa o primeiro lugar no benchmark independente do RAID, à frente de outros detetores líderes. É uma afirmação do fornecedor, publicada pela empresa cujo detetor descreve, e deve ser lida como tal.

Grammarly: página de produto do detetor de IA (em inglês)

A classificação em si é mais precisa. A fotografia citada aqui foi recolhida em 20 de setembro de 2026 e a entrada do Grammarly está datada de 9 de fevereiro de 2026. As entradas são enviadas pelos programadores dos detetores e pontuadas com o script do benchmark, por isso as condições são partilhadas mas o envio vem do fornecedor. Nessa fotografia o Grammarly declara um AUROC de 0,9987 em todas as condições do RAID, incluindo ataques adversariais, com 99,47% de precisão numa taxa alvo de falsos positivos de 5% e 98,21% com 1%. Na parte não adversarial, a mesma entrada declara um AUROC de 0,99972 e 99,91% de precisão com alvo de 5%.

Os nomes das métricas importam. O AUROC mede quão bem um detetor separa as duas classes em todos os limiares, em que 1,0 é perfeito, e não é uma percentagem de decisões corretas. A precisão do RAID é medida num ponto de funcionamento fixo, o limiar em que apenas 5% ou 1% dos textos humanos são marcados por erro.

O que diz a investigação independente sobre o Grammarly

O resultado independente mais útil vem de um estudo revisto por pares publicado na Advances in Simulation em 2025. Os investigadores pegaram em 30 artigos de acesso aberto publicados antes de 2022 em duas revistas de simulação em saúde, extraíram as introduções e produziram cinco versões de cada: o original humano, uma versão humana com edição ligeira de IA, uma com edição intensa, uma gerada a partir de pontos-chave humanos e uma escrita inteiramente a partir do título. Três detetores gratuitos (ZeroGPT, Phrasly AI e Grammarly) e cinco avaliadores humanos cegos pontuaram o mesmo material.

O Grammarly distinguiu as cinco condições no conjunto, com efeito estatisticamente significativo e um tamanho de efeito de 0,75, mas as percentagens absolutas ficaram muito abaixo do nível de envolvimento da IA. Nessas introduções, a média foi de 1,6% no texto humano intacto (intervalo de confiança de 95%: 0,0 a 3,1), 3,0% com edição ligeira, 11,5% com edição intensa, 62,5% em texto gerado a partir de pontos-chave e 50,0% em texto escrito inteiramente por IA a partir do título. O ZeroGPT ficou em 6,5%, 20,2%, 43,1%, 89,9% e 92,5%.

Advances in Simulation: capacidade das ferramentas de deteção de IA e dos humanos para identificar conteúdo gerado por IA (2025, em inglês)

Daí saem duas conclusões opostas. A animadora é que a ordem do Grammarly estava correta: as pontuações subiam com o envolvimento da IA e foi o menos propenso dos três a marcar texto humano intacto. A cautelosa é que um documento escrito inteiramente por um modelo voltou com 50% de média, longe do que um leitor chamaria escrito por máquina.

O estudo mediu também a concordância entre ferramentas. ZeroGPT e Phrasly coincidiam muito bem, com 0,96. A do Grammarly com o ZeroGPT era apenas moderada, 0,60, com um enviesamento de 24,7 pontos: o ZeroGPT devolvia sistematicamente percentagens mais altas no mesmo material, e Phrasly contra Grammarly ficou em 0,57. Os avaliadores humanos não fizeram melhor: a precisão global foi de 19%.

O Grammarly pode marcar escrita humana como IA?

Sim. Um falso positivo é texto realmente humano que um detetor lê como gerado ou assistido por IA, e o Grammarly reconhece o caso em vez de o descartar. A documentação afirma que o modelo está otimizado para minimizar falsos positivos, que pode haver casos em que padrões, sintaxe e complexidade humanos se pareçam mais com escrita de IA e que espera que sejam muito raros. Depois dá o mesmo conselho desta guia: lê o resultado em contexto, não como fonte objetiva de verdade.

As condições que elevam o risco são descritas de forma consistente na literatura, e são propriedades da escrita mais do que uma lista publicada pelo Grammarly. Registo muito formal, estrutura de frases repetitiva, transições previsíveis, pouca variação lexical, amostras muito curtas, géneros distantes dos dados de treino e inglês como língua adicional aproximam-se mais da fronteira. Nenhuma é prova de uso de IA, e várias resultam de escrita cuidada.

O Grammarly pode deixar passar texto gerado por IA?

Sim, e o estudo de 2025 é o exemplo público mais concreto: o texto escrito inteiramente por IA a partir do título promediou 50,0% no Grammarly, enquanto o mesmo material promediava mais de 92% nas outras duas ferramentas. Esse resultado não é uma taxa de falha, porque descreve 30 introduções de uma disciplina, com uma família de modelos e num momento. Mostra a forma do problema: um detetor afinado para evitar falsos positivos deixa passar parte do texto de máquina.

A documentação explica porque uma reescrita pode escapar. O modelo é treinado com texto humano e texto gerado por IA de fornecedores de modelos, e as sugestões de gramática ou clareza normalmente não mudam a percentagem, enquanto uma reescrita significativa com um modelo generativo a aumenta. Texto gerado e depois editado à mão fica entre os dois casos, tal como um passaje escrito por uma pessoa e muito reescrito por um assistente, a autoria mista que nenhum detetor resolve bem. Modelos novos tornam o problema maior, porque os detetores são treinados contra as saídas que existiam quando o modelo foi criado.

Porque os resultados do Grammarly podem variar

Quando duas pessoas passam o mesmo texto pela mesma ferramenta e obtêm números diferentes, ou quando duas ferramentas discordam sobre o mesmo documento, a explicação está normalmente nas condições.

  • Versão do detetor: o Grammarly atualiza o modelo de forma contínua, por isso os resultados mudam com o produto.
  • Comprimento e granularidade: o texto é analisado por secções, um documento curto assenta em menos decisões locais.
  • Histórico de edição: correções de gramática ou clareza deixam a pontuação igual; a reescrita generativa aumenta-a.
  • Limiar e comparação: onde um detetor traça a linha importa, e o Grammarly diz que as suas pontuações diferem das do Turnitin, GPTZero ou Copyleaks.

Uma percentagem só é interpretável ao lado de uma descrição do texto. Duas frases coladas de um parágrafo, um ensaio escrito de uma vez e um relatório montado em três semanas com um assistente são três medições distintas, mesmo que a ferramenta mostre o mesmo estilo de pontuação.

O comprimento do texto influencia a pontuação do Grammarly?

O Grammarly di-lo diretamente: os trechos curtos são mais difíceis de medir do que os longos. É sensato, porque um detetor que analisa por secções tem menos secções com que trabalhar quando lhe dás duas frases, por isso o seu juízo assenta em menos material.

A regra prática é a proporção. Uma percentagem alta num documento completo, onde os padrões se repetem em vários parágrafos, merece mais atenção do que uma alta numa só frase. Se analisas algo curto, trata o resultado como provisório.

A edição ou a paráfrase mudam a pontuação do Grammarly?

O Grammarly traça uma linha dentro da edição e é útil. As correções tradicionais não generativas, como sugestões de gramática, clareza, escolha de palavras e concisão, normalmente não afetam a percentagem de IA, porque não mudam os padrões de linguagem subjacentes. Reescrever frases ou parágrafos inteiros com um assistente generativo é outra operação: o Grammarly afirma que uma reescrita significativa com o seu agente, assistente generativo ou parafraseador aumenta a pontuação, e que texto de um fornecedor externo tem ainda mais probabilidade de receber uma percentagem mais alta.

A empresa aplica essa lógica às próprias ferramentas, e é invulgar tanta franqueza. A documentação avisa que reescrever conteúdo com os seus agentes de reformulação ou humanização provavelmente fará com que o resultado seja marcado como gerado por IA, porque essas reescritas saem do seu próprio modelo, e sugere usar os agentes para comentários que apliques à mão se te preocupar ser marcado. Se estás a ler a pontuação de outra pessoa, o mesmo facto importa ao contrário: texto que passou por um parafraseador é mais difícil de interpretar, e uma percentagem baixa não prova que não houve assistente.

Detetor de IA do Grammarly ou Authorship?

O Grammarly inclui duas ideias distintas com nomes parecidos, e confundi-las é a forma mais rápida de interpretar mal um resultado. A deteção de IA examina o texto final e estima que parte se parece com escrita gerada por IA. O Authorship regista como o documento foi criado e classifica o texto à medida que entra: escrito diretamente, colado de uma fonte do navegador, colado de uma fonte desconhecida como uma janela privada, gerado por IA, ou escrito e depois reformulado com IA a pedido.

Grammarly: apresentação do Authorship (em inglês)

O Authorship funciona no Google Docs através da extensão e no Word através da aplicação de ambiente de trabalho, e produz relatórios partilháveis que podem incluir verificações de IA e de plágio nos planos superiores. A distinção que importa é simples: um detetor lê o texto e estima, um registo de autoria descreve o processo que o produziu.

Como interpretar uma pontuação do Grammarly

Antes de agires a partir de uma percentagem, percorre estas perguntas: são a diferença entre ler um sinal e tratar um número como veredicto.

  • Quanto texto foi analisado: um documento completo ou um extrato curto?
  • O passaje está muito editado, assistido por IA ou é uma mistura?
  • Que secções foram marcadas e partilham algum padrão?
  • A escrita lê-se como repetitiva ou formulaica?
  • Um segundo detetor devolve uma leitura parecida?
  • Há rascunhos, histórico de versões ou um relatório de Authorship?

O que uma pontuação do Grammarly não pode estabelecer por si só convém dizer com clareza. Não diz quem escreveu um documento, se o uso de IA quebrou uma política, se houve plágio nem se alguém é honesto. O Grammarly admite-o, ao descrever a deteção como um dado e não como a única fonte de prova.

O que fazer se o Grammarly marcar o teu texto

Aborda a situação numa ordem fixa em vez de reescrever por reflexo. É a mesma sequência que esta guia recomenda para qualquer detetor.

Uma sequência de revisão que podes repetir
  1. 1

    Lê o passaje marcado

    Julga-o primeiro como escrita: lê-se mesmo como repetitivo ou formulaico?

  2. 2

    Verifica o tamanho da amostra

    A pontuação saiu de um documento completo ou de duas frases?

  3. 3

    Compara com um segundo detetor

    Passa o mesmo texto por outra ferramenta e vê se as leituras coincidem.

  4. 4

    Reúne provas do processo

    Procura rascunhos, histórico de versões ou um relatório de Authorship.

  5. 5

    Revê o que precisa

    Reescreve só os passajes que precisam e verifica as citações em separado.

Por vezes a preocupação é justa. Frases com a mesma forma, transições que não ligam nada e parágrafos que enumeram afirmações sem provas merecem ser corrigidos, com ou sem marcação. Quando um passaje é realmente mecânico, o humanizador do AI-2-Human reescreve-o numa versão mais natural sem perder o teu sentido.

Deves comparar o Grammarly com outro detetor de IA?

Sim, e aqui a recomendação vem também do fornecedor. A documentação afirma que a deteção usa um modelo próprio, que as pontuações podem diferir de outras soluções como Turnitin, GPTZero ou Copyleaks e que a sua pontuação não deve ser lida como indicação clara de que outro detetor dirá o mesmo. O estudo independente mediu o mesmo efeito: 0,60 de concordância entre Grammarly e ZeroGPT em textos idênticos, com cerca de 25 pontos de diferença.

A comparação ajuda nas duas direções. Quando dois detetores marcam o mesmo passaje, merece uma leitura atenta. Quando divergem claramente, a divergência diz que o texto está perto de uma fronteira de decisão e que a percentagem é mole, o que convém saber antes de reescrever ou de outra pessoa agir.

O Detetor do AI-2-Human lê o mesmo passaje com o seu modelo e assinala as secções que ainda parecem geradas, para pôr duas interpretações lado a lado. É uma segunda opinião, não um recurso a uma autoridade superior: dá-te mais elementos antes de decidires o que mudar.

Antes de entregar: uma lista de verificação prática

  • Entendo que a percentagem do Grammarly é uma estimativa e não uma medição.
  • Verifiquei se foi analisado texto suficiente antes de ler a pontuação.
  • Li os passajes que provocaram a marca em vez de só o número principal.
  • Considerei se o texto é escrito por humanos, assistido por IA ou uma mistura.
  • Comparei com outro detetor quando o resultado importa mesmo.
  • Procurei rascunhos, histórico de versões ou um relatório de Authorship.
  • Verifiquei citações e factos em separado da deteção de IA.
  • Revisei apenas os passajes que precisavam mesmo de melhoria.

Perguntas frequentes

Fontes e notas editoriais

O AI-2-Human não é afiliado nem apoiado pelo Grammarly. A documentação de produto do Grammarly, a informação de benchmarks e a investigação citada foram consultadas em 20 de setembro de 2026. Os modelos de deteção e as classificações de benchmark mudam com o tempo, por isso confirma a documentação atual do Grammarly e a classificação do RAID antes de confiar em qualquer cifra aqui citada.

Atualizado

Precisas de uma segunda opinião?

Compara a tua pontuação de IA do Grammarly com outro detetor.

Passa o mesmo trecho pelo AI-2-Human, revê outro sinal de deteção e decide se o texto precisa mesmo de revisão.

Ver todos os guias