Guias de deteção de IA
O detetor de IA do Grammarly é fiável?
O detetor de IA do Grammarly pode ter um desempenho muito forte em benchmarks padronizados, mas a pontuação não prova como um documento foi escrito. O Grammarly chama à percentagem uma estimativa média de quanto texto parece gerado por IA, afirma que a funcionalidade não é 100% precisa e nota que os trechos curtos são mais difíceis de medir. A evidência independente aponta no mesmo sentido: bom desempenho num grande benchmark partilhado, enquanto um estudo académico de 2025 registou percentagens muito abaixo das de outro detetor nas mesmas introduções escritas por IA. Uma pontuação do Grammarly é um sinal. Quando o resultado importa, compara o mesmo trecho com outro detetor e lê tu o texto marcado. O Detetor de IA do AI-2-Human dá-te essa segunda leitura.

O que é o detetor de IA do Grammarly?
O detetor de IA do Grammarly estima que parte de um texto parece gerada por IA. O Grammarly explica o mecanismo na sua documentação: o texto é dividido em secções, cada secção é comparada com um modelo de aprendizagem automática que procura padrões típicos de IA, como padrões de linguagem, sintaxe e complexidade, e depois devolve uma percentagem. O modelo é descrito como treinado com centenas de milhares de textos humanos e de IA.
A funcionalidade não é um site à parte que visitas uma vez. O Grammarly integra-a no produto: o agente AI Detector nas suas superfícies de escrita, a verificação de IA no Google Docs através da extensão e as aplicações de ambiente de trabalho para o Word, e é paga na maioria dos planos. Existe uma versão gratuita na página pública AI Detector, onde colas texto ou carregas um documento.
Então, qual é a precisão do detetor de IA do Grammarly?
Não há uma percentagem única de precisão que descreva cada análise. O que se pode dizer é mais concreto: o detetor separa texto de IA de texto humano com muita fiabilidade em condições de benchmark, e a investigação independente mostra que as percentagens devolvidas podem ficar bem abaixo do nível real de envolvimento da IA.
As palavras do próprio Grammarly definem melhor as expectativas do que qualquer resumo externo. O guia de utilizador chama à pontuação uma estimativa média de quanto texto gerado por IA um documento contém provavelmente, diz que os testes garantiram que o modelo acerta na direção, nota que os trechos curtos são mais difíceis de medir e afirma que a funcionalidade não é 100% precisa e não deve ser usada como avaliação definitiva. Outro artigo acrescenta que nenhum detetor atual consegue determinar de forma conclusiva se houve uso de IA e que estas ferramentas são um dado, não a única fonte de prova.
Grammarly: o uso do Grammarly ativa detetores de IA? (em inglês)
- Estilo de escrita: prosa formal e muito regular aproxima-se dos padrões que os detetores associam à máquina.
- Comprimento do texto: trechos curtos são mais difíceis de medir do que longos, segundo o Grammarly.
- Modelo gerador: cada modelo deixa rastos diferentes e os detetores são afinados para famílias concretas.
- Edição humana: texto gerado e depois muito reescrito já não parece saída bruta de um modelo.
- Autoria mista: juntar redação humana, ajuda de IA e revisão manual é o caso mais difícil.
- Versão e dados: cada cifra publicada depende do género e do comprimento do material de teste.
O que significa de facto a percentagem de IA do Grammarly?
Uma pontuação de 40% não significa que o Grammarly tenha estabelecido que exatamente 40% do documento foi escrito por IA. Significa que o modelo encontrou padrões que fazem essa parte do texto parecer escrita por IA. O Grammarly usa de propósito as palavras estimativa e média e repete a ressalva: a pontuação é uma estimativa média e não uma avaliação percentual definitiva, nem uma fonte objetiva de verdade, porque qualquer deteção de IA pode errar.
O desenho por secções explica parte dessa ambiguidade. Analisar por secções mostra que partes provocaram o resultado, mas uma única percentagem comprime vários juízos locais num só número: um documento com três parágrafos formulaicos e quatro pessoais pode ficar numa pontuação intermédia que não descreve bem nenhuma das metades.
O que o benchmark RAID diz sobre o Grammarly
O RAID é um benchmark partilhado criado para avaliar detetores em condições comuns: mais de 10 milhões de documentos com 11 modelos de linguagem, 11 géneros, quatro estratégias de descodificação e ataques adversariais como paráfrase, troca de sinónimos e homoglifos. Todos os detetores participantes são pontuados com o mesmo material e o mesmo script, o que faz dele a comparação pública mais justa disponível e a mais difícil de transformar numa promessa sobre um ensaio concreto.
O Grammarly anuncia o seu desempenho nesse benchmark diretamente. A página de produto do detetor afirma que o produto alcança 99% de precisão de deteção e ocupa o primeiro lugar no benchmark independente do RAID, à frente de outros detetores líderes. É uma afirmação do fornecedor, publicada pela empresa cujo detetor descreve, e deve ser lida como tal.
Grammarly: página de produto do detetor de IA (em inglês)
A classificação em si é mais precisa. A fotografia citada aqui foi recolhida em 20 de setembro de 2026 e a entrada do Grammarly está datada de 9 de fevereiro de 2026. As entradas são enviadas pelos programadores dos detetores e pontuadas com o script do benchmark, por isso as condições são partilhadas mas o envio vem do fornecedor. Nessa fotografia o Grammarly declara um AUROC de 0,9987 em todas as condições do RAID, incluindo ataques adversariais, com 99,47% de precisão numa taxa alvo de falsos positivos de 5% e 98,21% com 1%. Na parte não adversarial, a mesma entrada declara um AUROC de 0,99972 e 99,91% de precisão com alvo de 5%.
Os nomes das métricas importam. O AUROC mede quão bem um detetor separa as duas classes em todos os limiares, em que 1,0 é perfeito, e não é uma percentagem de decisões corretas. A precisão do RAID é medida num ponto de funcionamento fixo, o limiar em que apenas 5% ou 1% dos textos humanos são marcados por erro.
O que diz a investigação independente sobre o Grammarly
O resultado independente mais útil vem de um estudo revisto por pares publicado na Advances in Simulation em 2025. Os investigadores pegaram em 30 artigos de acesso aberto publicados antes de 2022 em duas revistas de simulação em saúde, extraíram as introduções e produziram cinco versões de cada: o original humano, uma versão humana com edição ligeira de IA, uma com edição intensa, uma gerada a partir de pontos-chave humanos e uma escrita inteiramente a partir do título. Três detetores gratuitos (ZeroGPT, Phrasly AI e Grammarly) e cinco avaliadores humanos cegos pontuaram o mesmo material.
O Grammarly distinguiu as cinco condições no conjunto, com efeito estatisticamente significativo e um tamanho de efeito de 0,75, mas as percentagens absolutas ficaram muito abaixo do nível de envolvimento da IA. Nessas introduções, a média foi de 1,6% no texto humano intacto (intervalo de confiança de 95%: 0,0 a 3,1), 3,0% com edição ligeira, 11,5% com edição intensa, 62,5% em texto gerado a partir de pontos-chave e 50,0% em texto escrito inteiramente por IA a partir do título. O ZeroGPT ficou em 6,5%, 20,2%, 43,1%, 89,9% e 92,5%.
Daí saem duas conclusões opostas. A animadora é que a ordem do Grammarly estava correta: as pontuações subiam com o envolvimento da IA e foi o menos propenso dos três a marcar texto humano intacto. A cautelosa é que um documento escrito inteiramente por um modelo voltou com 50% de média, longe do que um leitor chamaria escrito por máquina.
O estudo mediu também a concordância entre ferramentas. ZeroGPT e Phrasly coincidiam muito bem, com 0,96. A do Grammarly com o ZeroGPT era apenas moderada, 0,60, com um enviesamento de 24,7 pontos: o ZeroGPT devolvia sistematicamente percentagens mais altas no mesmo material, e Phrasly contra Grammarly ficou em 0,57. Os avaliadores humanos não fizeram melhor: a precisão global foi de 19%.
O Grammarly pode marcar escrita humana como IA?
Sim. Um falso positivo é texto realmente humano que um detetor lê como gerado ou assistido por IA, e o Grammarly reconhece o caso em vez de o descartar. A documentação afirma que o modelo está otimizado para minimizar falsos positivos, que pode haver casos em que padrões, sintaxe e complexidade humanos se pareçam mais com escrita de IA e que espera que sejam muito raros. Depois dá o mesmo conselho desta guia: lê o resultado em contexto, não como fonte objetiva de verdade.
As condições que elevam o risco são descritas de forma consistente na literatura, e são propriedades da escrita mais do que uma lista publicada pelo Grammarly. Registo muito formal, estrutura de frases repetitiva, transições previsíveis, pouca variação lexical, amostras muito curtas, géneros distantes dos dados de treino e inglês como língua adicional aproximam-se mais da fronteira. Nenhuma é prova de uso de IA, e várias resultam de escrita cuidada.
O Grammarly pode deixar passar texto gerado por IA?
Sim, e o estudo de 2025 é o exemplo público mais concreto: o texto escrito inteiramente por IA a partir do título promediou 50,0% no Grammarly, enquanto o mesmo material promediava mais de 92% nas outras duas ferramentas. Esse resultado não é uma taxa de falha, porque descreve 30 introduções de uma disciplina, com uma família de modelos e num momento. Mostra a forma do problema: um detetor afinado para evitar falsos positivos deixa passar parte do texto de máquina.
A documentação explica porque uma reescrita pode escapar. O modelo é treinado com texto humano e texto gerado por IA de fornecedores de modelos, e as sugestões de gramática ou clareza normalmente não mudam a percentagem, enquanto uma reescrita significativa com um modelo generativo a aumenta. Texto gerado e depois editado à mão fica entre os dois casos, tal como um passaje escrito por uma pessoa e muito reescrito por um assistente, a autoria mista que nenhum detetor resolve bem. Modelos novos tornam o problema maior, porque os detetores são treinados contra as saídas que existiam quando o modelo foi criado.
Porque os resultados do Grammarly podem variar
Quando duas pessoas passam o mesmo texto pela mesma ferramenta e obtêm números diferentes, ou quando duas ferramentas discordam sobre o mesmo documento, a explicação está normalmente nas condições.
- Versão do detetor: o Grammarly atualiza o modelo de forma contínua, por isso os resultados mudam com o produto.
- Comprimento e granularidade: o texto é analisado por secções, um documento curto assenta em menos decisões locais.
- Histórico de edição: correções de gramática ou clareza deixam a pontuação igual; a reescrita generativa aumenta-a.
- Limiar e comparação: onde um detetor traça a linha importa, e o Grammarly diz que as suas pontuações diferem das do Turnitin, GPTZero ou Copyleaks.
Uma percentagem só é interpretável ao lado de uma descrição do texto. Duas frases coladas de um parágrafo, um ensaio escrito de uma vez e um relatório montado em três semanas com um assistente são três medições distintas, mesmo que a ferramenta mostre o mesmo estilo de pontuação.
O comprimento do texto influencia a pontuação do Grammarly?
O Grammarly di-lo diretamente: os trechos curtos são mais difíceis de medir do que os longos. É sensato, porque um detetor que analisa por secções tem menos secções com que trabalhar quando lhe dás duas frases, por isso o seu juízo assenta em menos material.
A regra prática é a proporção. Uma percentagem alta num documento completo, onde os padrões se repetem em vários parágrafos, merece mais atenção do que uma alta numa só frase. Se analisas algo curto, trata o resultado como provisório.
A edição ou a paráfrase mudam a pontuação do Grammarly?
O Grammarly traça uma linha dentro da edição e é útil. As correções tradicionais não generativas, como sugestões de gramática, clareza, escolha de palavras e concisão, normalmente não afetam a percentagem de IA, porque não mudam os padrões de linguagem subjacentes. Reescrever frases ou parágrafos inteiros com um assistente generativo é outra operação: o Grammarly afirma que uma reescrita significativa com o seu agente, assistente generativo ou parafraseador aumenta a pontuação, e que texto de um fornecedor externo tem ainda mais probabilidade de receber uma percentagem mais alta.
A empresa aplica essa lógica às próprias ferramentas, e é invulgar tanta franqueza. A documentação avisa que reescrever conteúdo com os seus agentes de reformulação ou humanização provavelmente fará com que o resultado seja marcado como gerado por IA, porque essas reescritas saem do seu próprio modelo, e sugere usar os agentes para comentários que apliques à mão se te preocupar ser marcado. Se estás a ler a pontuação de outra pessoa, o mesmo facto importa ao contrário: texto que passou por um parafraseador é mais difícil de interpretar, e uma percentagem baixa não prova que não houve assistente.
Detetor de IA do Grammarly ou Authorship?
O Grammarly inclui duas ideias distintas com nomes parecidos, e confundi-las é a forma mais rápida de interpretar mal um resultado. A deteção de IA examina o texto final e estima que parte se parece com escrita gerada por IA. O Authorship regista como o documento foi criado e classifica o texto à medida que entra: escrito diretamente, colado de uma fonte do navegador, colado de uma fonte desconhecida como uma janela privada, gerado por IA, ou escrito e depois reformulado com IA a pedido.
Grammarly: apresentação do Authorship (em inglês)
O Authorship funciona no Google Docs através da extensão e no Word através da aplicação de ambiente de trabalho, e produz relatórios partilháveis que podem incluir verificações de IA e de plágio nos planos superiores. A distinção que importa é simples: um detetor lê o texto e estima, um registo de autoria descreve o processo que o produziu.
Como interpretar uma pontuação do Grammarly
Antes de agires a partir de uma percentagem, percorre estas perguntas: são a diferença entre ler um sinal e tratar um número como veredicto.
- Quanto texto foi analisado: um documento completo ou um extrato curto?
- O passaje está muito editado, assistido por IA ou é uma mistura?
- Que secções foram marcadas e partilham algum padrão?
- A escrita lê-se como repetitiva ou formulaica?
- Um segundo detetor devolve uma leitura parecida?
- Há rascunhos, histórico de versões ou um relatório de Authorship?
O que uma pontuação do Grammarly não pode estabelecer por si só convém dizer com clareza. Não diz quem escreveu um documento, se o uso de IA quebrou uma política, se houve plágio nem se alguém é honesto. O Grammarly admite-o, ao descrever a deteção como um dado e não como a única fonte de prova.
O que fazer se o Grammarly marcar o teu texto
Aborda a situação numa ordem fixa em vez de reescrever por reflexo. É a mesma sequência que esta guia recomenda para qualquer detetor.
- 1
Lê o passaje marcado
Julga-o primeiro como escrita: lê-se mesmo como repetitivo ou formulaico?
- 2
Verifica o tamanho da amostra
A pontuação saiu de um documento completo ou de duas frases?
- 3
Compara com um segundo detetor
Passa o mesmo texto por outra ferramenta e vê se as leituras coincidem.
- 4
Reúne provas do processo
Procura rascunhos, histórico de versões ou um relatório de Authorship.
- 5
Revê o que precisa
Reescreve só os passajes que precisam e verifica as citações em separado.
Por vezes a preocupação é justa. Frases com a mesma forma, transições que não ligam nada e parágrafos que enumeram afirmações sem provas merecem ser corrigidos, com ou sem marcação. Quando um passaje é realmente mecânico, o humanizador do AI-2-Human reescreve-o numa versão mais natural sem perder o teu sentido.
Deves comparar o Grammarly com outro detetor de IA?
Sim, e aqui a recomendação vem também do fornecedor. A documentação afirma que a deteção usa um modelo próprio, que as pontuações podem diferir de outras soluções como Turnitin, GPTZero ou Copyleaks e que a sua pontuação não deve ser lida como indicação clara de que outro detetor dirá o mesmo. O estudo independente mediu o mesmo efeito: 0,60 de concordância entre Grammarly e ZeroGPT em textos idênticos, com cerca de 25 pontos de diferença.
A comparação ajuda nas duas direções. Quando dois detetores marcam o mesmo passaje, merece uma leitura atenta. Quando divergem claramente, a divergência diz que o texto está perto de uma fronteira de decisão e que a percentagem é mole, o que convém saber antes de reescrever ou de outra pessoa agir.
O Detetor do AI-2-Human lê o mesmo passaje com o seu modelo e assinala as secções que ainda parecem geradas, para pôr duas interpretações lado a lado. É uma segunda opinião, não um recurso a uma autoridade superior: dá-te mais elementos antes de decidires o que mudar.
Antes de entregar: uma lista de verificação prática
- Entendo que a percentagem do Grammarly é uma estimativa e não uma medição.
- Verifiquei se foi analisado texto suficiente antes de ler a pontuação.
- Li os passajes que provocaram a marca em vez de só o número principal.
- Considerei se o texto é escrito por humanos, assistido por IA ou uma mistura.
- Comparei com outro detetor quando o resultado importa mesmo.
- Procurei rascunhos, histórico de versões ou um relatório de Authorship.
- Verifiquei citações e factos em separado da deteção de IA.
- Revisei apenas os passajes que precisavam mesmo de melhoria.
Perguntas frequentes
O detetor de IA do Grammarly tem um bom desempenho em benchmarks padronizados: a sua entrada no RAID declara um AUROC de 0,9987 e 99,47% de precisão numa taxa alvo de falsos positivos de 5% na fotografia que consultámos. Nenhum detetor acerta em todos os textos. O Grammarly descreve a pontuação como estimativa e não como prova definitiva de uso de IA, e a investigação independente mostra que as percentagens devolvidas podem ficar bem abaixo do nível real de envolvimento da IA.
A resposta honesta é que depende do teste, e por isso as cifras publicadas diferem tanto. No RAID, um grande benchmark partilhado com ataques adversariais, a entrada do Grammarly declara um AUROC de 0,9987. Num estudo independente de 2025 com 30 introduções de artigos, o Grammarly ordenou corretamente as cinco condições de escrita mas promediou 50,0% em texto escrito inteiramente por IA, contra 92,5% do ZeroGPT no mesmo material.
É a estimativa média do Grammarly de quanto do texto analisado parece gerado por IA. O Grammarly divide o documento em secções, verifica cada uma em busca de padrões típicos de IA como padrões de linguagem, sintaxe e complexidade, e devolve uma percentagem. Uma pontuação de 40% não significa que 40% do documento esteja provado como escrito por máquina.
Não, e o Grammarly di-lo na sua documentação. Afirma que a funcionalidade não é 100% precisa, que não deve ser usada como avaliação definitiva da presença de texto gerado por IA e que a percentagem não deve ser tratada como fonte objetiva de verdade, porque qualquer deteção de IA pode errar.
Sim. O Grammarly reconhece a possibilidade e diz que esses casos devem ser muito raros, embora note que padrões, sintaxe e complexidade humanos podem aproximar-se da escrita de IA. Registo formal, estrutura repetitiva, amostras muito curtas e géneros pouco habituais são as situações mais prováveis, e uma marca não é prova de uso de IA.
Normalmente porque partes do texto partilham traços superficiais com a escrita de máquina, não porque tenha acontecido algo indevido. O Grammarly analisa por secções, uns parágrafos formulaicos sobem a pontuação, e os trechos curtos dão menos material ao modelo. Compara com outro detetor e lê tu as secções marcadas antes de mudar algo.
Verificar com o Detetor de IA →Sim. O estudo de 2025 na Advances in Simulation registou uma média de 50,0% para o Grammarly em introduções escritas inteiramente por IA a partir do título, muito abaixo dos outros detetores no mesmo texto. O Grammarly afirma também que o seu modelo está otimizado para minimizar falsos positivos, ou seja, é deliberadamente cauteloso a acusar escrita humana, e modelos cautelosos deixam passar mais escrita de máquina.
O Grammarly diz que o detetor identifica texto escrito ou modificado por modelos principais, incluindo ChatGPT, Claude e Gemini, e o benchmark RAID inclui várias famílias de modelos. Detetar uma família não é o mesmo que detetar todos os seus passajes: o estudo de 2025 encontrou introduções totalmente escritas por IA com cerca de 50% no Grammarly, e uma pontuação baixa não estabelece que não houve assistente.
Sim, e o Grammarly é explícito. A documentação afirma que uma reescrita significativa com um assistente generativo ou parafraseador aumenta a percentagem, que texto de um fornecedor externo como ChatGPT ou Gemini tem mais probabilidade de receber uma percentagem maior e que reescrever com os seus próprios agentes de reformulação ou humanização provavelmente também será marcado.
O Grammarly tem bom desempenho em material de benchmark que inclui prosa tipo ensaio, e os resultados no RAID são sólidos em vários géneros. Isso não se transfere automaticamente para um ensaio concreto. O próprio Grammarly avisa que os trechos curtos são mais difíceis de pontuar e o estudo independente encontrou percentagens absolutas muito abaixo do nível real de envolvimento da IA.
Sim. O Grammarly afirma no guia de utilizador que os trechos curtos são mais difíceis de medir com precisão do que os longos. Uma percentagem obtida de duas frases merece mais cautela do que uma obtida de um documento completo, onde os padrões se repetem em várias secções.
Depende do benchmark, da versão e da métrica, e um só conjunto de dados não decide. Na fotografia do RAID que consultámos, a entrada do Grammarly ficou acima da do GPTZero em AUROC em todas as condições. No estudo de 2025, o GPTZero foi excluído nos testes-piloto porque classificava frequentemente escrita totalmente humana como principalmente IA. Compara os dois com o teu próprio texto.
Comparar com o Detetor de IA →Sim, e é esperado, não sinal de que um esteja avariado. Modelos, dados de treino e limiares diferentes fazem com que o mesmo trecho seja lido de outra forma. O Grammarly diz que o seu modelo próprio produz pontuações diferentes das do Turnitin, GPTZero e Copyleaks, e o estudo de 2025 mediu apenas concordância moderada, um ICC de 0,60, entre Grammarly e ZeroGPT em textos idênticos.
Não por si só. O Grammarly aconselha tratar a saída do detetor como um dado e não como a única fonte de prova, e recomenda combinar deteção automática com revisão manual. Um processo viável junta a pontuação a provas do processo de escrita: rascunhos, histórico de versões, um relatório de Authorship, notas de fontes, trabalhos anteriores do mesmo aluno e uma conversa sobre o material.
A deteção de IA lê o texto final e estima que parte se parece com escrita de IA. O Authorship regista como o documento foi criado e classifica o texto como escrito, colado de uma fonte do navegador, colado de uma fonte desconhecida, gerado por IA ou escrito e depois reformulado com IA. A deteção é uma pontuação de parecença; o Authorship é prova sobre o processo de escrita.
Sim, sobretudo quando o resultado tem consequências. O próprio Grammarly diz que as suas pontuações podem diferir das de outros detetores e que a percentagem não deve ser lida como previsão do que outra ferramenta dirá. Uma segunda leitura mostra se o texto está perto de uma fronteira de decisão e dá-te mais passajes marcados para revisão.
Usar o Detetor de IA →Sim. Cola o mesmo trecho no Detetor do AI-2-Human e tens outra leitura do texto, com as secções que ainda parecem geradas assinaladas. Se as duas ferramentas apontarem para os mesmos passajes, merecem revisão atenta. Se divergirem, sabes que a pontuação é mole e decides com mais contexto.
Verificar o meu texto →Fontes e notas editoriais
- Grammarly: guia de utilizador do detetor de IA (em inglês)
- Grammarly: página de produto do detetor de IA (em inglês)
- Grammarly: o uso do Grammarly ativa detetores de IA? (em inglês)
- Grammarly: apresentação do Authorship (em inglês)
- RAID: um benchmark partilhado para a avaliação robusta de detetores de texto gerado por máquina (em inglês)
- Classificação do benchmark RAID (em inglês)
- Advances in Simulation: capacidade das ferramentas de deteção de IA e dos humanos para identificar conteúdo gerado por IA (2025, em inglês)
O AI-2-Human não é afiliado nem apoiado pelo Grammarly. A documentação de produto do Grammarly, a informação de benchmarks e a investigação citada foram consultadas em 20 de setembro de 2026. Os modelos de deteção e as classificações de benchmark mudam com o tempo, por isso confirma a documentação atual do Grammarly e a classificação do RAID antes de confiar em qualquer cifra aqui citada.
Atualizado


