Mixed e AI-Polished no GPTZero: o que cada rótulo quer dizer
O GPTZero mostra três porcentagens e esconde cinco classificações com nome a um clique abaixo delas. AI Polished é uma das duas que ficam sob Mixed. O GPTZero o define num painel na tela de resultados e o explica num post de junho de 2025 que está no site de notícias, e não na central de ajuda. Aqui está o conjunto inteiro, nas palavras do próprio GPTZero, e o que o número ao lado de cada um está realmente contando.
Equipe HumanPen
· 14 min de leitura
A resposta curta
O GPTZero imprime três porcentagens, sob o título "Chance this entire text is..." (a probabilidade de que este texto inteiro seja...): AI, Mixed e Human. Esse número é a confiança do modelo de que a classe é a correta, não a fatia do seu texto que está nela. O GPTZero diz isso na própria tela de resultados, numa linha abaixo dos chips. Basta você clicar em qualquer chip para ele se abrir em sub-leituras com nome, cinco no total entre os três, e "AI polished" é uma das duas sob Mixed. O GPTZero o define como "Human-written text that was refined or edited by an AI tool" (texto escrito por um humano e refinado ou editado por uma ferramenta de IA), acrescentando que, com este rótulo, "the core ideas and structure are the student's own work, but AI was used as an editing assistant" (as ideias centrais e a estrutura são trabalho próprio do estudante, mas a IA foi usada como assistente de edição). Assim, "100% mixed" é o modelo dizendo que está muito confiante de que o documento pertence à classe mixed. Em qual das duas leituras sob Mixed ele se apoiou é um número separado, a um clique de distância.
O que o número ao lado do rótulo está contando
Comece pela tela que você está olhando, porque o GPTZero responde a isso nela. Abra o chip Mixed e esta linha aparece logo abaixo das leituras:
This result isn't the percentage of mixed text, it's the model's confidence in the classification of the entire text as mixed. (Este resultado não é a porcentagem de texto misto; é a confiança do modelo na classificação do texto inteiro como misto.)
A mesma frase espera sob os outros dois chips, só com o nome da classe trocado: "isn't the percentage of AI text" (não é a porcentagem de texto de IA) sob AI, "isn't the percentage of human text" (não é a porcentagem de texto humano) sob Human.
Por que essa distinção importa é explicado por Alex Adam, que lidera a equipe de machine learning do GPTZero, em um post de 12 de janeiro de 2024:
categorizing predictions this way enables the confidence of the detector to be disentangled from the percentage of sentences that are AI-generated. Without this distinction, an AI probability of 50% could mean that the detector is 50% confident in its prediction (essentially a coin flip), or that 50% of the text is AI-generated. (Classificar as previsões dessa forma permite separar a confiança do detector da porcentagem de frases que foram geradas por IA. Sem essa distinção, uma probabilidade de IA de 50% poderia significar que o detector está 50% confiante na própria previsão — basicamente um cara ou coroa — ou que 50% do texto foi gerado por IA.)
Duas leituras do mesmo "50%", e para você elas significam coisas opostas. A saída de três classes existe para mantê-las separadas.
A documentação concorda a partir de outras três direções. Uma entrada de 9 de janeiro de 2024 nas notas de lançamento do GPTZero diz que as previsões foram "tuned to better represent the probability that the model is correct" (ajustadas para representar melhor a probabilidade de o modelo estar correto), dando o exemplo trabalhado de que um escore de IA de 90% significa "there is a 90% chance that the text is entirely written by an AI" (há 90% de chance de o texto ter sido escrito inteiramente por uma IA). A página de ajuda da API descreve a probabilidade de uma classe como "the chance that the detector is correct in its classification" (a chance de o detector estar correto em sua classificação), acrescentando que 90% significa correto "90% of the time on similar documents" (em 90% dos casos, em documentos semelhantes). Note documentos semelhantes, no plural, não os seus. E a página de tecnologia lista isso entre as contribuições de pesquisa do GPTZero na formulação mais seca possível: o detector é descrito como "a trinary classification problem, separating prediction confidence from the proportion of LLM text." (um problema de classificação ternária, que separa a confiança da previsão da proporção de texto de LLM.)
Uma página do GPTZero formula isso ao contrário. O bloco de FAQ na página inicial diz que o GPTZero "will suggest what percentage of your text is likely to be AI-generated" (vai sugerir qual porcentagem do seu texto provavelmente foi gerada por IA). Isso está dentro de uma resposta de passo a passo em três etapas, e não na descrição de um campo de resultado com nome, então pode muito bem ser texto de marketing escrito sem cuidado, e não uma contradição. De todo modo, a regra prática é a mesma: "GPTZero disse 30%" não identifica de qual grandeza alguém está falando, então diga de qual tela e de qual campo o número veio. Por que o mesmo texto recebe pontuações diferentes em cada detector coloca isso lado a lado com as unidades do Turnitin, do Originality.ai e do Winston AI, que é onde vive a versão entre fornecedores deste problema.
Três chips em cima, cinco classes com nome embaixo
Esta é a parte que pega as pessoas, e é o motivo pelo qual uma frase como "written by a human and polished with AI" (escrita por um humano e polida com IA) parece sair do nada. A fileira de cima são três chips. Cada um abre.
| Chip | Abre em | A linha do GPTZero abaixo dele |
|---|---|---|
| AI | "chance AI Generated" e "chance AI Paraphrased" | "isn't the percentage of AI text" (não é a porcentagem de texto de IA) |
| Mixed | "chance AI-Human Mix" e "chance AI polished" | "isn't the percentage of mixed text" (não é a porcentagem de texto misto) |
| Human | "Human written" | "isn't the percentage of human text" (não é a porcentagem de texto humano) |
Cinco leituras com nome no total. "AI polished" não é um quarto balde ao lado de Mixed. É uma das duas coisas que Mixed pode significar. Esse único fato responde à maior parte da confusão, porque um resultado mixed é lido de forma muito diferente depois que você sabe que a outra leitura sob ele se chama AI-Human Mix.
Clique no pequeno ícone de informação ao lado de qualquer uma dessas leituras e um painel se abre, com o título "Understanding AI Classifications" (Entendendo as classificações de IA), com uma aba para cada uma das cinco. As definições do GPTZero, ao pé da letra:
AI Generated — Text written directly by an AI language model with no meaningful human editing. AI Paraphrased — AI-generated text that was rewritten — either by a tool or by hand — to disguise its origin. AI-Human Mix — Human-written text combined with AI-generated text in the same document. AI Polished — Human-written text that was refined or edited by an AI tool. Human — Text written entirely by a human with no AI involvement. (AI Generated — Texto escrito diretamente por um modelo de linguagem de IA, sem edição humana significativa. AI Paraphrased — Texto gerado por IA que foi reescrito — por uma ferramenta ou à mão — para disfarçar sua origem. AI-Human Mix — Texto escrito por humano combinado com texto gerado por IA no mesmo documento. AI Polished — Texto escrito por humano que foi refinado ou editado por uma ferramenta de IA. Human — Texto escrito inteiramente por um humano, sem participação de IA.)
A aba AI Polished traz um segundo parágrafo, e é o que vale ter na sua frente:
The text was originally written by a human, then run through an AI tool to improve grammar, rephrase sentences, or enhance clarity. The core ideas and structure are the student's own work, but AI was used as an editing assistant. (O texto foi escrito originalmente por um humano e depois passado por uma ferramenta de IA para melhorar a gramática, reformular frases ou dar mais clareza. As ideias centrais e a estrutura são trabalho próprio do estudante, mas a IA foi usada como assistente de edição.)
Repare de onde cada definição parte. Polished parte da escrita humana. Paraphrased parte da saída de uma IA. Não são dois graus da mesma coisa, são histórias de origem opostas, e pendem de chips diferentes.
Duas coisas menores. O GPTZero escreve este rótulo de três formas em três lugares: "AI polished" no chip, "AI Polished" no painel e "Polished by AI" nos botões de exemplo da página inicial. E a varredura gratuita tem um mínimo: com zero caracteres a caixa diz "Enter at least 250 characters to scan" (Insira pelo menos 250 caracteres para varrer), mudando para "Great! You've entered enough text to scan" (Ótimo! Você inseriu texto suficiente para varrer) quando você passa do limite.
De onde veio o "AI Polished" e onde o GPTZero o explica
A classe é mais nova do que as outras quatro. Ela chega numa nota de lançamento de 3 de junho de 2025, arquivada sob "Added", como uma única linha:
Ability to detect "polished" texts that are lightly edited by AI (Capacidade de detectar textos "polished" que foram levemente editados por IA.)
Nove meses depois, mais uma linha, 11 de março de 2026: "Improved performance on the AI polished class." (Melhoria de desempenho na classe AI polished.) Essas duas entradas são tudo o que há sobre ela nas notas de lançamento.
A explicação mais longa veio dois dias depois daquela primeira entrada, no post do GPTZero que apresenta a classe AI Polished, de Emily Napier, datado de 5 de junho de 2025. Ele diz com todas as letras onde o rótulo se encaixa:
To improve transparency, we've decided to distinguish between documents that combine "chunks" of AI and human text and documents rewritten or polished by AI. We now identify these documents under the "Mixed" class with an accompanying tag of "AI Polished". (Para melhorar a transparência, decidimos distinguir entre documentos que combinam "pedaços" de texto de IA e de humano e documentos reescritos ou polidos por IA. Agora identificamos esses documentos sob a classe "Mixed", com a tag que os acompanha de "AI Polished".)
Isso é a tabela acima, nas palavras do próprio GPTZero e com uma data: dois tipos de documento misto, e um deles recebe a tag AI Polished.
Se você for procurar o post, use dois termos na busca. O título e o corpo usam "AI Polished", a formulação do painel. Duas das legendas de figura usam "Lightly edited by AI", que não é uma das três acima, mas é a formulação da nota de lançamento, e o endereço da página é montado a partir dela.
O post não faz parte da central de ajuda do GPTZero, e nenhum dos artigos de ajuda menciona o rótulo. Verificamos a central de suporte exaustivamente em 15 de setembro de 2026. Sua página inicial lista cinco coleções de nível superior, cada uma imprimindo sua própria contagem de artigos: General 36, API 17, Origin Extension 8, Account Management 11, Microsoft Word Add-In 5. Isso dá 77. Entrando em cada uma, aparecem oito subcoleções mais três artigos ligados diretamente a uma página de coleção, e enumerar tudo isso dá exatamente 77 artigos distintos. Buscamos os 77 e pesquisamos o `innerText` de cada página, o texto que o navegador renderiza (espaços não separáveis convertidos em espaços comuns, navegação e barra lateral do site incluídas), 88.894 caracteres no total naquele dia. A barra lateral muda entre carregamentos de página, então uma nova execução não vai cair exatamente nesse número:
- `polish`, `polished`, `AI polished`, `AI-polished`, `AI Polished`, `Polished` — 0 cada um
- `Polish` — 1, e é o idioma, na lista de idiomas suportados
- `confidence in the classification`, a frase que a tela de resultados usa — 0
O contador estava vivo: sobre o mesmo corpus naquele dia, `burstiness` retornou 28, `paraphras` 18, `sentence` 19, `mixed` 11. Folhear o índice principal de notícias também não leva você até lá. Em 15 de setembro de 2026 esse índice tinha 30 páginas de profundidade, terminando com 147 endereços de post distintos, e o post de junho de 2025 não estava entre eles. Ele estava listado no sitemap de notícias, que na época continha 320 posts. O GPTZero publica com frequência, então os dois totais já terão mudado quando você conferir.
Nada disso torna o rótulo pouco confiável, e a contagem não é um argumento de que seja. Ela só explica por que ler os artigos de ajuda do GPTZero deixa você sem nada sobre AI Polished. Se alguém perguntar o que o seu rótulo significa, o post é o que você deve mandar. Faça a captura de tela do painel de definição, além da pontuação. É uma definição curta, a um clique da leitura que seu documento recebeu, e é a diferença entre um leitor que acha que "polished" é um eufemismo e um que leu o GPTZero dizer que as ideias centrais são do próprio autor.
Sobre qual nível o rótulo realmente fala
Os chips descrevem o documento. O título acima deles diz literalmente "Chance this entire text is..." (a probabilidade de que este texto inteiro seja...). Os destaques de frase são uma segunda saída, com outra função, e a FAQ é explícita sobre em que direção corre o raciocínio:
The sentence-level classification should not be solely used to indicate that an essay contains AI (such as ChatGPT plagiarism). Rather, when a document gets a MIXED or AI_ONLY classification, the highlighted sentence will indicate where in the document we believe this occurred. (A classificação em nível de frase não deve ser usada sozinha para indicar que uma redação contém IA (como plágio via ChatGPT). Em vez disso, quando um documento recebe classificação MIXED ou AI_ONLY, a frase destacada indicará onde no documento acreditamos que isso ocorreu.)
Documento primeiro, destaques depois. Eles explicam o veredito em vez de somar até ele. Na tela, isso aparece como uma lista com o título "Your most AI sentences" (Suas frases mais IA), com cada entrada marcada por impacto, e não com uma porcentagem própria.
O GPTZero também publica um ranking de até onde confiar em cada nível, e ele vai contra o jeito como a maioria das pessoas lê um relatório:
The accuracy of our model increases as more text is submitted to the model. As such, the accuracy of the model on the document-level classification will be greater than the accuracy on the paragraph-level, which is greater than the accuracy on the sentence level. (A precisão do nosso modelo aumenta à medida que mais texto é enviado ao modelo. Assim, a precisão do modelo na classificação em nível de documento será maior do que a de parágrafo, que será maior do que a de frase.)
A frase destacada individual é aquela em que você acaba fixando o olhar. E é também a camada que o GPTZero considera menos precisa.
Mais dois comportamentos pegam as pessoas. As frases destacadas, diz o artigo de ajuda do Advanced Scan, são as que estão "disproportionately affecting your overall AI or human score" (afetando de forma desproporcional sua pontuação geral de IA ou humana), o que é impacto, não proporção, e o GPTZero acrescenta que as frases não destacadas "may still have an effect on your score, but they aren't more likely than other parts of your document" (ainda podem ter efeito na sua pontuação, mas não são mais prováveis do que outras partes do seu documento). Separadamente, um resultado mediano sem nenhum destaque tem seu próprio artigo de ajuda: "there isn't one specific section of the document that is especially likely to have AI content. Rather, the entire document has signs of being AI generated, but with lower certainty." (não há uma seção específica do documento que seja especialmente provável de ter conteúdo de IA. Em vez disso, o documento inteiro tem sinais de ter sido gerado por IA, mas com menor certeza.)
Por que o número mudou quando você quase não mexeu em nada
Duas notas de lançamento falam disso, e ambas são mais estreitas do que as pessoas supõem.
6 de fevereiro de 2024:
Processing of long documents has been made more consistent. There should be less variation in predictions when cutting out a few sentences from long AI-generated documents (O processamento de documentos longos ficou mais consistente. Deve haver menos variação nas previsões ao cortar algumas frases de documentos longos gerados por IA.)
2 de maio de 2025:
Increased output stability when rescanning multiple times (Maior estabilidade da saída ao rescanear várias vezes.)
Olhe o escopo de cada uma. A primeira fala de cortar frases de documentos longos gerados por IA. A segunda fala de passar o mesmo texto duas vezes. Nenhuma das duas é uma afirmação sobre editar uma frase do seu próprio rascunho e escanear de novo, e não conseguimos encontrar uma: nos 77 artigos de suporte acima, `stabilit`, `rescan` e `re-scan` retornam todos 0. Essa é a lacuna deste artigo, e ela tem uma consequência prática: um número do GPTZero só significa alguma coisa ao lado de outro número do GPTZero se você souber quando cada um foi tirado, então registre a data junto com a pontuação.
A razão pela qual as datas importam está na página de notas de lançamento. Contando as datas de entrada no início de uma linha no `innerText` da página, ela traz 55 entradas datadas desde maio de 2023, 10 delas em 2026 até 15 de setembro, a mais recente sendo 12 de agosto de 2026 (Model 4.9b). Duas deste ano: "More granular mixed text predictions and identification of interleaving mixed texts" (Previsões de texto misto mais granulares e identificação de textos mistos intercalados) em maio, e "Robustness to headers; headers are now excluded from our model's input" (Robustez a cabeçalhos; os cabeçalhos agora ficam fora da entrada do nosso modelo) em agosto. A tela de resultados imprime a versão do modelo ao lado do veredito, que é a coisa mais barata nela de registrar. Um scan de julho e um scan da semana passada não foram rodados pelo mesmo modelo.
A faixa de confiança é a outra metade da leitura, e é a parte que se perde quando uma pontuação é jogada na cara de alguém. O artigo de ajuda do Advanced Scan mapeia as faixas em taxas de erro: "Highly confident: our error rate is less than 2%" (Altamente confiante: nossa taxa de erro é menor que 2%), "Moderately confident: our error rate would be around 10%" (Moderadamente confiante: nossa taxa de erro ficaria em torno de 10%), "Low confidence: our error rate would be 14% or higher" (Baixa confiança: nossa taxa de erro seria 14% ou mais). A página de tecnologia põe a faixa de cima em "less than 1%" (menos de 1%) de erro médio, num conjunto de avaliação interno. Os dois números são do próprio GPTZero, com dados do próprio GPTZero, não batem, e o artigo de ajuda que traz os 2% está marcado como atualizado pela última vez há um ano. O líder de ML do GPTZero também é franco sobre o limite do número subjacente: a etapa de calibração faz o detector ser "not overconfident in its predictions" (não excessivamente confiante em suas previsões) na maior parte dos casos, mas "achieving perfect calibration is nearly impossible" (alcançar calibração perfeita é quase impossível). Uma classe citada sem sua faixa de confiança é meio resultado.
O que fazer com um rótulo
Se o que você fez era permitido é uma pergunta para a sua instituição, não para um classificador, e o GPTZero diz isso com mais clareza do que muita gente que o cita: "these results should not be used to punish students" (estes resultados não devem ser usados para punir estudantes) e "we don't recommend using an AI detection result as the only proof for academic punishment or discipline" (não recomendamos usar um resultado de detecção de IA como a única prova para punição ou medida disciplinar acadêmica). Seu líder de ML vai além, e esta vale conhecer se um único scan estiver sendo brandido contra você:
we do not encourage punitive actions based solely on the results of a single scan. Instead, a history of scan results should ideally be established, serving as stronger evidence of AI usage. (não encorajamos ações punitivas baseadas apenas nos resultados de um único scan. Em vez disso, o ideal é estabelecer um histórico de resultados de scan, que serve como evidência mais forte de uso de IA.)
Cinco coisas que estão nas suas mãos:
- Abra o chip antes de entrar em pânico. Um "Mixed" nu é a coisa menos informativa da tela. As duas leituras abaixo dele são AI-Human Mix e AI polished, e descrevem situações diferentes.
- Registre a classe, a sub-leitura, a faixa de confiança, a versão do modelo e a data, numa única captura de tela. Os cinco estão no mesmo painel. Redigitar o número joga fora tudo o que o torna interpretável.
- Faça a captura do painel de definição também, e guarde o link do post de junho de 2025 do GPTZero. O painel fica atrás do ícone de informação, e a captura mantém a definição como a sua tela a mostrou. O post é onde o GPTZero explica, por escrito, que AI Polished é uma tag sob Mixed.
- Descubra o que a sua instituição realmente usa antes de discutir com um número vindo de outro lugar. Uma autoverificação numa ferramenta gratuita não é o relatório que o seu departamento vai olhar, e os nomes de classe, a formulação e os limiares não são compartilhados entre fornecedores. Dois instrumentos discordando sobre o seu arquivo é o resultado esperado, não um mau funcionamento.
- Guarde seus rascunhos e seu histórico de revisões. O próprio conselho do GPTZero a educadores é pedir "drafts, revision histories, or brainstorming notes" (rascunhos, históricos de revisão ou anotações de brainstorming), e ele destaca o histórico de versões do editor como o que costuma resolver a questão. Essa evidência precisa já existir quando você precisar dela, o que faz disso um trabalho de hoje, e não um trabalho para depois do e-mail.
A saída é uma leitura do texto que está na frente dela, não um registro de como aquele texto veio a existir. Em qualquer chip que você tenha caído, o argumento que você realmente pode ganhar é sobre o seu processo, e a evidência disso está nos seus rascunhos.
Para ler mais
- GPTZero contra Turnitin: por que as pontuações não batem e o que cada ferramenta realmente mede — para quando as duas ferramentas devolvem dois números diferentes no mesmo arquivo.
- O Turnitin removeu o destaque roxo de AI-paraphrased — o próprio conjunto de rótulos do Turnitin mudou em agosto de 2026, e uma captura de tela antiga não está desatualizada do jeito que as pessoas supõem.
- Por que o mesmo texto tem pontuações diferentes em cada detector
- O que os detectores de IA medem além de perplexity e burstiness — o GPTZero diz que deixou de usar os dois no outono de 2023, quando passou para uma arquitetura de deep learning.
- Marcado, mas foi você mesmo quem escreveu: como preparar uma resposta
- Personal Statement marcada como IA: o prompt escolheu a forma primeiro
Tudo o que foi citado acima foi lido nas próprias páginas do GPTZero e numa varredura gratuita feita sem login, em 15 e 17 de setembro de 2026, e cada citação indica onde ela está. Onde duas dessas páginas dão números diferentes para a mesma coisa, os dois estão aqui.
Continue lendo
GPTZero vs Turnitin: por que as pontuações não coincidem e o que cada ferramenta realmente mede
5 min de leitura
Detectores de IAPor que o mesmo texto recebe uma pontuação diferente em cada detector
5 min de leitura
Relatórios de detecçãoO Turnitin removeu o realce roxo do texto parafraseado por IA
11 min de leitura