Checklist de estilo para reescrever texto produzido com apoio de IA e deixá-lo com cara de jornal: metas numéricas de frase e parágrafo medidas em 19 matérias de g1, Folha, Estadão, Agência Pública e Aos Fatos, uma passada de edição por LLM e uma limpeza determinística do que o modelo não obedece.
Conteúdo
Texto escrito por modelo de linguagem não é denunciado por uma palavra mágica. É denunciado por ritmo: frases todas do mesmo tamanho, parágrafos uniformes, conectivo abrindo período, travessão no meio de tudo. A saída é medir a distância até uma referência humana e tratar cada desvio.
A régua
Estes números saíram da medição de 19 matérias publicadas em setembro de 2026 por g1, Folha, Estadão, Agência Pública e Aos Fatos: 1.319 frases e 757 parágrafos, cerca de 32 mil palavras.
| Métrica | Faixa de referência | |---|---| | Frase, mediana | 19 a 22 palavras (p90 38, p99 61) | | Frases com até 15 palavras | 36,5% | | Frases com até 8 palavras | 11,1% | | Parágrafo, mediana | 33 palavras | | Parágrafos com uma única frase | 57,7% | | Parágrafo começando com conectivo | 1,7% (13 de 757) | | Advérbio em -mente abrindo período | 3 em 31,8 mil palavras | | Lide, dois primeiros parágrafos | mediana de 83 palavras | | Verbos de atribuição mais usados | segundo, disse, conta, afirmou, avalia | | Densidade numérica | cerca de 18 tokens numéricos por mil palavras |
O passo de edição
Peça a reescrita com as metas explícitas, não com a instrução vaga "deixe mais humano":
- nenhum parágrafo com mais de 3 frases, e a maioria com 1 ou 2;
- pelo menos um terço das frases com 15 palavras ou menos;
- no máximo um travessão no texto inteiro;
- não abrir parágrafo com "Além disso", "Nesse sentido", "Dessa forma", "Diante disso", "Por fim";
- cortar inflação: crucial, fundamental, essencial, robusto, abrangente, inovador, "desempenha um papel crucial", "representa um avanço", listas de três itens forçadas, "não apenas X, mas também Y";
- verbo direto (é, tem, faz) em vez de "configura-se como";
- atribuição com verbo de imprensa, sem "ressaltou" e "destacou" como sinônimo de "disse";
- preservar todos os números, nomes, datas, unidades e links.
A limpeza determinística
Modelo não obedece tudo no prompt, então o que sobra vira código, nesta ordem:
- remates de redação escolar ("Conclui-se que", "Portanto, é fundamental que");
- advérbios em -mente abrindo período;
- travessões além do primeiro viram vírgula;
- aberturas de enchimento em qualquer começo de frase;
- paralelismos inflados;
- títulos em caixa de frase, negrito limitado a um por parágrafo;
- grafia de termos técnicos (IA, OpenAI, arXiv) restaurada depois da caixa de frase;
- quebra de parágrafos longos, no máximo duas frases ou 80 palavras.
O passo 8 é o que fecha a meta de parágrafo: o modelo mantém blocos longos mesmo quando instruído.
O que não vale a pena
Não perseguir detector de IA. São classificadores estatísticos de perplexidade e variação de frase, com falso positivo alto em português, e nenhum deles é usado pelo Google no ranqueamento. O que importa é o texto ser claro, concreto e específico. Detector é efeito colateral, não meta.
Resultado medido
Em duas publicações do E-Cogni, antes e depois do passo:
- mediana de frase: de 25,9 para 19 palavras (notícia) e 17,5 (artigo);
- frases com até 15 palavras: de 3% para 40%;
- parágrafo mediano: de 46,6 para 23 e 30 palavras;
- travessão por mil palavras: de 4,41 para 1,44 e 0.
Números, links e nomes foram preservados integralmente nas duas passadas.
Instalação
# 1) guarde o checklist como skill do agente
mkdir -p .claude/skills/redacao-ptbr
$EDITOR .claude/skills/redacao-ptbr/SKILL.md # cole as regras do passo de edição
# 2) use como segundo passo do seu pipeline: rascunho -> editor -> limpeza
# no prompt do editor, cite as metas (frase mediana 19-22, um terço com <=15 palavras,
# parágrafo mediano 33, no máximo um travessão) e liste o que não pode mudar.
# 3) meça o resultado antes e depois (o número é o que impede a regressão):
# mediana de palavras por frase, % de frases <=15 palavras, mediana de palavras por parágrafo,
# travessões por mil palavras, contagem de links e de dígitos.
Agente: claude-code
Veredito
Testado em produção no E-Cogni: mediana de frase de 25,9 para 19 palavras, frases de até 15 palavras de 3% para 40%, parágrafo mediano de 46,6 para 23, travessão de 4,41 para 1,44 por mil palavras, com links e números intactos.