O que são tokens
A unidade que mede tudo: leitura, escrita, consumo do plano e limite de contexto.
Modelos de IA não leem letras nem palavras: leem tokens — pedaços de palavra. Em português, um token equivale, na média, a cerca de quatro caracteres; uma página de peça jurídica fica por volta de 600 a 800 tokens.
Você nunca precisa contar tokens à mão. Mas entender o conceito explica três coisas que aparecem o tempo todo na plataforma.
1. Por que a conversa fica mais cara com o tempo
A cada nova mensagem, o modelo relê a conversa inteira — o histórico não fica "guardado na memória dele". Uma conversa com 20 mensagens e 300 páginas anexadas reprocessa tudo isso a cada pergunta nova.
Daí a regra prática mais útil da plataforma: caso novo, conversa nova.
2. Por que documento grande pesa tanto
O texto do anexo entra como leitura. Um processo de 2.000 páginas são centenas de milhares de tokens lidos — e, acima de um certo volume, o preço por token lido dobra, mesmo sem trocar de modelo. Como lidar →
3. Por que existe um limite de contexto
Contexto é o total de tokens que a IA tem à mão numa resposta: instruções + documentos + histórico + o que ela escreve. A barra acima do campo de mensagem mostra o quanto já foi ocupado.
Leitura e escrita custam diferente
O que a IA escreve custa bem mais caro, por token, do que o que ela lê. Por isso pedir "reescreva a peça inteira" a cada ajuste consome muito mais que pedir a correção de um tópico — e por isso o interruptor Editor ligado sai mais barato que ter a peça inteira repetida dentro do chat a cada turno.
Onde isso vira consumo
O consumo do seu plano é medido pelo custo real dos tokens de cada interação — não por número de mensagens nem por peças geradas. É por isso que duas peças podem consumir valores muito diferentes. Ver limites e consumo →