Há dois termos que aparecem em todo o lado quando se fala de IA — tokens e janela de contexto — e que soam a coisa de engenheiro. Não são. São dois conceitos simples que, depois de entendidos, mudam mesmo a forma como trabalha com a IA. Vou explicá-los sem uma única fórmula.

O que é um token

Quando lê um texto, lê palavras. A IA não — ela lê tokens, que são pedaços de texto. Um token é, em média, cerca de três quartos de uma palavra. Palavras curtas são um token; palavras longas podem ser dois ou três.

Não precisa de contar tokens à mão (há ferramentas para isso, e raramente é preciso). O que interessa reter é a ideia: tudo o que escreve para a IA e tudo o que ela escreve de volta é medido em tokens. É a "moeda" com que a IA lê e produz texto — e, quando se usa a IA via automações, é literalmente a unidade pela qual se paga.

O que é a janela de contexto

Aqui está o conceito que muda tudo.

A janela de contexto é a quantidade de tokens que a IA consegue ter "em mente" ao mesmo tempo, numa conversa. Inclui tudo: a sua pergunta, os documentos que colou, o histórico da conversa até ali, e a resposta que está a gerar. Tudo somado tem de caber na janela.

Pense numa secretária de trabalho. A janela de contexto é o tamanho da secretária: tudo o que está em cima dela, a IA vê e usa. O que não cabe, fica fora do alcance — é como se não existisse para aquela tarefa.

Por isso é que a janela importa: quanto maior, mais material a IA processa de uma vez sem perder o fio.

Porque é que isto muda o seu trabalho

A dimensão da janela determina o que pode pedir.

  • Janela pequena: a IA só "vê" um pouco de cada vez. Se lhe der um documento longo, ela perde o início quando chega ao fim. Tem de trabalhar aos bocados.
  • Janela grande: pode dar-lhe um relatório inteiro, um histórico completo de cliente, várias páginas de contexto — e ela trabalha sobre tudo, com o quadro completo.

Para quem vive de clientes, isto é decisivo. Uma janela grande significa que pode pedir "lê este histórico inteiro de emails e prepara-me um ponto de situação" sem ter de partir tudo em pedaços. O resultado é melhor porque a IA tem o contexto todo.

Hoje, os modelos topo de gama têm janelas enormes — na ordem de um milhão de tokens, o equivalente a centenas de páginas de uma só vez. Os modelos mais leves e baratos têm janelas menores (na casa das duzentas mil), suficientes para a maioria das tarefas correntes. É mais um critério para escolher o modelo certo para cada tarefa.

Dois erros comuns que isto explica

Entender a janela de contexto resolve duas frustrações que toda a gente tem:

  1. "A IA esqueceu-se do que eu disse no início." Numa conversa muito longa, o princípio pode ter saído da janela. Solução: recomece com o contexto essencial resumido, ou use um modelo de janela maior.
  2. "Dei-lhe um documento enorme e ela ignorou parte." Provavelmente o documento não coube todo. Solução: um modelo de janela maior, ou dividir a tarefa.

A regra prática: se a IA "perde o fio", quase sempre é a janela de contexto a falar. Não é incompetência — é falta de espaço na secretária.

Perguntas frequentes (FAQ)

O que é um token em IA?

É um pedaço de texto — em média cerca de três quartos de uma palavra — que é a unidade com que a IA lê e escreve. Tudo o que envia e tudo o que a IA responde é medido em tokens.

O que é a janela de contexto?

É a quantidade de tokens que a IA consegue ter em mente de uma só vez numa conversa: o seu pedido, os documentos dados, o histórico e a resposta, tudo somado. É como o tamanho de uma secretária — o que não cabe, fica fora do alcance.

Por que é que a IA "se esquece" do que eu disse?

Porque, numa conversa longa, o início pode ter saído da janela de contexto. A IA não tem espaço para guardar tudo indefinidamente. Resumir o essencial e recomeçar, ou usar um modelo de janela maior, resolve.

Quanto é uma janela de um milhão de tokens?

É o equivalente a centenas de páginas de texto que a IA processa de uma só vez. Permite dar-lhe relatórios inteiros ou históricos completos sem partir em pedaços — algo muito útil para quem trabalha com muita informação.

Preciso de me preocupar a contar tokens?

Raramente. No uso normal das aplicações, não. Só passa a importar quando liga a IA a automações (onde se paga por token) ou quando trabalha com documentos muito grandes e a janela do modelo se torna um limite.