Você abre um chat, escreve uma frase e recebe outra, no tom de quem sabe. ChatGPT, Claude e Grok fazem isso. Por baixo, a operação é menor do que parece: o modelo continua o texto.
Ele não abre a padaria. Não lembra de você como uma pessoa lembra. Não tem uma ficha com o horário de sábado. Ele foi treinado em muito texto para chutar a próxima peça, a que mais parece com o que veio antes.
O texto até aqui
A padaria da esquina abre …
Toque uma continuação. As barras são exemplo, não a saída de um modelo real.
As barras são um exemplo. A ideia é esta: cada continuação tem uma chance, e a mais alta ainda pode estar errada no mundo real. "Sábado" ganha porque muitas frases de padaria seguem assim. Banana perde porque quase nenhuma segue assim. Nenhuma das duas foi conferida na porta da loja.
Uma peça por vez, sorteada
Uma resposta inteira sai desse mesmo passo, repetido. O modelo calcula as chances da próxima peça, uma é escolhida, ela é colada no fim do texto, e o modelo calcula de novo. Uma resposta de três parágrafos são algumas centenas dessas voltas.
A escolha costuma ser um sorteio, com a temperatura decidindo o quanto ele arrisca. Temperatura baixa quase sempre pega a mais provável. Temperatura alta dá chance para as improváveis.
A padaria abre …
Morna: varia um pouco, sem perder o fio.
DesafioGere uma frase com a temperatura acima de 1,5.
É por isso que a mesma pergunta, feita duas vezes, pode ter respostas diferentes. E é também por isso que um modelo pode inventar um horário com toda a segurança: "das 6h às 12h" é uma continuação muito provável para uma frase sobre padaria, exista a padaria ou não. Isso tem nome: alucinação.
O chat que você usa é esse modelo mais um produto em volta. A OpenAI, a Anthropic e a xAI colocam instruções, o histórico da conversa e, quando existe, ferramentas. Sem ferramenta de busca, o Grok não vê o que aconteceu depois do treino. A documentação da xAI diz isso com todas as letras.
Glossário da aula
- Modelo
- O programa treinado para continuar texto. ChatGPT, Claude e Grok são modelos diferentes, da mesma família de ideia.
- Temperatura
- O quanto o sorteio da próxima peça arrisca. Baixa repete a mais provável; alta varia mais.
- Alucinação
- Uma resposta fluente e errada. O modelo escolheu a continuação provável, e ela não bate com o mundo.
Dica do ProdBot
Fluente não é verificado. Uma frase pode estar redonda e o horário, errado. A conferência é sua, ou de uma ferramenta que foi olhar a fonte.
Confere rapidinho
A IA respondeu o horário com segurança. O que isso prova?
