- Definição
- LLM: LLM (Large Language Model, ou modelo de linguagem grande) é um programa de inteligência artificial treinado com uma quantidade enorme de texto para entender perguntas e escrever respostas, como o que está por trás do ChatGPT, do Claude e do Gemini.
Como funciona, sem matemática
Um LLM é treinado lendo uma quantidade gigantesca de texto: livros, artigos, páginas da web. Com isso ele aprende padrões da língua, fatos que aparecem com frequência e jeitos de responder. Depois do treino, quando você faz uma pergunta, ele escreve a resposta palavra por palavra, escolhendo a continuação mais provável para aquele contexto.
Alguns nomes conhecidos: a família GPT, da OpenAI, que está por trás do ChatGPT; o Claude, da Anthropic; o Gemini, do Google; e o Llama, da Meta. Cada empresa tem os seus próprios robôs que visitam a internet, e eles estão listados na página de robôs de IA.
Duas formas de o LLM usar o seu site
Um LLM pode encontrar a sua empresa de dois jeitos diferentes, e vale entender a diferença:
- No treino. Robôs como o GPTBot e o ClaudeBot coletam páginas que podem entrar no material de treinamento de futuros modelos. O que o modelo aprende ali fica “na memória”, mas congelado na data em que foi coletado.
- Na hora da pergunta. Quando o assistente faz uma busca para responder, ele manda um robô buscar páginas naquele momento e usa o texto como fonte. Esse processo se chama RAG. É aqui que o seu horário atualizado, o seu cardápio novo e o seu endereço certo fazem diferença.
Por que importa para o seu negócio
Um LLM sem fonte tende a preencher lacunas com o que parece plausível. É daí que vêm as alucinações: o assistente diz que a sua loja fecha às 18h quando fecha às 20h, ou que você não faz entrega quando faz. Quanto mais clara e acessível estiver a informação no seu site, menor o espaço para o modelo adivinhar.
Também é importante lembrar que o LLM lê texto. Imagem com o cardápio escrito, vídeo sem legenda, informação que só aparece depois de um clique ou só depois do JavaScript rodar: tudo isso pode passar despercebido.
Um exemplo
Uma confeitaria mudou de endereço há seis meses. O endereço antigo continua em várias páginas antigas da internet, e um modelo treinado com esse material pode “lembrar” do endereço velho. Se o site da confeitaria estiver acessível aos robôs de busca dos assistentes e mostrar o endereço novo em texto, com dados estruturados de LocalBusiness, o assistente que pesquisa na hora tem uma fonte atual para corrigir a informação.
Como o Mecita olha para isso
O diagnóstico não conversa com o LLM. Ele verifica se o seu site entrega o que um LLM precisa para usar você como fonte: acesso liberado, texto no HTML, identidade clara e trechos citáveis.
Perguntas frequentes
O LLM sabe tudo o que está na internet?
Não. Ele aprendeu com uma parte do que foi coletado até uma certa data. Para responder sobre coisas recentes ou específicas, como o horário da sua loja, os assistentes precisam buscar a informação na hora, e aí entra o seu site.
Se eu bloquear os robôs de treino, sumo das respostas?
Não necessariamente. Vários operadores separam o robô que coleta para treino do robô que busca páginas na hora da pergunta. Bloquear um não bloqueia o outro. O que cada robô faz está explicado na página de robôs de IA.
Faltou algum termo? Veja o glossário completo.