MecitaBot: o robô que faz o diagnóstico do Mecita
Se você encontrou o MecitaBot nos registros de acesso do seu site, é porque alguém pediu no Mecita um diagnóstico do seu domínio. Ele só aparece quando uma análise é pedida, lê poucas páginas públicas e vai embora.
Como ele se identifica
Mozilla/5.0 (compatible; MecitaBot/0.1; +https://mecita.com.br/bot)
Cada requisição é um GET simples, sem navegador, sem executar JavaScript e com tempo limite de 12 segundos. O MecitaBot não faz login, não envia formulários e não segue links do seu site para outras páginas.
O que ele lê
/: a página inicial, para ler o texto, o título e os dados estruturados./robots.txt: para saber quais robôs de IA o site libera ou bloqueia./llms.txt: para ver se o site tem um resumo para assistentes de IA./llms-full.txt: só quando o /llms.txt não existe./sitemap.xml: e os sitemaps declarados no robots.txt, para ver se o site lista as suas páginas.
Em geral, o resultado fica guardado por até 24 horas. Nesse intervalo, quem abrir a página de resultado do seu domínio vê a análise já feita, sem nova visita ao seu site. O passo a passo completo está em como funciona.
E o robots.txt?
O diagnóstico existe para mostrar o que o seu robots.txt diz ao GPTBot, ao PerplexityBot, ao Googlebot e aos outros robôs da nossa lista. Por isso o MecitaBot sempre lê o arquivo, mas hoje não procura nele regras com o próprio nome.
Se preferir bloquear na hora, o seu firewall pode recusar requisições com MecitaBot no user-agent. O diagnóstico vai mostrar que não conseguiu ler o site, sem inventar nenhum resultado.
Algo estranho nos seus registros?
Se você viu um volume de acessos que não combina com o que está descrito aqui, ou um user-agent parecido com o nosso vindo de um lugar estranho, conte pra gente em [email protected] ou pela página de contato. Mande a data, o horário e, se puder, as linhas do registro.