Um site preparado para IA entrega o texto pronto no HTML, deixa os robôs de busca e de IA entrarem, descreve a empresa em dados estruturados e oferece um mapa enxuto em llms.txt. Nessa ordem: sem a primeira parte, schema e llms.txt não salvam ninguém.
O que significa, no código, um site preparado para IA?
Significa que a pessoa, o robô do Google e os robôs de IA que alimentam ChatGPT, Claude e Perplexity recebem a mesma informação. Este guia cobre o lado técnico, o que quem constrói ou encomenda o site precisa exigir. A estratégia de conteúdo está no guia como aparecer no ChatGPT e no Modo IA do Google.
O assunto ganhou peso no Brasil desde que o Google anunciou o Modo IA em português, segundo a Forbes Brasil em 8 de setembro de 2025. Se a busca tradicional ainda compensa nesse cenário, discutimos em SEO ainda vale a pena em 2026.
Por que a renderização vem antes de tudo?
Porque os robôs leem o site de jeitos diferentes. A documentação de JavaScript do Google Search Central (atualizada em março de 2026) descreve três fases: rastreamento, renderização num Chromium sem tela e indexação. A página pode esperar na fila de renderização, e o próprio Google recomenda renderizar no servidor ou pré-renderizar, porque nem todo robô executa JavaScript.
Com os robôs de IA é pior. Uma análise da Vercel publicada em dezembro de 2024 concluiu que nenhum dos grandes rastreadores de IA renderizava JavaScript: GPTBot, OAI-SearchBot, ClaudeBot e PerplexityBot baixam scripts, mas não os executam.
Se o preço ou a lista de serviços aparecem só depois que um script roda, a IA não vê. Next.js e frameworks parecidos resolvem com renderização no servidor ou geração estática: a animação continua, o texto sai pronto no HTML. Velocidade conta junto, e está detalhada em Core Web Vitals em 2026.
Quais robôs precisam de passagem no robots.txt?
A documentação de rastreadores da OpenAI separa três agentes: OAI-SearchBot (busca do ChatGPT), GPTBot (treino de modelos) e ChatGPT-User (visita a pedido do usuário). Quem bloqueia o OAI-SearchBot não aparece nas respostas de busca do ChatGPT.
São decisões independentes: dá para liberar a busca e negar o treino. O erro comum é herdar de um plugin de segurança um robots.txt que bloqueia tudo que não é Google.
User-Agent: OAI-SearchBot
User-Agent: ChatGPT-User
User-Agent: PerplexityBot
Allow: /
Disallow: /api/
Sitemap: https://seusite.com.br/sitemap.xml
Que schema markup uma empresa deve ter?
Dados estruturados descrevem em JSON-LD o que a página é, com o vocabulário do schema.org. Para uma empresa de serviços, o núcleo é Organization (ou um subtipo de LocalBusiness) na página inicial, Service nas páginas de serviço, BlogPosting nos artigos e BreadcrumbList em todas.
{
"@context": "https://schema.org",
"@type": "Organization",
"name": "Sua Empresa",
"url": "https://seusite.com.br",
"logo": "https://seusite.com.br/logo.png",
"sameAs": ["https://www.instagram.com/suaempresa"],
"contactPoint": {
"@type": "ContactPoint",
"contactType": "sales",
"areaServed": "BR",
"availableLanguage": "pt-BR"
}
}
Dois cuidados. O schema precisa repetir o que está visível na página. E escolha o tipo mais específico que existir: a própria página do tipo ProfessionalService no schema.org avisa que ele foi depreciado por confusão com Service e recomenda subtipos como Attorney, Dentist ou AccountingService. Na home da Brave Cross usamos Organization combinado com ProfessionalService; quem começa do zero deve preferir o subtipo do próprio ramo.
Dados estruturados FAQPage ainda valem a pena?
Para aparecer com perguntas expansíveis no Google, não. O registro de atualizações do Google Search Central informa que o resultado aprimorado de FAQ deixou de aparecer na Busca a partir de 7 de maio de 2026, depois de anos restrito a sites governamentais e de saúde; em junho de 2026 o Google retirou a própria documentação do recurso.
O markup segue válido no schema.org, e perguntas com respostas literais seguem úteis para quem recorta trechos. Use FAQPage só onde houver perguntas reais e visíveis.
{
"@context": "https://schema.org",
"@type": "FAQPage",
"mainEntity": [{
"@type": "Question",
"name": "Quanto tempo leva um site institucional?",
"acceptedAnswer": {
"@type": "Answer",
"text": "Resposta curta e igual à que aparece na página."
}
}]
}
llms.txt: o que é e o que ele não faz?
É um arquivo em Markdown na raiz do site que resume o que importa para um modelo de linguagem. A proposta oficial em llmstxt.org, criada por Jeremy Howard em setembro de 2024, exige só um título H1; o resumo em citação e as listas de links sob títulos H2 são opcionais. A ideia é caber no contexto do modelo e apontar para páginas limpas.
O limite: o Google diz, na documentação sobre recursos de IA na Busca, que não é preciso criar arquivos de IA, arquivos legíveis por máquina nem schema especial para aparecer em AI Overviews ou no Modo IA. É um complemento barato para outros assistentes, não um atalho para o Google.
Um exemplo: o llms.txt da Brave Cross tem H1, resumo em citação, seções Páginas, Blog, Recursos e Contato, e aponta para /blog/llms-full.txt, com o texto completo dos artigos (convenção nossa, fora da proposta).
# Sua Empresa
> Estúdio de arquitetura em Belo Horizonte. Projetos residenciais e comerciais.
## Páginas
- [Serviços](https://seusite.com.br/servicos): o que fazemos e para quem
- [Contato](https://seusite.com.br/contato): como pedir orçamento
Como verificar cada item?
| Item | O que é | Como verificar |
|---|---|---|
| Renderização no servidor | Texto principal presente no HTML entregue, sem depender de JavaScript | "Exibir código-fonte" e busca por uma frase do meio da página |
| robots.txt | Regras de acesso por robô (Googlebot, OAI-SearchBot, ClaudeBot, PerplexityBot) | Abrir seusite.com.br/robots.txt e conferir se nenhum deles está em Disallow: / |
| Sitemap | Lista das URLs que devem ser indexadas | Abrir /sitemap.xml e enviar no Google Search Console |
| Organization ou subtipo | Identidade da empresa em JSON-LD na página inicial | Validador do schema.org na página inicial |
| BlogPosting e BreadcrumbList | Autor, data e trilha de cada artigo | Validador do schema.org em uma URL de post |
| FAQPage | Perguntas e respostas visíveis marcadas em JSON-LD | Validador do schema.org; sem resultado aprimorado no Google desde maio de 2026 |
| llms.txt | Resumo em Markdown com links para as páginas principais | Abrir /llms.txt e conferir H1, resumo e links funcionando |
| Canônico e título único | Uma URL oficial e um título por página | Código-fonte: tag link rel="canonical" e tag title |
Fontes: Google Search Central (recursos de IA, dez/2025; JavaScript, mar/2026; registro de atualizações sobre FAQ, mai/2026), documentação de rastreadores da OpenAI e proposta llmstxt.org, consultadas em outubro de 2026.
Qual é a ordem certa para implementar?
Renderização
Garantir que o texto principal de cada página saia pronto do servidor
Acesso
Revisar o robots.txt e liberar os robôs de busca e de IA que interessam
Indexação
Publicar sitemap, canônicos e títulos únicos, e enviar ao Search Console
Identidade
Marcar a empresa com Organization ou o subtipo do ramo na página inicial
Conteúdo
Marcar artigos com BlogPosting e BreadcrumbList, e FAQPage onde houver perguntas reais
Mapa
Publicar um llms.txt curto com as páginas que respondem às perguntas do cliente
Nenhum item custa caro quando entra no projeto desde o início; refazer um site renderizado só no navegador, sim. Se você está orçando um site, leia quanto custa um site profissional em 2026 e inclua este checklist no briefing. Regras de setor que precisam estar no texto visível estão em site para clínica, imobiliária e indústria.
Perguntas frequentes
O que é llms.txt e para que serve?
É um arquivo em Markdown publicado em /llms.txt que resume o site para modelos de linguagem e lista links para as páginas principais. A proposta em llmstxt.org, de setembro de 2024, só exige um título H1. O Google afirma, em documentação de dezembro de 2025, que não precisa dele para AI Overviews nem para o Modo IA.
Preciso de schema para aparecer no Modo IA do Google?
Não há schema obrigatório. A documentação do Google sobre recursos de IA, atualizada em dezembro de 2025, diz que basta a página estar indexada e apta a aparecer com snippet na busca comum. Dados estruturados ajudam a descrever a empresa e os serviços com precisão, mas não são requisito.
O ChatGPT consegue ler um site feito em React?
Depende da entrega. Segundo análise da Vercel de dezembro de 2024, os robôs da OpenAI não executam JavaScript. Se o site React for renderizado no servidor ou gerado de forma estática, como o Next.js permite, o texto chega pronto. Se for montado só no navegador, o robô recebe uma página quase vazia.
Dados estruturados FAQPage ainda funcionam no Google?
O markup continua válido no schema.org, mas o Google deixou de mostrar o resultado aprimorado de FAQ a partir de 7 de maio de 2026, segundo o registro de atualizações do Google Search Central. Vale manter onde há perguntas reais e visíveis, sem esperar efeito na página de resultados.
Bloquear o GPTBot tira meu site do ChatGPT?
Não necessariamente. A OpenAI documenta que o GPTBot coleta conteúdo para treino e que a busca do ChatGPT usa outro robô, o OAI-SearchBot. Quem bloqueia só o GPTBot pode continuar aparecendo nas respostas com busca. Quem bloqueia o OAI-SearchBot, segundo a própria OpenAI, deixa de aparecer nessas respostas.
Peça o checklist aplicado ao seu site
Ser citado por uma IA começa no código: texto no HTML, acesso liberado no robots.txt, identidade clara em JSON-LD e um mapa curto em llms.txt. Mais estudos técnicos como este estão no blog da Brave Cross.
O site da Brave Cross é feito em Next.js, com renderização no servidor, dados estruturados e llms.txt, e podemos revisar o seu com esta tabela. Conte o que o seu site precisa em uma conversa com a Brave Cross.

