Brave
Cross

O intervaloentre ver e entender

IA8 min de leitura

Site preparado para IA: schema, llms.txt e renderização, o checklist técnico para ser citado

O que um site precisa ter, no código, para ser lido e citado por ChatGPT e Modo IA do Google: renderização no servidor, robots.txt, schema e llms.txt, item por item.

8 min · Brave Cross
Neste texto

Um site preparado para IA entrega o texto pronto no HTML, deixa os robôs de busca e de IA entrarem, descreve a empresa em dados estruturados e oferece um mapa enxuto em llms.txt. Nessa ordem: sem a primeira parte, schema e llms.txt não salvam ninguém.

O que significa, no código, um site preparado para IA?

Significa que a pessoa, o robô do Google e os robôs de IA que alimentam ChatGPT, Claude e Perplexity recebem a mesma informação. Este guia cobre o lado técnico, o que quem constrói ou encomenda o site precisa exigir. A estratégia de conteúdo está no guia como aparecer no ChatGPT e no Modo IA do Google.

O assunto ganhou peso no Brasil desde que o Google anunciou o Modo IA em português, segundo a Forbes Brasil em 8 de setembro de 2025. Se a busca tradicional ainda compensa nesse cenário, discutimos em SEO ainda vale a pena em 2026.

Por que a renderização vem antes de tudo?

Porque os robôs leem o site de jeitos diferentes. A documentação de JavaScript do Google Search Central (atualizada em março de 2026) descreve três fases: rastreamento, renderização num Chromium sem tela e indexação. A página pode esperar na fila de renderização, e o próprio Google recomenda renderizar no servidor ou pré-renderizar, porque nem todo robô executa JavaScript.

Com os robôs de IA é pior. Uma análise da Vercel publicada em dezembro de 2024 concluiu que nenhum dos grandes rastreadores de IA renderizava JavaScript: GPTBot, OAI-SearchBot, ClaudeBot e PerplexityBot baixam scripts, mas não os executam.

Se o preço ou a lista de serviços aparecem só depois que um script roda, a IA não vê. Next.js e frameworks parecidos resolvem com renderização no servidor ou geração estática: a animação continua, o texto sai pronto no HTML. Velocidade conta junto, e está detalhada em Core Web Vitals em 2026.

Quais robôs precisam de passagem no robots.txt?

A documentação de rastreadores da OpenAI separa três agentes: OAI-SearchBot (busca do ChatGPT), GPTBot (treino de modelos) e ChatGPT-User (visita a pedido do usuário). Quem bloqueia o OAI-SearchBot não aparece nas respostas de busca do ChatGPT.

São decisões independentes: dá para liberar a busca e negar o treino. O erro comum é herdar de um plugin de segurança um robots.txt que bloqueia tudo que não é Google.

User-Agent: OAI-SearchBot
User-Agent: ChatGPT-User
User-Agent: PerplexityBot
Allow: /
Disallow: /api/

Sitemap: https://seusite.com.br/sitemap.xml

Que schema markup uma empresa deve ter?

Dados estruturados descrevem em JSON-LD o que a página é, com o vocabulário do schema.org. Para uma empresa de serviços, o núcleo é Organization (ou um subtipo de LocalBusiness) na página inicial, Service nas páginas de serviço, BlogPosting nos artigos e BreadcrumbList em todas.

{
  "@context": "https://schema.org",
  "@type": "Organization",
  "name": "Sua Empresa",
  "url": "https://seusite.com.br",
  "logo": "https://seusite.com.br/logo.png",
  "sameAs": ["https://www.instagram.com/suaempresa"],
  "contactPoint": {
    "@type": "ContactPoint",
    "contactType": "sales",
    "areaServed": "BR",
    "availableLanguage": "pt-BR"
  }
}

Dois cuidados. O schema precisa repetir o que está visível na página. E escolha o tipo mais específico que existir: a própria página do tipo ProfessionalService no schema.org avisa que ele foi depreciado por confusão com Service e recomenda subtipos como Attorney, Dentist ou AccountingService. Na home da Brave Cross usamos Organization combinado com ProfessionalService; quem começa do zero deve preferir o subtipo do próprio ramo.

Dados estruturados FAQPage ainda valem a pena?

Para aparecer com perguntas expansíveis no Google, não. O registro de atualizações do Google Search Central informa que o resultado aprimorado de FAQ deixou de aparecer na Busca a partir de 7 de maio de 2026, depois de anos restrito a sites governamentais e de saúde; em junho de 2026 o Google retirou a própria documentação do recurso.

O markup segue válido no schema.org, e perguntas com respostas literais seguem úteis para quem recorta trechos. Use FAQPage só onde houver perguntas reais e visíveis.

{
  "@context": "https://schema.org",
  "@type": "FAQPage",
  "mainEntity": [{
    "@type": "Question",
    "name": "Quanto tempo leva um site institucional?",
    "acceptedAnswer": {
      "@type": "Answer",
      "text": "Resposta curta e igual à que aparece na página."
    }
  }]
}

llms.txt: o que é e o que ele não faz?

É um arquivo em Markdown na raiz do site que resume o que importa para um modelo de linguagem. A proposta oficial em llmstxt.org, criada por Jeremy Howard em setembro de 2024, exige só um título H1; o resumo em citação e as listas de links sob títulos H2 são opcionais. A ideia é caber no contexto do modelo e apontar para páginas limpas.

O limite: o Google diz, na documentação sobre recursos de IA na Busca, que não é preciso criar arquivos de IA, arquivos legíveis por máquina nem schema especial para aparecer em AI Overviews ou no Modo IA. É um complemento barato para outros assistentes, não um atalho para o Google.

Um exemplo: o llms.txt da Brave Cross tem H1, resumo em citação, seções Páginas, Blog, Recursos e Contato, e aponta para /blog/llms-full.txt, com o texto completo dos artigos (convenção nossa, fora da proposta).

# Sua Empresa

> Estúdio de arquitetura em Belo Horizonte. Projetos residenciais e comerciais.

## Páginas
- [Serviços](https://seusite.com.br/servicos): o que fazemos e para quem
- [Contato](https://seusite.com.br/contato): como pedir orçamento

Como verificar cada item?

ItemO que éComo verificar
Renderização no servidorTexto principal presente no HTML entregue, sem depender de JavaScript"Exibir código-fonte" e busca por uma frase do meio da página
robots.txtRegras de acesso por robô (Googlebot, OAI-SearchBot, ClaudeBot, PerplexityBot)Abrir seusite.com.br/robots.txt e conferir se nenhum deles está em Disallow: /
SitemapLista das URLs que devem ser indexadasAbrir /sitemap.xml e enviar no Google Search Console
Organization ou subtipoIdentidade da empresa em JSON-LD na página inicialValidador do schema.org na página inicial
BlogPosting e BreadcrumbListAutor, data e trilha de cada artigoValidador do schema.org em uma URL de post
FAQPagePerguntas e respostas visíveis marcadas em JSON-LDValidador do schema.org; sem resultado aprimorado no Google desde maio de 2026
llms.txtResumo em Markdown com links para as páginas principaisAbrir /llms.txt e conferir H1, resumo e links funcionando
Canônico e título únicoUma URL oficial e um título por páginaCódigo-fonte: tag link rel="canonical" e tag title

Fontes: Google Search Central (recursos de IA, dez/2025; JavaScript, mar/2026; registro de atualizações sobre FAQ, mai/2026), documentação de rastreadores da OpenAI e proposta llmstxt.org, consultadas em outubro de 2026.

Qual é a ordem certa para implementar?

01

Renderização

Garantir que o texto principal de cada página saia pronto do servidor

02

Acesso

Revisar o robots.txt e liberar os robôs de busca e de IA que interessam

03

Indexação

Publicar sitemap, canônicos e títulos únicos, e enviar ao Search Console

04

Identidade

Marcar a empresa com Organization ou o subtipo do ramo na página inicial

05

Conteúdo

Marcar artigos com BlogPosting e BreadcrumbList, e FAQPage onde houver perguntas reais

06

Mapa

Publicar um llms.txt curto com as páginas que respondem às perguntas do cliente

Nenhum item custa caro quando entra no projeto desde o início; refazer um site renderizado só no navegador, sim. Se você está orçando um site, leia quanto custa um site profissional em 2026 e inclua este checklist no briefing. Regras de setor que precisam estar no texto visível estão em site para clínica, imobiliária e indústria.

Perguntas frequentes

O que é llms.txt e para que serve?

É um arquivo em Markdown publicado em /llms.txt que resume o site para modelos de linguagem e lista links para as páginas principais. A proposta em llmstxt.org, de setembro de 2024, só exige um título H1. O Google afirma, em documentação de dezembro de 2025, que não precisa dele para AI Overviews nem para o Modo IA.

Preciso de schema para aparecer no Modo IA do Google?

Não há schema obrigatório. A documentação do Google sobre recursos de IA, atualizada em dezembro de 2025, diz que basta a página estar indexada e apta a aparecer com snippet na busca comum. Dados estruturados ajudam a descrever a empresa e os serviços com precisão, mas não são requisito.

O ChatGPT consegue ler um site feito em React?

Depende da entrega. Segundo análise da Vercel de dezembro de 2024, os robôs da OpenAI não executam JavaScript. Se o site React for renderizado no servidor ou gerado de forma estática, como o Next.js permite, o texto chega pronto. Se for montado só no navegador, o robô recebe uma página quase vazia.

Dados estruturados FAQPage ainda funcionam no Google?

O markup continua válido no schema.org, mas o Google deixou de mostrar o resultado aprimorado de FAQ a partir de 7 de maio de 2026, segundo o registro de atualizações do Google Search Central. Vale manter onde há perguntas reais e visíveis, sem esperar efeito na página de resultados.

Bloquear o GPTBot tira meu site do ChatGPT?

Não necessariamente. A OpenAI documenta que o GPTBot coleta conteúdo para treino e que a busca do ChatGPT usa outro robô, o OAI-SearchBot. Quem bloqueia só o GPTBot pode continuar aparecendo nas respostas com busca. Quem bloqueia o OAI-SearchBot, segundo a própria OpenAI, deixa de aparecer nessas respostas.

Peça o checklist aplicado ao seu site

Ser citado por uma IA começa no código: texto no HTML, acesso liberado no robots.txt, identidade clara em JSON-LD e um mapa curto em llms.txt. Mais estudos técnicos como este estão no blog da Brave Cross.

O site da Brave Cross é feito em Next.js, com renderização no servidor, dados estruturados e llms.txt, e podemos revisar o seu com esta tabela. Conte o que o seu site precisa em uma conversa com a Brave Cross.

  • site preparado para IA
  • llms.txt o que é
  • schema markup para empresa
  • dados estruturados FAQPage
  • renderização e indexação por IA

O que não cabe numa nota cabe numa conversa.

  1. 01IA

    Como aparecer no ChatGPT e no Modo IA do Google: guia de AEO e GEO para empresas brasileiras

    AEO e GEO sem mistério: o que o Google e a OpenAI dizem, o que os estudos mostram sobre as fontes citadas e um checklist para sua empresa virar resposta.

    8 min de leituraLer
  2. 02IA

    Agente de IA no WhatsApp em 2026: o que a Meta e a LGPD permitem, e como treinar a IA no seu negócio

    A Meta barrou assistentes de IA genéricos na API, mas o bot do próprio negócio segue liberado. O que a LGPD pede e como treinar a IA sem perder o controle.

    8 min de leituraLer
  3. 03IA

    IA que recria um site a partir de um print: o que v0, Bolt e Lovable acertam (e o que só o arquivo original guarda)

    A IA lê layout, cores e componentes de uma imagem. Animação, hover, 3D, fontes e lógica não estão no print. O que cada ferramenta entrega e onde o original faz falta.

    7 min de leituraLer