
Resposta direta: robots.txt controla acesso de rastreamento, noindex impede uma página de aparecer nos resultados, nosnippet bloqueia o trecho e o uso direto daquele conteúdo em AI Overviews e AI Mode do Google, max-snippet limita o tamanho do trecho e data-nosnippet exclui apenas seções. Para que o Google leia noindex ou nosnippet, a página precisa estar acessível ao Googlebot.
O erro mais comum é bloquear uma URL no robots.txt e também esperar que o robô enxergue o noindex dentro dela. Se o rastreamento está proibido, a meta tag pode não ser lida. A URL ainda pode aparecer sem trecho quando descoberta por links. Controle começa por distinguir descoberta, rastreamento, indexação e apresentação.
Quatro etapas diferentes
Descoberta ocorre quando o buscador encontra uma URL em links, sitemap ou outras fontes. Rastreamento é a requisição ao recurso. Indexação é a análise e possível inclusão. Apresentação decide título, snippet, imagem e formatos de IA.
Uma diretiva atua em uma etapa. robots.txt não é ferramenta de remoção do índice. Canonical não é garantia de ocultação. nofollow não significa noindex. Entender essas fronteiras evita vazamento e perda de visibilidade.
Quando usar robots.txt
Use robots.txt para gerenciar rastreamento de caminhos que não precisam ser acessados, reduzir carga ou evitar padrões infinitos. Ele é público e não protege informação sensível. Qualquer pessoa pode ler o arquivo.
Não bloqueie CSS e JavaScript necessários à renderização. O Google precisa enxergar a página como usuário. Não bloqueie uma página se pretende que a meta noindex seja processada; permita o rastreamento até a remoção e mantenha a regra.
Para sistemas do Google fora da Busca, agentes diferentes podem existir. Google-Extended é um controle relacionado a treinamento e grounding em alguns sistemas, mas não substitui os controles da Busca. Leia a documentação atual antes de alterar.

Quando usar noindex
Adicione meta robots noindex no head de HTML ou X-Robots-Tag no cabeçalho HTTP. Use para páginas que não devem aparecer: ambiente de teste, resultados internos, combinações sem valor, áreas intermediárias ou arquivos.
Para PDF e outros não HTML, X-Robots-Tag é apropriado. A resposta precisa ser acessível e retornar cabeçalho. Autenticação é mais segura para conteúdo privado; noindex não impede acesso direto.
Depois de adicionar, o Google precisa recrawlear. A remoção não é instantânea. URL Inspection ajuda a ver o HTML recebido. Se a página retorna bloqueio ou redireciona, a diretiva pode não ser processada como esperado.
Nosnippet e max-snippet
nosnippet permite indexação, mas impede trecho textual ou prévia de vídeo. A documentação informa que se aplica à Busca, Imagens, Discover, AI Overviews e AI Mode e impede uso do conteúdo como entrada direta nesses recursos.
Essa escolha reduz a capacidade de mostrar contexto e pode diminuir cliques. Não aplique ao site inteiro sem motivo. Se apenas uma parte é sensível ou licenciada, data-nosnippet pode ser mais preciso.
max-snippet define máximo de caracteres. Valor zero equivale a nosnippet; menos um permite ao Google escolher. Um limite muito baixo pode restringir a utilidade em formatos generativos. Diretivas mais restritivas prevalecem quando há conflito.
Data-nosnippet por seção
O atributo data-nosnippet pode ser colocado em div, span ou section para impedir que aquele texto apareça no snippet. O restante da página continua disponível. Use em preço temporário, conteúdo de assinante, rodapé repetitivo ou trecho com restrição de licença, quando fizer sentido.
O HTML precisa ser válido. Uma tag não fechada pode excluir conteúdo além do planejado. O Google alerta que renderização não é garantida; não adicione ou remova o atributo de nós existentes apenas via JavaScript. Coloque-o desde a criação do elemento.
Dados estruturados podem continuar utilizáveis mesmo dentro de região data-nosnippet, porque são um fornecimento explícito. Revise marcação separadamente e não publique em JSON-LD informação que deseja restringir.
Imagens e vídeo
max-image-preview controla tamanho da prévia; noimageindex impede indexação de imagens da página. max-video-preview define duração. Esses controles afetam recursos de apresentação, não necessariamente rastreamento.
Para conteúdo editorial, permitir imagem grande pode aumentar presença em Discover e resultados visuais, desde que direitos permitam. Para materiais exclusivos, restrinja conscientemente. Verifique licenças antes de liberar.
IA na Busca e outros usos
O Google afirma que as práticas normais de SEO se aplicam a AI Overviews e AI Mode. Para limitar conteúdo nessas experiências, recomenda nosnippet, data-nosnippet, max-snippet ou noindex. robots.txt para Googlebot controla acesso de Busca.
Google-Extended trata alguns usos de treinamento e grounding fora do caminho normal de Busca. Não presuma que uma regra vale para toda empresa ou todo sistema de IA. Cada crawler e produto possui documentação própria.
Mais restrição reduz possibilidade de destaque. A decisão é editorial e jurídica: alcance, proteção, licença e modelo de negócio. Nenhuma configuração garante citação ou ausência absoluta em resumos externos.
Exemplos de decisão
Página pública de serviço
Normalmente deve ser rastreável e indexável, com snippet livre. Conteúdo precisa explicar oferta, região e próximos passos. A Open Leads usa páginas públicas para apresentar tráfego pago e criação de sites.
Página de obrigado
Pode usar noindex, pois não tem valor como entrada orgânica e pode duplicar sinais. Não inclua dados pessoais na URL. A conversão deve tolerar recarregamento.
PDF interno acessível por URL
Se realmente privado, use autenticação. Se público mas não desejado na busca, X-Robots-Tag noindex. Não dependa apenas de robots.txt.
Trecho licenciado em artigo
data-nosnippet pode excluir a seção de previews mantendo a página indexada. Confirme contrato e marcação.
Como auditar
- Liste URLs por tipo e objetivo.
- Confira status HTTP, canonical e meta robots.
- Leia robots.txt e regras específicas por agente.
- Inspecione cabeçalhos de PDFs e arquivos.
- Use URL Inspection para HTML do Googlebot.
- Procure conflitos entre noindex e bloqueio.
- Valide data-nosnippet e fechamento de tags.
- Revise structured data em áreas restritas.
- Solicite recrawl após mudanças importantes.
- Monitore cobertura e desempenho.
Automatize testes no deploy. Templates podem acidentalmente publicar noindex em produção ou remover diretiva de staging. Uma verificação simples evita perdas amplas.
Checklist por objetivo
- Para reduzir rastreamento: robots.txt, sem tratar como segurança.
- Para remover da busca: noindex acessível ao crawler.
- Para arquivo não HTML: X-Robots-Tag.
- Para ocultar todo snippet: nosnippet.
- Para limitar tamanho: max-snippet.
- Para excluir parte: data-nosnippet.
- Para conteúdo privado: autenticação.
- Para imagens: noimageindex ou max-image-preview conforme objetivo.
- Para IA da Busca: controles de preview documentados.
- Para outros sistemas: política específica do agente.
Erros comuns
O primeiro é bloquear no robots.txt e esperar noindex. O segundo é usar noindex como segurança. O terceiro é adicionar nosnippet globalmente. O quarto é confundir nofollow com remoção. O quinto é esquecer PDFs.
Também são comuns conflitos entre plugins, cabeçalhos e HTML; staging indexável; JavaScript inserindo diretiva tarde; canonical para URL bloqueada; e data-nosnippet não fechado. Revise após migrações.
Relação com conteúdo citável
Se o objetivo é ser encontrado e citado, mantenha páginas importantes acessíveis e permita snippets suficientes. Estruture respostas claras e fontes. Veja nosso guia de SEO para buscas e IAs.
Se o objetivo é restringir, aceite o trade-off. nosnippet evita uso direto em AI Overviews e AI Mode, mas reduz preview em resultados tradicionais. A escolha precisa corresponder ao modelo editorial.
Dados estruturados não anulam controles, mas informação explicitamente marcada pode seguir regras próprias. Nosso artigo sobre Organization explica como manter identidade factual.
Perguntas frequentes
robots.txt remove uma página do Google?
Não é o mecanismo correto. Ele bloqueia rastreamento; a URL ainda pode ser conhecida. Use noindex acessível ao Googlebot.
nosnippet impede indexação?
Não. A página pode ser indexada, mas sem snippet textual e com restrições documentadas para recursos de IA.
data-nosnippet funciona em qualquer elemento?
O Google documenta suporte em div, span e section. HTML deve ser válido e o atributo deve estar presente quando o elemento é criado.
noindex protege conteúdo privado?
Não. Quem tiver a URL ainda pode acessar. Use autenticação e controle de autorização.
max-snippet limita AI Overviews?
Segundo o Google, o limite também restringe quanto pode ser usado como entrada direta em AI Overviews e AI Mode, com exceções de permissões específicas.
Quanto tempo uma mudança leva?
Depende do recrawl e processamento; pode levar dias ou mais. Use inspeção e solicite recrawl quando apropriado.
Conclusão
Controle técnico exige precisão: rastrear, indexar e exibir são etapas diferentes. Use robots.txt para acesso, noindex para índice e controles de snippet para apresentação em busca e IA. Proteja conteúdo privado com autenticação. Para auditar SEO técnico e estratégia de conteúdo, conheça os serviços da Open Leads.
Quer transformar tráfego em oportunidades reais? A Open Leads integra mídia paga, mensuração e criação de sites focados em conversão. Conheça os serviços da Open Leads.
Fontes consultadas
Consulte os materiais originais usados na pesquisa deste artigo.
- Robots meta tag, data-nosnippet, and X-Robots-Tag specifications — Google Search Central
- AI features and your website — Google Search Central
- Top ways to ensure your content performs well in Google's AI experiences — Google Search Central Blog
- Featured snippets and your website — Google Search Central
- Introduction to robots.txt — Google Search Central
Tags
Escrito por
Equipe Open Leads