Pular para o conteúdo
DocumentaçãoInteligênciaWACI-1.0: Web & AI Crawler Intelligence
InteligênciaContrato atualVersão DOCS-2.0

WACI-1.0: Web & AI Crawler Intelligence

Audite discovery, crawl, indexabilidade, estrutura semântica, legibilidade por IA e políticas observáveis para agentes em sites próprios ou autorizados.

Como interpretar este documento

Este conteúdo descreve o comportamento técnico e metodológico implementado ou explicitamente planejado no produto. Quando um controle depende de configuração, provider, secret, contrato ou aprovação jurídica, essa dependência deve permanecer visível.

O que o WACI resolve

WACI-1.0 conecta saúde técnica do site ao ciclo de AI Visibility. O scanner procura barreiras que podem dificultar descoberta, leitura, interpretação ou uso do conteúdo como evidência por mecanismos de busca e sistemas de IA.

Escopo seguro

O crawler aceita apenas HTTP/HTTPS, bloqueia alvos locais ou de rede privada, limita páginas e profundidade, segue redirects de forma controlada e restringe o baseline ao mesmo origin. Targets próprios ou autorizados devem ser explicitamente cadastrados.

Robots e agentes

O produto lê robots.txt e registra a regra observável para diferentes categorias de agentes, como search, training e user-initiated. Allowed, blocked ou unspecified descrevem a diretiva observada; não são garantia de comportamento futuro do provedor.

Sinais por página

Cada página persiste status HTTP, title, description, canonical, robots meta, H1/headings, volume textual, links, JSON-LD, hreflang, Open Graph, Twitter Card, conteúdo principal, risco de shell JavaScript e indicadores de indexabilidade/crawlability.

Crawler Readiness Score

O score WACI-1.0 combina discoverability, crawlability, indexability, semantic structure, AI readability, entity clarity, structured data e freshness. É um índice técnico interno e não garante ranking, indexação ou citação por qualquer IA.

Findings

Problemas são classificados por categoria e severidade. Exemplos incluem robots/sitemap ausentes, erros HTTP, canonical ausente, noindex, estrutura H1 inconsistente, dependência excessiva de JavaScript e falta de dados estruturados quando aplicáveis.

Recommendation Management

Findings High e Critical geram ou atualizam recomendações REC-1.0 com deduplicação por fingerprint. O re-scan posterior fornece nova evidência para verificar se a condição técnica realmente mudou.

llms.txt

A presença de llms.txt é tratada como sinal auxiliar de GEO/AEO, não como requisito universal de indexação ou como mecanismo de controle de crawler equivalente a robots.txt.