Rastreio é a descoberta e leitura de páginas por um motor de pesquisa. Indexação é a análise e possível inclusão do conteúdo no seu índice. Uma página pode ser rastreada sem ser indexada.
Ligações internas e sitemaps ajudam a descobrir endereços. A página também deve responder corretamente e apresentar conteúdo que possa ser lido. Um endereço que devolve erro ou depende de uma interação para mostrar a informação principal pode dificultar esse trabalho.
O ficheiro robots.txt controla pedidos de rastreio; a diretiva noindex comunica que uma página não deve ser incluída no índice. Se o rastreio estiver bloqueado, o motor pode não conseguir ler o noindex. Nenhum destes mecanismos garante que todas as outras páginas sejam indexadas.