Aller au contenu
indexatioTélécharger l'appTélécharger

TECHNIQUE

Fichier robots.txt, c'est quoi ?

Un fichier à la racine du site qui dit aux robots où ils peuvent aller. Il n'empêche pas l'indexation, il empêche l'exploration, ce qui n'est pas la même chose.

En clair

Le fichier robots.txt se place à la racine du site et indique aux robots les chemins qu'ils peuvent parcourir. C'est une consigne, respectée par les robots sérieux, ignorée par les autres.

Un exemple concret

Un site de petites annonces bloque dans son robots.txt les milliers de pages de recherche interne, qui n'apportent rien. Le robot de Google passe alors son temps sur les annonces elles-mêmes, qui sont celles qu'on veut voir sortir.

Pourquoi ça compte

Il évite de faire perdre du temps aux robots sur des pages sans intérêt, et il déclare l'adresse de ton sitemap.

Comment t'en servir

  1. Ouvre tonsite.fr/robots.txt pour voir ce qui est bloqué aujourd'hui.
  2. Ne bloque jamais une page que tu veux voir dans Google.
  3. Pour retirer une page des résultats, utilise une balise noindex, pas le robots.txt.

L'erreur fréquente

Il empêche l'exploration, pas l'indexation. Pour qu'une page disparaisse vraiment des résultats, il faut la laisser accessible et y poser une balise noindex.

Les questions qu'on se pose ensuite

De la définition à la pratique

Une définition explique. Un exercice fait retenir. L'application te fait écrire la réponse, pas la regarder.

Télécharger dansl'App Store

Gratuit pour commencer, sans carte bancaire.