Générateur de Robots.txt

Générez un fichier robots.txt pour contrôler quels robots peuvent accéder à votre site.

Cet outil fonctionne entièrement dans votre navigateur. Vos fichiers ne sont jamais envoyés à un serveur.

User-agent: *
Allow: /

Fonction de cet outil

Crée un brouillon robots.txt UTF-8 pour le groupe universel d'agents. Il peut ajouter une règle Allow explicite pour la racine, des chemins Disallow relatifs et validés, ainsi qu'une adresse absolue HTTP ou HTTPS de sitemap.

Mode d'emploi

Saisissez un chemin commençant par une barre par ligne, ajoutez éventuellement l'URL canonique du sitemap et relisez le texte. Publiez le fichier texte à /robots.txt sur le protocole, l'hôte et le port exacts qu'il doit régir.

Exemple expliqué

Le blocage de /admin/ et /search?sort= produit deux enregistrements Disallow sous User-agent: *. La valeur https://example.com/sitemap.xml est ajoutée séparément comme enregistrement Sitemap absolu.

Méthode de validation

Le générateur nettoie et déduplique les chemins, refuse les lignes sans barre initiale, les commentaires et caractères de contrôle, puis n'accepte que les URL de sitemap HTTP ou HTTPS sans identifiants ni fragment. Les entrées invalides sont signalées et omises.

Fonctionnement des correspondances

Les règles sont sensibles à la casse et correspondent aux préfixes de chemin. Selon la RFC 9309, la règle Allow ou Disallow correspondante la plus spécifique l'emporte; à spécificité égale, Allow doit être préféré. Testez les URL importantes avec le robot visé.

Exploration, indexation et sécurité diffèrent

Disallow demande aux robots conformes de ne pas récupérer un chemin; il n'authentifie rien et une URL bloquée peut être indexée via d'autres signaux. Protégez les données privées par contrôle d'accès et utilisez une réponse noindex explorable pour l'exclusion de recherche.

Confidentialité et vérification

La génération reste locale et Quiklio ne transmet ni chemins ni sitemap. Vérifiez que le fichier publié répond HTTP 200 en texte UTF-8 à la racine, puis testez des URL représentatives avec les outils du moteur concerné; recommandations Google et RFC 9309 vérifiées en septembre 2026.

Questions Fréquentes

Où placer robots.txt ?
À la racine de votre domaine, par ex. https://example.com/robots.txt — il ne sera lu à aucun autre emplacement.
Disallow garantit-il qu'une page reste hors de Google ?
Non — cela bloque seulement l'exploration. Utilisez une balise meta noindex ou une protection par mot de passe pour exclure totalement des pages des résultats.
Pourquoi l'outil n'ajoute-t-il pas Crawl-delay ?
Crawl-delay ne fait pas partie de la RFC 9309 et Google ne le documente pas comme règle robots.txt compatible. Utilisez les mécanismes documentés par le robot concerné.