Robot d'indexation
À propos de TrouveKABot
Qu'est-ce que TrouveKABot?
TrouveKABot est le robot d'indexation de Trouve-KA, un moteur de recherche indépendant consacré au web québécois. Il visite des pages web publiques pour les comprendre, les classer et les rendre trouvables par les gens du Québec.
Pourquoi crawle-t-il votre site?
Votre site a probablement été découvert par un lien depuis un autre site québécois, un sitemap public ou une soumission d'utilisateur. TrouveKABot lit les pages accessibles publiquement afin de construire un index de recherche : il renvoie ensuite les internautes directement vers votre site — jamais l'inverse.
Identité (user-agent)
Le robot s'identifie toujours avec ce user-agent exact :
Mozilla/5.0 (compatible; TrouveKABot/0.1; +https://www.trouve-ka.com/trouveka-bot)Respect de robots.txt
TrouveKABot respecte le standard robots.txt ainsi que les directives noindex, nofollow, canonical et l'en-tête X-Robots-Tag. Les règles sont mises en cache et revérifiées régulièrement.
Comment le bloquer
Pour empêcher TrouveKABot de visiter votre site, ajoutez ceci à votre fichier robots.txt :
User-agent: TrouveKABot
Disallow: /Le blocage est pris en compte dès la prochaine lecture de votre robots.txt. Vous pouvez aussi nous écrire pour un retrait manuel.
Comportement poli
- Au plus une ou deux requêtes simultanées par site, avec des délais entre chaque requête.
- Adresses IP stables — aucune rotation de proxys.
- Aucune technique de dissimulation (« stealth »).
- Cache HTTP (ETag, Last-Modified) pour éviter de retélécharger des pages inchangées.
Contact
Une question, un problème ou une demande de retrait ? Écrivez-nous : contact@spboucher.ai.