/** * Trouve-KA — page publique du robot TrouveKABot * Author: Simon-Pierre Boucher * Contact: contact@spboucher.ai */ import type { Metadata } from "next"; export const metadata: Metadata = { title: "À propos de TrouveKABot", description: "TrouveKABot est le robot d'indexation de Trouve-KA. Identité, comportement, respect de robots.txt et façon de le bloquer.", }; const USER_AGENT = "Mozilla/5.0 (compatible; TrouveKABot/0.1; +https://www.trouve-ka.com/trouveka-bot)"; export default function TrouvekaBotPage() { return (

Robot d'indexation

À propos de TrouveKABot

Qu'est-ce que TrouveKABot?

TrouveKABot est le robot d'indexation de{" "} Trouve-KA, un moteur de recherche indépendant consacré au web québécois. Il visite des pages web publiques pour les comprendre, les classer et les rendre trouvables par les gens du Québec.

Pourquoi crawle-t-il votre site?

Votre site a probablement été découvert par un lien depuis un autre site québécois, un sitemap public ou une soumission d'utilisateur. TrouveKABot lit les pages accessibles publiquement afin de construire un index de recherche : il renvoie ensuite les internautes directement vers votre site — jamais l'inverse.

Identité (user-agent)

Le robot s'identifie toujours avec ce user-agent exact :

            {USER_AGENT}
          

Respect de robots.txt

TrouveKABot respecte le standard robots.txt ainsi que les directives noindex, nofollow,{" "} canonical et l'en-tête X-Robots-Tag. Les règles sont mises en cache et revérifiées régulièrement.

Comment le bloquer

Pour empêcher TrouveKABot de visiter votre site, ajoutez ceci à votre fichier robots.txt :

            {"User-agent: TrouveKABot\nDisallow: /"}
          

Le blocage est pris en compte dès la prochaine lecture de votre{" "} robots.txt. Vous pouvez aussi nous écrire pour un retrait manuel.

Comportement poli

  • Au plus une ou deux requêtes simultanées par site, avec des délais entre chaque requête.
  • Adresses IP stables — aucune rotation de proxys.
  • Aucune technique de dissimulation (« stealth »).
  • Cache HTTP (ETag, Last-Modified) pour éviter de retélécharger des pages inchangées.

Contact

Une question, un problème ou une demande de retrait ? Écrivez-nous :{" "} contact@spboucher.ai .

); }