Notre robot d'indexation
Ce que 9ADDECH relève chez les revendeurs, et comment en sortir.
9ADDECH est un comparateur de prix. Pour comparer, il faut relever — automatiquement, sur les pages publiques des boutiques informatiques tunisiennes. Cette page décrit précisément ce que fait ce robot, pour que n'importe quel revendeur puisse décider en connaissance de cause.
Comment identifier notre robot
Nos requêtes portent un seul et même en-tête User-Agent, qui ne change jamais et qui renvoie vers cette page :
9ADDECHBot/1.0 (+https://www.9addech.tn/bot)
Nous n'utilisons aucune rotation d'identité, aucun proxy, aucune adresse IP résidentielle et nous ne tentons de résoudre aucun test anti-robot (CAPTCHA, challenge interactif) : face à un mur de vérification, le robot abandonne la page et la signale comme bloquée. Si vous voyez 9ADDECH dans vos journaux, c'est parce que nous voulons y être visibles.
L'exception, et pourquoi elle existe
Sur expert-gaming.tn, skymil-shop.com, wiki.tn, ce même en-tête reçoit un refus automatique du CDN (erreur 403 ou page vide sans aucun produit) alors que le robots.txt de ces mêmes sites autorise explicitement les pages concernées. Ce refus ne vise pas 9ADDECH en particulier — il frappe tout ce qui ne ressemble pas à un navigateur, y compris Googlebot. Sur ces domaines, et uniquement sur ceux-là, nos requêtes portent donc un User-Agent de navigateur standard.
Nous préférons l'écrire ici plutôt que de le taire. Deux garanties l'encadrent : votre robots.txt continue d'être lu et appliqué en tant que groupe 9ADDECHBot sur ces domaines comme sur les autres — la règle ci-dessous vous arrête donc de la même façon — et une simple demande de votre part nous fait cesser sous 24 heures. Si vous préférez nous laisser passer sous notre vraie identité, il suffit d'autoriser 9ADDECHBot dans les règles de votre CDN, et nous repasserons à l'en-tête déclaré.
robots.txt
Notre robot lit le fichier robots.txt de votre domaine avant chaque requête et le respecte : groupe 9ADDECHBot s'il existe, groupe * sinon. Les directives Disallow, Allow et Crawl-delay sont appliquées — et si votre Crawl-delay est plus long que notre pause habituelle, c'est le vôtre qui s'applique.
Le fichier est mis en cache une heure par domaine, pour ne pas le redemander à chaque page. Si votre serveur répond une erreur 5xx sur robots.txt, nous considérons le domaine comme interdit pour ce passage plutôt que d'insister.
Ajouter ces trois lignes à votre robots.txt suffit à nous arrêter, sans nous écrire :
User-agent: 9ADDECHBot
Disallow: /Ce qui est relevé
Uniquement depuis les pages catégories publiques : le titre du produit, son prix, un éventuel prix promotionnel, l'URL de la fiche produit, l'URL de son image et un indicateur de disponibilité.
Ce qui n'est pas relevé
- Aucune fiche produit n'est ouverte. Le robot ne visite que les pages listes. Il ne collecte donc ni descriptions marketing, ni fiches techniques rédigées, ni avis clients, ni contenu éditorial.
- Rien derrière une authentification, un compte ou un paywall.
- Aucune donnée personnelle : ni client, ni commande, ni stock nominatif.
Comment le contenu est utilisé
- Les prix et disponibilités sont affichés avec la date de leur relevé et un lien direct vers votre fiche produit. Chaque clic sortant vous envoie un visiteur.
- Les titres sont normalisés en caractéristiques structurées (socket, capacité, fréquence…) pour regrouper le même composant vendu par plusieurs boutiques.
- Les images sont affichées depuis vos propres serveurs (lien direct), jamais copiées ni ré-hébergées par 9ADDECH.
- Votre nom de boutique est affiché en clair sur chaque offre et sur la page Boutiques suivies. 9ADDECH ne se substitue jamais au vendeur.
Fréquence
Le relevé tourne chaque nuit mais par rotation : un quart des boutiques par nuit, soit un passage complet environ tous les quatre jours. Chaque passage parcourt un nombre limité de pages listes (au plus 20 par catégorie, 8 catégories) avec une pause de 2 à 2,5 secondes entre chaque requête. La charge induite sur un site reste donc au maximum de l'ordre de 150 requêtes étalées sur plusieurs minutes, tous les quatre jours.
Demander à ne plus être référencé
Écrivez-nous via le formulaire de signalement en choisissant « Information boutique / déréférencement », ou directement par e-mail depuis la page Contact.
Pour une demande de déréférencement d'une boutique, nous nous engageons à répondre et à appliquer le retrait sous 24 heures. Sans discussion et sans condition : c'est votre catalogue. Les autres signalements (image, donnée inexacte, droit d'auteur) sont traités sous 5 jours ouvrés, car ils demandent une vérification.
Concrètement, la sortie du suivi :
- retire immédiatement toutes vos offres du catalogue ;
- arrête le robot sur votre domaine ;
- est persistante — elle est enregistrée en base et le relevé suivant ne peut pas la défaire. C'est une garantie technique, pas une promesse d'exploitation.
Le retrait d'une image en particulier suit la même logique : une fois retirée, elle est inscrite sur une liste de blocage et ne peut pas être réimportée par un relevé ultérieur.
Une alternative au relevé automatique
Si vous préférez nous fournir un flux de données (CSV, XML, API), c'est mieux pour tout le monde : les prix sont plus exacts, la disponibilité est fiable, et votre site ne reçoit plus aucune requête de notre part. Écrivez-nous — voir la page Contact.