Dernière mise à jour : 16/09/2026
Fabien Raquidel
Consultant SEO freelance
Paris, France
Courriel : contact@referenceur-web.pro
Directeur de la publication : Fabien Raquidel.
o2switch
SAS au capital de 100 000 €
Chemin des Pardiaux, 63000 Clermont-Ferrand, France
SIRET 510 909 807 00032, RCS Clermont-Ferrand
www.o2switch.fr
L'ensemble des éléments de ce site, textes, mise en page, code, logo et illustrations, est la propriété exclusive de Fabien Raquidel, sauf mention contraire. Toute reproduction ou représentation, totale ou partielle, sans autorisation écrite préalable est interdite.
Les données affichées par l'outil proviennent de l'index public de Common Crawl, organisation à but non lucratif, ainsi que des serveurs des sites analysés. Elles restent la propriété de leurs détenteurs respectifs. Les marques et noms de robots cités, CCBot, GPTBot, ClaudeBot, PerplexityBot et Google-Extended, appartiennent à leurs éditeurs et ne sont mentionnés qu'à titre descriptif.
Cet outil est mis à disposition gratuitement, à titre informatif. Il effectue trois mesures au moment où vous le sollicitez : la lecture du fichier robots.txt du domaine analysé, une requête vers ce domaine et une interrogation de l'index public de Common Crawl.
Les résultats reflètent l'état de ces sources à l'instant de la mesure. Ils peuvent varier d'une consultation à l'autre, notamment parce que l'index de Common Crawl est parfois momentanément incomplet, mais aussi parce qu'un serveur peut répondre différemment selon le moment. Ils sont fournis sans garantie d'exactitude ni d'exhaustivité et ne constituent ni un audit contractuel ni un conseil professionnel.
La présence d'un site dans Common Crawl indique qu'il a été exploré. Elle ne démontre pas qu'un modèle de langue a été entraîné sur son contenu, ni qu'il sera cité dans une réponse. L'éditeur ne saurait être tenu responsable des décisions prises sur la base des informations affichées, ni des conséquences d'une modification de configuration effectuée à leur suite.
L'outil s'adresse aux personnes qui souhaitent analyser un site dont elles ont la responsabilité. Les requêtes émises sont limitées en nombre et strictement identiques à celles d'un robot d'indexation ordinaire.
Le site ne demande aucune inscription et aucun compte. Il ne collecte aucune donnée sur vous, à une exception près, décrite plus bas : l'adresse que vous laissez si vous demandez un rapport de backlinks.
Deux éléments seulement sont enregistrés sur le serveur, à chaque analyse :
Votre adresse IP n'est jamais enregistrée. Elle est transformée par une fonction à sens unique, avec un sel secret. Seuls quatre caractères du résultat sont conservés. Cela permet de distinguer deux visiteurs sur une même journée et non d'en identifier un seul. Le responsable du traitement n'est donc pas en mesure de rattacher ces enregistrements à une personne.
Ces éléments servent à deux choses : mesurer l'usage du service et le protéger contre les abus, en limitant le nombre d'analyses par visiteur. La base légale est l'intérêt légitime de l'éditeur à assurer le bon fonctionnement et la sécurité du service.
Les compteurs anti-abus sont effacés au bout d'une heure. Le journal des analyses est conservé 12 mois, puis supprimé automatiquement. Aucune donnée n'est transmise, vendue ni cédée à un tiers. Aucun service d'analyse d'audience n'est installé.
Conformément au règlement général sur la protection des données, vous disposez de droits d'accès, de rectification, d'effacement, de limitation et d'opposition. Vous pouvez les exercer à l'adresse contact@referenceur-web.pro. Compte tenu de ce qui précède, l'éditeur n'est pas en mesure de vous identifier au sein des enregistrements conservés. Il pourra vous demander des éléments complémentaires ou vous indiquer qu'aucune donnée vous concernant n'est identifiable. Vous pouvez également introduire une réclamation auprès de la CNIL.
Ce rapport ne peut pas être calculé pendant que vous attendez : il demande de lire l'intégralité du graphe de liens de Common Crawl, près de dix gigaoctets, ce qui prend une vingtaine de minutes. Le calcul est donc groupé et lancé une fois par nuit pour toutes les demandes en attente. C'est la seule raison pour laquelle une adresse est demandée.
L'adresse ne sert qu'à vous prévenir, une fois. Elle est enregistrée avec le domaine demandé, utilisée pour l'envoi du message annonçant que le rapport est prêt, puis effacée dans la foulée. Elle n'est ni transmise, ni revendue, ni utilisée pour vous écrire autre chose. Il n'y a aucune lettre d'information et aucun envoi ultérieur.
Le rapport lui-même reste accessible trente jours par un lien contenant un identifiant aléatoire, puis il est supprimé automatiquement, avec la demande qui l'a produit. La base légale est l'exécution de la demande que vous formulez.
L'hébergeur conserve pour sa part des journaux de connexion techniques, dans les conditions prévues par la réglementation et par ses propres conditions.
Ce site n'utilise aucun cookie. Il ne dépose rien dans votre navigateur, n'emploie ni stockage local, ni pixel, ni identifiant publicitaire. Il n'installe aucun outil de mesure d'audience.
Aucune ressource n'est chargée depuis un service tiers : ni police d'écriture distante, ni bibliothèque externe, ni image hébergée ailleurs. Votre navigateur ne communique donc qu'avec ce seul domaine. C'est aussi pour cette raison qu'aucune bannière de consentement n'est nécessaire.
Le site renvoie vers des ressources externes, notamment la documentation de Common Crawl, de Cloudflare, d'OpenAI et des jeux de données cités. L'éditeur n'exerce aucun contrôle sur leur contenu et décline toute responsabilité à leur égard.
Les présentes mentions sont régies par le droit français. En cas de litige et à défaut de résolution amiable, les tribunaux français sont compétents.