OdysseusBotOdysseusBot
Ce que fait ce robot lorsqu'il visite un site, les données qu'il conserve et comment bloquer son accès.
- Identification
- En-tête User-Agent, règle de blocage
- Rythme des requêtes
- Au moins 333 ms entre deux requêtes initiées par le robot
- Conservation
- 90 jours, puis suppression automatique
Odysseus est un outil de diagnostic technique de sites web. S'il visite votre site, c'est dans l'un des deux cas suivants : un diagnostic a été commandé pour ce site, ou le site a été analysé dans le cadre d'une démarche de prospection commerciale afin d'identifier des problèmes techniques avant une prise de contact.
Le comportement d'OdysseusBot diffère selon le type d'analyse ; les deux cas peuvent donc être distingués dans les journaux d'accès de votre serveur.
Diagnostic commandé : le robot parcourt le site, charge chaque page avec et sans exécution JavaScript afin d'identifier les contenus ou liens absents du HTML initial, notamment sur certains sites rendus côté client avec React ou Next.js. Il exécute également des contrôles automatisés d'accessibilité (axe-core) et des mesures de performance (Lighthouse) sur une sélection déterministe de pages.
Analyse de prospection : lors de la première analyse, le robot consulte au maximum trois pages et n'exécute pas Lighthouse. Il charge chaque page avec et sans JavaScript et effectue les contrôles automatisés d'accessibilité. Pour un nombre restreint d'établissements présélectionnés, une analyse complète du site est ensuite réalisée selon la même méthode et le même rythme de requêtes qu'un diagnostic commandé. Dans les deux cas, le robot ne crée aucun compte, ne soumet aucun formulaire et n'effectue aucune réservation.
Identification : l'en-tête User-Agent de ses requêtes contient la mention OdysseusBot/1.0. Pour le bloquer, ajoutez ceci à votre fichier robots.txt :
User-agent: OdysseusBot
Disallow: /Rythme des requêtes : OdysseusBot espace d'au moins 333 ms le démarrage des requêtes qu'il initie vers votre site. Si votre fichier robots.txt définit une directive Crawl-delay plus longue, c'est elle qui s'applique. Les sous-ressources chargées par une page ne sont pas comptées comme des démarrages indépendants par ce rythme. Le fichier robots.txt est lu avant toute visite et les pages interdites ne sont jamais chargées.
Nous conservons le rendu des pages et les captures d'écran à des fins de diagnostic uniquement. Ils sont supprimés automatiquement après 90 jours et ne sont ni vendus ni transmis à des tiers pour leur propre usage. Pour une analyse de prospection, l'origine des données, leur usage et la marche à suivre pour s'y opposer sont détaillés sur la page prospection et données personnelles.
Contact : contact@odysseusaudit.fr, pour toute question ou pour demander le retrait de votre site de toute analyse en cours ou future. La page ne plus être contacté explique ce qui se passe ensuite.
Mentions légales : entreprise individuelle en cours d'immatriculation (micro-entrepreneur, France). Numéro SIREN en attente d'attribution.
What this crawler does when it visits a website, what data it retains, and how to block it.
- Identification
- User-Agent header, blocking rule
- Request pacing
- At least 333 ms between crawler-initiated request starts
- Retention
- 90 days, then automatic deletion
Odysseus is a technical website diagnostic tool. If it visits your site, one of two things is happening: a diagnostic has been commissioned for the site, or the site is being analysed as part of commercial outreach to identify technical issues before we make contact.
OdysseusBot behaves differently in each case, so the two types of analysis can be distinguished in your server access logs.
Commissioned diagnostic: the crawler moves through the site and loads each page with and without JavaScript to identify content or links that are absent from the initial HTML, including on some client-rendered React or Next.js sites. It also runs automated accessibility checks with axe-core and Lighthouse performance measurements on a deterministic selection of pages.
Outreach analysis: during the initial analysis, the crawler accesses no more than three pages and does not run Lighthouse. It loads each page with and without JavaScript and runs the automated accessibility checks. For a small number of pre-selected establishments, a full-site analysis then follows using the same method and request pacing as a commissioned diagnostic. In both cases, the crawler creates no account, submits no form and makes no booking.
Identification: the User-Agent header on its requests contains OdysseusBot/1.0. To block it, add the following rule to your robots.txt file:
User-agent: OdysseusBot
Disallow: /Request pacing: OdysseusBot spaces crawler-initiated request starts to your site by at least 333 ms. If your robots.txt file specifies a longer Crawl-delay, that value takes precedence. Subresources loaded by a page are not counted as independent starts by this pacing rule. robots.txt is read before any page is visited, and disallowed pages are never loaded.
We retain rendered pages and screenshots for diagnostic purposes only. They are automatically deleted after 90 days and are neither sold nor disclosed to third parties for their own use. For outreach analysis, the source of the data, how it is used and how to object are explained on the outreach and personal data page.
Contact: contact@odysseusaudit.fr for any question, or to ask us to remove your site from current or future analysis. The opt-out page explains what happens next.
Legal: sole proprietorship in the process of registration (micro-entrepreneur, France). SIREN number pending assignment.