Aller au contenu

Documentation technique

Le robot d'indexation Qlairio

Vous avez repéré Qlairio-Bot dans les journaux de votre serveur. Cette page explique ce qu'il fait, pourquoi il visite votre site et comment le contrôler.

Dernière mise à jour : 16 septembre 2026

En bref

Vous avez repéré Qlairio-Bot dans les journaux de votre serveur. Cette page explique ce qu’il fait, pourquoi il visite votre site et comment le contrôler.

Qlairio-Bot explore les pages publiques d’un site pour permettre à un agent conversationnel de répondre aux questions des visiteurs de ce site, à partir de son contenu. Il ne visite un site que si le titulaire d’un compte Qlairio.ai l’a explicitement demandé et a déclaré détenir les droits nécessaires. Il respecte le fichier robots.txt, se limite à une requête toutes les deux secondes maximum et n’accède à aucune zone protégée par un mot de passe.

Identification

Agent utilisateur Qlairio-Bot/1.0 (+https://www.qlairio.ai/robot)
Opérateur COHERACTIO, 9 rue Louis Forest, 78430 Louveciennes, France — RCS Versailles 507 594 059
Contact contact@qlairio.ai

L’exploration s’effectue depuis une adresse IP fixe. Nous ne la publions pas ici, mais nous la communiquons sur demande aux administrateurs qui souhaitent l’inscrire dans une liste d’autorisation ou de blocage : écrivez-nous depuis une adresse rattachée au domaine concerné.

Tout robot se réclamant de Qlairio depuis une autre adresse que celle que nous vous aurons communiquée n’est pas le nôtre : signalez-le-nous.

Ce qu’il fait

Qlairio.ai est un agent conversationnel que des entreprises installent sur leur site pour répondre aux questions de leurs visiteurs. Pour répondre, l’agent a besoin de connaître le contenu du site. Qlairio-Bot en constitue donc un index : il télécharge les pages publiques, en extrait le texte, le découpe en segments et calcule pour chacun une représentation numérique permettant la recherche par similarité.

Quand un visiteur pose une question, l’agent recherche les segments pertinents dans cet index et les transmet à un modèle de langage qui formule une réponse citant ses sources. L’agent ne répond qu’à partir de ce contenu : il n’invente pas de contexte extérieur et n’a pas accès à d’autres sources.

Ce qu’il ne fait pas

  • Il n’entraîne aucun modèle d’intelligence artificielle. Ni Coheractio ni notre fournisseur de modèle n’utilisent les contenus indexés pour entraîner, affiner ou évaluer un modèle. L’option correspondante est désactivée dans notre contrat avec ce fournisseur, qui n’en conserve par ailleurs aucune copie.
  • Il n’accède à aucune zone authentifiée. Il ne dispose d’aucun identifiant, ne remplit aucun formulaire de connexion et ne suit pas de lien menant à une zone protégée.
  • Il ne collecte pas de données personnelles à dessein. Il traite le texte des pages publiques telles qu’elles sont publiées.
  • Il ne republie pas votre contenu. Les extraits ne sont restitués qu’aux visiteurs du site auquel l’index est rattaché, dans le cadre d’une réponse citant sa source.
  • Il ne revend rien. L’index est propre à un compte client et n’est partagé avec personne.

Comportement technique

Cadence Une requête toutes les 2 secondes maximum
Profondeur par défaut 5 niveaux de liens depuis le point de départ
Points de départ sitemap.xml s’il existe, sinon la page d’accueil
Types de contenus Pages HTML, PDF, documents texte et traitement de texte
Réindexation Incrémentale quotidienne sur les contenus détectables via sitemap.xml ou la page d’accueil ; complète chaque semaine
Rendu JavaScript Non
Respect de robots.txt Oui, vérifié avant chaque exploration
Respect de Crawl-delay Oui, lorsque la valeur est supérieure à 2 secondes
Respect des balises noindex et nofollow Oui

Une requête toutes les deux secondes maximum, soit une charge similaire à celle d’un visiteur humain naviguant activement. Si cette cadence vous pose malgré tout un problème, écrivez-nous : nous la réduirons.

Comment nous exclure

Bloquer entièrement le robot

User-agent: Qlairio-Bot
Disallow: /

Exclure certains répertoires ou certaines pages

User-agent: Qlairio-Bot
Disallow: /prive/
Disallow: /clients/
Disallow: /documents-internes/
Disallow: /page-a-exclure.html

Autoriser une seule partie du site

User-agent: Qlairio-Bot
Disallow: /
Allow: /aide/
Allow: /faq/

Ralentir le robot

User-agent: Qlairio-Bot
Crawl-delay: 30

Exclure une page sans modifier robots.txt

<meta name="robots" content="noindex">

Les modifications du robots.txt sont prises en compte à l’exploration suivante, soit sous 24 heures au plus.

Contenus déjà indexés

Si votre site a été indexé et que vous souhaitez que l’index soit supprimé, écrivez à support@qlairio.ai en indiquant le nom de domaine concerné. Nous identifions le compte client à l’origine de la demande d’indexation, suspendons l’exploration et supprimons l’index.

Chaque client déclare, avant toute indexation, détenir les droits ou autorisations nécessaires sur les contenus qu’il soumet. Si vous estimez qu’une déclaration a été faite à tort sur vos contenus, indiquez-le dans votre message : nous traitons ces signalements en priorité.

Protection des données

Le robot peut incidemment traiter des données personnelles figurant sur des pages publiques : nom d’un collaborateur, coordonnées professionnelles, signature d’un document. Pour ces traitements, Coheractio agit en qualité de sous-traitant du client à l’origine de la demande d’indexation, qui en est responsable.

Le détail figure dans notre politique de confidentialité et notre accord de sous-traitance.

Pour exercer vos droits ou signaler la présence de données personnelles dans un index : rgpd@qlairio.ai.

Nous signaler un problème

Comportement anormal, charge excessive, exploration d’une zone qui aurait dû être exclue, usurpation de notre agent utilisateur : support@qlairio.ai. Nous répondons sous un jour ouvré.