Aller au contenu

NuriBot

Si vous avez trouvé cette page dans vos journaux de serveur, c’est que NuriBot a visité votre site. Voici ce qu’il est, et ce qu’il fait.

Comment il s’identifie

NuriBot/1.0 (+https://nuri-app.com/bot; audit SEO/GEO)

NuriBot s’annonce sous son propre nom. Il ne se fait jamais passer pour le robot d’un autre service.

Deux passes de mesure se présentent comme un navigateur

Sur un échantillon de quarante pages au plus, Nuri charge aussi vos pages dans un vrai navigateur — une fois pour comparer le contenu brut au contenu rendu, une fois pour mesurer la performance. Ces deux passes envoient l’identité d’un navigateur ordinaire, etne consultent pas robots.txt.

La raison est la mesure elle-même : un site qui reconnaît un outil d’analyse peut lui servir une page différente de celle qu’il sert à vos clients, et la mesure ne vaudrait alors plus rien. Comparer ce qu’un robot reçoit à ce qu’un visiteur voit est aussi le seul moyen de détecter qu’un prix ou un bouton d’achat n’apparaît qu’après exécution du JavaScript — donc reste invisible aux IA qui ne l’exécutent pas.

Elles restent identifiables, et c’est fait pour. Toutes les requêtes de Nuri — celles-ci comprises — portent un en-tête X-Nuri-Audit dont la valeur vous est propre. Il ne change pas, ce qui permet à votre pare-feu applicatif de reconnaître notre trafic, de l’exclure de vos statistiques ou de le laisser passer sans limitation de débit — même quand l’identité déclarée est celle d’un navigateur. Demandez-nous votre valeur : elle vous est communiquée à l’ouverture du compte.

Nous préférons vous le dire ici plutôt que vous laisser le découvrir dans vos journaux.

Ce qu’il fait

  • Il ne visite que les sites dont le propriétaire a demandé un audit. Il ne parcourt pas le web au hasard et ne constitue aucun corpus.
  • Il lit le HTML des pages pour en vérifier les titres, les balises, les données structurées, les redirections et les liens cassés. Il ne remplit aucun formulaire, ne se connecte à aucun compte et n’envoie jamais de requête modifiant quoi que ce soit.
  • Il respecte robots.txt et n’explore pas les adresses qui lui sont interdites.
  • L’exploration se limite à deux requêtes par seconde, et passe une fois par semaine. S’y ajoutent quarante pages au plus chargées dans un navigateur, une par une. Nuri n’est pas conçu pour peser sur un serveur.

Comment le bloquer

Ajoutez ces deux lignes à votre robots.txt :

User-agent: NuriBot
Disallow: /

Cela arrête l’exploration, dès le passage suivant — mais pas les deux passes de mesure décrites plus haut, qui ne consultent pas robots.txt et travaillent sur les adresses relevées au dernier passage réussi. Pour un retrait immédiat et complet, écrivez-nous : c’est le seul moyen sûr, et nous le faisons sans discuter.

Notez que l’audit de ce site n’aura alors plus de matière : c’est précisément le constat que Nuri remonte à ses clients sous le nom d’« exploration bloquée ».

Une question, un problème ?

Si NuriBot pose problème sur votre infrastructure, écrivez-nous : nous ajusterons son rythme ou le retirerons du site.

Nous écrire