Ce qu'est FestroBot
FestroBot est le robot qu'utilise Festro pour tenir à jour un calendrier des événements montréalais. Il lit les pages d'événements et les calendriers publics des salles et des organisateurs afin que ce qui se passe ce soir en ville soit rassemblé au même endroit, avec un lien vers qui vend le billet.
Il lit des faits : titre, date et heure, salle, fourchette de prix, et le lien vers la source. Il ne copie ni vos visuels ni vos textes, et il ne vend rien. Si vous avez trouvé une fiche Festro pour votre propre événement, la page qu'il vous faut est Comment votre événement s'est retrouvé sur Festro.
Comment l'identifier
FestroBot envoie cet en-tête User-Agent à chaque requête : FestroBot/1.0 (+https://festro.com/crawler)
Le jeton de produit — le mot à utiliser dans `robots.txt` — est FestroBot. Les requêtes proviennent d'une infrastructure Google Cloud en Amérique du Nord ; nous ne publions pas de plage d'adresses IP fixe, veuillez donc filtrer sur l'agent utilisateur plutôt que sur une adresse.
Tout ce qui se présente comme FestroBot en ignorant les règles ci-dessous n'est pas nous. Si vous voyez cela, dites-le-nous : nous tenons à le savoir autant que vous.
Comment le bloquer
FestroBot respecte `robots.txt`. Pour l'empêcher entièrement de lire votre site, ajoutez ces deux lignes au fichier `robots.txt` à la racine de votre domaine :
- User-agent: FestroBot
- Disallow: /
Pour ne bloquer qu'une partie du site, indiquez un chemin au lieu de `/` — par exemple `Disallow: /prive/`. Une directive `Crawl-delay:` est également respectée et ne peut que nous ralentir. Les changements prennent effet en moins d'une journée : nous relisons le `robots.txt` au moins toutes les 24 heures.
Si nous n'arrivons pas du tout à lire votre `robots.txt` — erreur serveur, délai dépassé — nous considérons que c'est un « ne pas explorer » et nous arrêtons, plutôt que de présumer une permission. Un fichier absent (un simple 404) signifie qu'il n'y a aucune restriction, selon l'usage courant.
Vous n'êtes pas obligé de modifier un fichier si vous préférez : dites-le-nous au moyen de notre formulaire de retrait et nous couperons votre site de notre côté, le jour même. Voir Corriger ou retirer une fiche.
Comment il se comporte
- Lentement. Au moins une seconde entre deux requêtes vers un même site web, davantage si votre `robots.txt` le demande. Une salle type est lue au plus quelques fois par jour. Les API de billetterie sous licence constituent un chemin distinct, interrogé selon les limites de débit propres à ces programmes — il s'agit d'un appel d'API, et non de l'exploration de votre site.
- Déconnecté. FestroBot ne se connecte jamais, n'utilise aucun compte et n'envoie les identifiants ou la clé d'API de personne.
- HTTP simple. Il n'exécute pas de JavaScript, ne soumet pas de formulaire, ne clique sur rien et ne tente de résoudre aucun test ni CAPTCHA.
- Honnête devant l'échec. Un 429 ou un 5xx le fait reculer. Un blocage le fait arrêter, pas insister.
Si FestroBot cause une charge mesurable sur votre serveur, c'est un bogue de notre côté. Dites-le-nous au moyen de notre formulaire de contact et nous le ralentirons ou le couperons le temps de vérifier.
Ce que nous conservons
D'une page publique d'événements, nous conservons les faits de l'événement et l'URL d'où ils proviennent. Nous conservons la date de la dernière vérification, affichée publiquement sur la fiche pour que le lecteur sache à quel point elle est fraîche. Nous ne gardons pas de copies de vos pages au-delà de ce qui est nécessaire pour en extraire ces faits.
Nous conservons également une copie datée du `robots.txt` et des conditions publiques de chaque source, afin que notre trace de ce qu'un site autorisait, et à quel moment, soit un document et non un souvenir.
Nous joindre
Questions, plaintes ou demande d'arrêt : notre formulaire de contact. Une personne vous lit. Si vous nous demandez d'arrêter, nous arrêtons d'abord et discutons ensuite — inutile d'envoyer une mise en demeure pour obtenir une réponse.