IAMatinBot
IAMatinBot lit les flux RSS d’une sélection de médias et de blogs consacrés à l’intelligence artificielle, pour préparer l’édition quotidienne de l’application IA Matin.
Identification
IAMatinBot/0.1 (+https://iamatin.lobodart.dev/bot/)
Ce qu’il fait
- Il lit les flux RSS des sources suivies, toutes les deux heures environ.
- Pour les sites qui l’autorisent, il télécharge une fois la page de chaque nouvel article, afin d’en extraire le texte. Ce texte sert uniquement à rédiger une synthèse originale ; il n’est jamais republié et n’est pas accessible aux lecteurs.
- Chaque synthèse cite ses sources et renvoie vers les articles originaux.
Opposition à la fouille de textes
Le texte complet des articles n’est pas utilisé si votre site :
- bloque IAMatinBot, ou tous les robots, dans son
robots.txt; - bloque les principaux robots d’IA dans son
robots.txt(GPTBot, ClaudeBot, anthropic-ai, CCBot, Google-Extended, PerplexityBot, meta-externalagent) ; - déclare une réserve de fouille de textes et de données (article 4 de la directive (UE) 2019/790) via
/.well-known/tdmrep.json, l’en-tête HTTPtdm-reservation: 1ou la balise<meta name="tdm-reservation" content="1">.
Dans ce cas, seuls le titre et un court extrait (500 caractères au plus) issus de votre flux RSS sont utilisés, avec un lien vers l’article. Ces signaux sont vérifiés à l’ajout de chaque source, puis à nouveau régulièrement.
Bloquer IAMatinBot
Ajoutez ces lignes à votre robots.txt :
User-agent: IAMatinBot
Disallow: /
Pour que votre site ne soit plus du tout suivi, y compris son flux RSS, écrivez à contact@louisbodart.fr : la source est retirée sous 48 heures.
