De SereneReader bot
Wat onze feed-fetcher doet, hoe hij zichzelf identificeert, en hoe u hem kunt weigeren.
Wat SereneReader is
SereneReader is een feedlezer. Wanneer iemand zich abonneert op uw RSS- of Atom-feed, halen onze servers die namens hen op en tonen nieuwe artikelen.
Voor een voorbeeldafbeelding halen we elke artikelpagina eenmalig op om de og:image-tag te lezen, en we halen het favicon van uw site op voor de zijbalk.
User-Agent
Elk verzoek van onze servers identificeert zichzelf met deze string:
SereneReader/1.0 (+https://serenereader.com/bot)Wat we ophalen
- Feed-URL's waarop mensen zijn geabonneerd.
- Elke artikelpagina, eenmalig, waarbij we maximaal 1 MB HTML lezen om de og:image-tag te vinden.
- Het favicon van uw site.
We crawlen nooit een site, volgen geen links op artikelpagina's en halen niets op waarvoor niemand zich heeft geabonneerd.
Hoe vaak
Feeds worden volgens een schema vernieuwd. Wanneer uw server een ETag- of Last-Modified-header stuurt, verzendt de volgende vernieuwing If-None-Match of If-Modified-Since, zodat een ongewijzigde feed slechts een 304 kost zonder body.
Elke artikelpagina wordt eenmalig opgehaald voor de voorbeeldafbeelding. Als de pagina niet bereikbaar is, stoppen we: een permanente fout zoals een 404 wordt 30 dagen onthouden, en een tijdelijke fout zoals een time-out of serverfout wordt nog maximaal drie keer opnieuw geprobeerd met backoff, waarna we de pagina minimaal een uur met rust laten.
Een 429 of 503 geeft aan dat we moeten wachten. Voor feeds verschuiven we de volgende verversing met een oplopende vertraging en, bij een 429, minimaal uw Retry-After-waarde. Voor artikelpagina's proberen we het tot drie keer opnieuw gedurende de volgende tien minuten, daarna wachten we minimaal een uur, of zo lang als uw Retry-After aangeeft, tot maximaal zeven dagen.
robots.txt
Voor het ophalen van een artikelpagina of favicon lezen we uw robots.txt en volgen we de Disallow-regels en crawl-delay voor User-agent: SereneReader, met terugval naar de *-groep.
Feed-URL's werken anders. Een feed wordt opgehaald namens een lezer die erop is geabonneerd, dus we behandelen dit zoals Google's Feedfetcher dat doet: de Disallow-regels van de *-groep zijn hierop niet van toepassing. Een User-agent: SereneReader-groep die het feedpad niet toestaat, wordt wel gerespecteerd, en crawl-delay geldt voor feeds net zoals voor al het andere.
Als uw robots.txt onbereikbaar is door een serverfout, behandelen we dit als toestemming om op te halen. Een abonnement is expliciete toestemming van een lezer — een onbetrouwbaar robots-bestand mag hun feed niet tegenhouden.
Hoe u ons kunt blokkeren
Blokkeer of beperk de bovenstaande User-Agent op uw server of firewall, of wijs ons af in robots.txt met een groep die ons benoemt. Een regel voor alle bots stopt geen feed-ophaalverzoeken; deze wel:
User-agent: SereneReader
Disallow: /Het blokkeren van uw feed-URL stopt vernieuwingen voor iedereen die erop is geabonneerd, niet slechts voor één lezer.
Verzoekhandtekeningen
Verzoeken worden ondertekend met Web Bot Auth (HTTP-berichthandtekeningen, RFC 9421), zodat u kunt verifiëren dat ze echt van ons afkomstig zijn. Onze publieke sleutels zijn gepubliceerd op:
https://serenereader.com/.well-known/http-message-signatures-directoryUitgaande IP-adressen
Geplande feed-verversingen en voorbeeldafbeeldingen worden opgehaald vanaf deze vaste adressen. De eenmalige aanvraag die plaatsvindt wanneer iemand een feed toevoegt, komt van onze webservers en staat niet op deze lijst — een allowlist op IP-adres alleen zal deze aanvraag dus afwijzen.
162.220.234.241
152.55.180.242
152.55.180.243Machineleesbare lijst/bot/ips.json
Contact
Vragen over ons verkeer, of iets dat u wilt laten aanpassen? Neem contact op.