Der SereneReader Bot
Was unser Feed-Abrufdienst macht, wie er sich identifiziert und wie Sie ihn abweisen können.
Was SereneReader ist
SereneReader ist ein Feed-Reader. Wenn jemand Ihren RSS- oder Atom-Feed abonniert, rufen unsere Server ihn in deren Namen ab und zeigen ihnen neue Artikel.
Um eine Vorschau anzuzeigen, rufen wir jede Artikelseite einmalig ab, um das og:image-Tag zu lesen, und laden das Favicon Ihrer Website für die Seitenleiste.
User-Agent
Jede Anfrage unserer Server identifiziert sich mit diesem String:
SereneReader/1.0 (+https://serenereader.com/bot)Was wir abrufen
- Feed-URLs, die Nutzer abonniert haben.
- Jede Artikelseite, einmalig – wir lesen höchstens 1 MB HTML, um das og:image-Tag zu finden.
- Das Favicon Ihrer Website.
Wir crawlen keine Website, folgen keinen Links auf Artikelseiten und rufen nichts ab, das niemand abonniert hat.
Wie oft
Feeds werden nach einem festen Zeitplan aktualisiert. Sendet Ihr Server einen ETag- oder Last-Modified-Header, übermittelt die nächste Aktualisierung If-None-Match oder If-Modified-Since — ein unveränderter Feed kostet Sie dann nur eine 304-Antwort ohne Inhalt.
Jede Artikelseite wird einmalig abgerufen, um das Vorschaubild zu laden. Schlägt der Abruf fehl, brechen wir ab: Ein dauerhafter Fehler wie ein 404 wird 30 Tage gespeichert; ein vorübergehender Fehler wie ein Timeout oder Serverfehler wird bis zu dreimal mit Wartezeit erneut versucht, danach mindestens eine Stunde lang nicht mehr.
Ein 429- oder 503-Status signalisiert uns, die Anfragen zu drosseln. Bei Feeds verlängern wir das nächste Aktualisierungsintervall schrittweise und berücksichtigen bei einem 429 mindestens den angegebenen Retry-After-Wert. Bei Artikelseiten wiederholen wir den Versuch bis zu dreimal innerhalb von etwa zehn Minuten und warten danach mindestens eine Stunde – oder so lange, wie Retry-After es angibt, maximal sieben Tage.
robots.txt
Bevor wir eine Artikelseite oder ein Favicon abrufen, lesen wir Ihre robots.txt und befolgen Disallow-Regeln sowie crawl-delay für User-agent: SereneReader – bei Bedarf mit Fallback auf die Gruppe *.
Feed-URLs sind anders. Ein Feed wird im Auftrag eines Lesers abgerufen, der ihn abonniert hat – wir behandeln ihn daher wie Googles Feedfetcher: Die Disallow-Regeln der Gruppe * gelten dafür nicht. Eine Gruppe User-agent: SereneReader, die den Feed-Pfad ausschließt, wird weiterhin berücksichtigt, und crawl-delay gilt für Feeds genauso wie für alles andere.
Ist Ihre robots.txt aufgrund eines Serverfehlers nicht erreichbar, behandeln wir dies als Erlaubnis zum Abruf. Ein Abonnement ist die ausdrückliche Zustimmung eines Lesers – eine fehlerhafte robots-Datei sollte seinen Feed nicht blockieren.
So blockieren Sie uns
Blockieren oder drosseln Sie den obigen User-Agent auf Ihrem Server oder Ihrer Firewall, oder weisen Sie uns in der robots.txt mit einer benannten Gruppe ab. Eine allgemeine Bot-Regel verhindert keine Feed-Abrufe; diese hier schon:
User-agent: SereneReader
Disallow: /Das Blockieren Ihrer Feed-URL stoppt die Aktualisierungen für alle Abonnenten – nicht nur für einen einzelnen Leser.
Anfrage-Signaturen
Anfragen werden mit Web Bot Auth (HTTP-Nachrichtensignaturen, RFC 9421) signiert, damit Sie prüfen können, ob sie wirklich von uns stammen. Unsere öffentlichen Schlüssel sind veröffentlicht unter:
https://serenereader.com/.well-known/http-message-signatures-directoryAusgehende IP-Adressen
Geplante Feed-Aktualisierungen und Vorschaubilder stammen von diesen festen Adressen. Der einmalige Abruf beim ersten Hinzufügen eines Feeds erfolgt über unsere Webserver und ist hier nicht aufgeführt – eine reine IP-Zulassungsliste würde ihn daher ablehnen.
162.220.234.241
152.55.180.242
152.55.180.243Maschinenlesbare Liste/bot/ips.json
Kontakt
Fragen zu unserem Traffic oder etwas, das wir beheben sollen? Schreiben Sie uns.