Der Wullup-Crawler
Stand: 23.09.2026
Diese Seite richtet sich an Betreiberinnen und Betreiber von Websites, die in ihren Server-Protokollen auf unseren Crawler gestoßen sind.
Diese Hinweise sind auf Englisch und Deutsch verfügbar. Bei Abweichungen ist die deutsche Fassung maßgeblich.
1. Was der Crawler tut
Der Wullup-Crawler ist der Event-Crawler der Wullup GmbH. Er liest ausschließlich öffentliche Veranstaltungsübersichten von Websites von Venues und Veranstaltern und entnimmt daraus Sachangaben zu Veranstaltungen — Titel, Datum, Uhrzeit, Ort und Preis —, die wir in der Wullup-App und auf wullup.com anzeigen.
Welche Angaben wir übernehmen, was wir nicht übernehmen, wie wir mit personenbezogenen Daten umgehen und wie lange wir was speichern, erläutern unsere Event-Quellen und KI-Transparenz.
2. So erkennen Sie ihn
- User-Agent:
Wullup/1.0 (+https://wullup.com/bot) - Herkunft: Die Abrufe kommen von Wullups eigenen Servern — ohne wechselnde IP-Adressen und ohne Proxys
- Seiten, die nur mit JavaScript Inhalte zeigen: Solche Seiten können wir einmal über einen gehosteten Headless-Browser (Apify) darstellen lassen. Auch dieser Abruf sendet denselben User-Agent
3. Was der Crawler beachtet
3.1 robots.txt
Der Crawler beachtet die robots.txt nach dem Robots-Exclusion-Standard (RFC 9309), einschließlich einer dort angegebenen Wartezeit (Crawl-delay). Er folgt der Gruppe User-agent: Wullup, andernfalls der Gruppe User-agent: *.
So sperren Sie den Crawler vollständig:
User-agent: Wullup
Disallow: /
3.2 Text-und-Data-Mining-Vorbehalte (§ 44b Abs. 3 UrhG)
Jeder der folgenden Vorbehalte genügt, damit der Crawler die Website nicht mehr ausliest und die bereits von dieser Website übernommenen Veranstaltungen entfernt werden:
- TDMRep:
/.well-known/tdmrep.json, HTTP-Header oder Meta-Angabetdm-reservation noai/noimageaiinX-Robots-Tagoder im Robots-Meta-Tag- IETF AIPREF:
Content-Usage-Angabe im HTTP-Header oder als Zeile in der robots.txt - Schriftlicher Nutzungsvorbehalt oder ein Verbot automatisierter Auswertung in den Nutzungsbedingungen, AGB oder im Impressum der Website
Bilder werden auf dieselbe Weise geprüft.
3.3 Keine Umgehung
Der Crawler meldet sich nie an und löst keine Captchas. Antwortet eine Website mit einer Bot- oder Captcha-Abfrage, bricht er den gesamten Durchlauf für diese Website ab.
4. Abruffrequenz
Jede Website wird etwa alle dreieinhalb Tage abgerufen, mit mindestens 0,5 Sekunden Abstand zwischen zwei Anfragen — oder mehr, wenn Ihr Crawl-delay das verlangt.
5. Ausnahme: Erlaubnis des Rechteinhabers
Hat eine Venue ihre eigene Website in Wullup Backstage eingetragen, der Übernahme zugestimmt und nachgewiesen, dass die Website ihr gehört, liegt die Erlaubnis des Rechteinhabers vor. Für diese Website halten ihre Text-und-Data-Mining-Vorbehalte und Verbote in den Nutzungsbedingungen den Crawler dann nicht mehr auf. Ein Disallow in der robots.txt beachtet er weiterhin.
6. Kontakt und Widerspruch
Sie möchten nicht, dass wir Ihre Veranstaltungen übernehmen? Nutzen Sie unser Widerspruchsformular oder schreiben Sie an [email protected]. Bei Fragen zum Crawler erreichen Sie uns ebenfalls unter [email protected].