# robots.txt für passt. — https://passt.jkstudio.me # # Zwei Anliegen, die auseinandergehalten werden müssen: # # 1. Auffindbarkeit. Suchmaschinen und die Suchbots der KI-Anbieter dürfen # weiterhin lesen. Wer eine Wohnung planen will, soll die Seite finden. # 2. Kein Trainingsmaterial. Crawler, die Inhalte für das Training # generativer Modelle einsammeln, sind ausgeschlossen. # # Rechtlicher Kern ist nicht diese Datei, sondern der Nutzungsvorbehalt nach # § 44b Abs. 3 UrhG. Der steht maschinenlesbar in /.well-known/tdmrep.json, # als HTTP-Feld `tdm-reservation: 1` an jeder Antwort, als -Element in # jeder Seite und ausformuliert in den Nutzungsbedingungen. robots.txt ist # eine Bitte; der Vorbehalt ist die Grundlage, gegen Zuwiderhandlung # vorzugehen. # # Nutzungsvorbehalt (Text and Data Mining Reservation): # Die Inhalte dieser Website sind vom Text- und Data-Mining nach # § 44b UrhG ausdrücklich ausgenommen. Eine Vervielfältigung zum Zweck # des Trainings oder der Entwicklung generativer KI-Modelle ist nicht # gestattet. # # Die Namen der Crawler ändern sich laufend. Stand der Liste: 30.08.2026. # Belegt aus Betreiberdokumentation: GPTBot/OAI-* (OpenAI), ClaudeBot/ # Claude-* (Anthropic), Google-Extended (Google), Applebot-Extended (Apple). # Die übrigen Einträge stammen aus Sekundärquellen und gehören bei der # nächsten Durchsicht gegen die Betreiberdokumentation geprüft. # ---------------------------------------------------------------- Alle # Grundregel: lesen erlaubt. Die Ausnahmen stehen darunter. User-agent: * Allow: / # ------------------------------------------- Training generativer Modelle # OpenAI: GPTBot sammelt fürs Training. OAI-SearchBot und ChatGPT-User # bleiben erlaubt – das ist Suche bzw. ein vom Menschen ausgelöster Abruf. User-agent: GPTBot Disallow: / # Anthropic: ClaudeBot sammelt fürs Training. Claude-SearchBot und # Claude-User bleiben erlaubt. User-agent: ClaudeBot Disallow: / User-agent: anthropic-ai Disallow: / # Google: eigener Token nur für das Training der Gemini-Modelle. Laut # Google ohne Einfluss auf Aufnahme und Ranking in der Google-Suche – # Googlebot bleibt darum unberührt. User-agent: Google-Extended Disallow: / # Apple: steuert nur die Verwendung für Apples Foundation Models. Der # reguläre Applebot (Spotlight, Siri, Safari) bleibt erlaubt. User-agent: Applebot-Extended Disallow: / # Common Crawl: dessen Archiv ist Ausgangsmaterial vieler Trainingsläufe. User-agent: CCBot Disallow: / # Meta User-agent: meta-externalagent Disallow: / User-agent: FacebookBot Disallow: / # ByteDance User-agent: Bytespider Disallow: / # Amazon User-agent: Amazonbot Disallow: / # Weitere Sammler, die ihre Daten für Modelltraining anbieten User-agent: Diffbot Disallow: / User-agent: Omgilibot Disallow: / User-agent: ImagesiftBot Disallow: / User-agent: Timpibot Disallow: / User-agent: cohere-ai Disallow: / User-agent: AI2Bot Disallow: / Sitemap: https://passt.jkstudio.me/sitemap.xml