Richtlinie zur akzeptablen Nutzung
Gültigkeitsdatum: 31. Mai 2026 | Zuletzt aktualisiert: 10. Juli 2026
Diese Richtlinie zur akzeptablen Nutzung ("RAN") legt die Regeln fest, die für alle Nutzer des von New Horizon Platforms Kft. betriebenen CrawlHawk-Dienstes ("Dienst") gelten. Die RAN ist Bestandteil der Allgemeinen Geschäftsbedingungen und gilt für jeden Crawl und jede Interaktion mit dem Dienst. Die RAN ist eine grundlegende Bedingung. Ein Verstoß gegen die RAN kann zur sofortigen Sperrung oder Beendigung Ihres Kontos führen, einschließlich des Verfalls ungenutzter Credits bei schwerwiegenden oder wiederholten Verstößen.
1. Allgemeines Prinzip
Sie müssen den Dienst rechtmäßig, in gutem Glauben und in einer Weise nutzen, die seinem Zweck entspricht: legitimes Webcrawling, Linkentdeckung, Sitemap-Erstellung und Produktextraktion von öffentlich zugänglichen Websites, die Sie rechtmäßig crawlen dürfen. Sie dürfen den Dienst nicht in einer Weise nutzen, die Zielwebsites, deren Betreiber, deren Besucher, andere Nutzer, den Betreiber, Dritte oder die Integrität und Verfügbarkeit des Dienstes schädigt.
2. Grundlegende Nutzerzusicherungen
Jedes Mal, wenn Sie einen Crawl einreichen, bestätigen und garantieren Sie folgendes:
- Sie haben das gesetzliche Recht und die Befugnis, ein automatisiertes System anzuweisen, auf die Inhalte der Zielwebsite zuzugreifen, sie abzurufen, zu kopieren, zu speichern und zu analysieren, um Ihren Crawl durchzuführen;
- Ihr Crawl entspricht den Nutzungsbedingungen, den Richtlinien für den automatisierten Zugang und dem Protokoll zur Ausschluss von Robotern (robots.txt) der Zielwebsite, oder Sie haben eine ausdrückliche schriftliche Genehmigung vom Betreiber der Zielwebsite, diese zu ignorieren;
- Ihr Crawl umgeht keine technischen Zugangskontrollen, Bezahlschranken, Anmeldeschranken, IP-Blocks, CAPTCHAs oder Rechte-Schutzmaßnahmen in einer Art und Weise, die nach geltendem Recht verboten ist;
- Ihr Crawl entspricht allen geltenden Gesetzen, einschließlich Gesetzen zu Computercextraktraachen, unrechtmäßigem Zugang, geistigem Eigentum, Datenbankrechten, Geschäftsgeheimnissen, Schutz persönlicher Daten und unlauterem Wettbewerb;
- Ihr Crawl ist nicht darauf ausgelegt oder wird verwendet, um den Betrieb einer Zielwebsite, eines Servers oder Netzwerks zu überlasten, zu stören, zu schädigen oder zu beeinträchtigen.
3. Verbotene Nutzungsszenarien
Sie dürfen den Dienst nicht nutzen, um sich an folgenden Aktivitäten zu beteiligen oder diese zu ermöglichen oder zu versuchen:
3.1 Unbefugter Zugang und Systemmissbrauch
- die Zugang zu Computersystemen oder Daten zu erlangen, zu denen Sie nicht berechtigt sind;
- den Versuch, Anmeldeschranken, Authentifizierungsmechanismen, Zwei-Faktor-Authentifizierung oder Sitzungssteuerungen in einer dem geltenden Recht widersprechenden Weise zu umgehen;
- Erfassen von Anmeldeinformationen, Sitzungstokens, API-Schlüsseln oder anderen Authentifizierungsdaten;
- die Ausnutzung von Schwachstellen, Sicherheitslücken oder Fehlkonfigurationen von Zielwebsites;
- IP-Blocks, Rate-Limits oder andere Zugangskontrollen zu umgehen, die speziell gegen Sie aufgrund früherer Missbräuche verhängt wurden.
3.2 Missbrauch von personenbezogenen Daten und Datenschutz
- Massenhaft personenbezogene Daten zu sammeln (einschließlich Namen, E-Mail-Adressen, Telefonnummern, Fotografien, Profildaten), wo Sie keine rechtliche Grundlage nach der DSGVO oder einem anderen anwendbaren Datenschutzrecht haben;
- Personendaten zu sammeln für Zwecke der unaufgeforderten Werbung, Spam, Belästigung, Doxing, Profilerstellung ohne rechtliche Grundlage oder Überwachung;
- Datenbanken mit persönlichen Daten für den Weiterverkauf, die Verbreitung oder andere unzulässige Zwecke zu erstellen;
- Quellen zu crawlen, deren Bedingungen oder geltendes Recht explizit das Sammeln der enthaltenen personenbezogenen Daten verbieten.
3.3 Missbrauch von geistigem Eigentum und Datenbanken
- in großem Maßstab urheberrechtlich geschütztes Material zu kopieren für eine rechtsverletzende Verteilung, Spiegelung, Wiederveröffentlichung oder das Training generativer Modelle, wo Sie keine Lizenz, keine anwendbare gesetzliche Ausnahmeregelung (einschließlich der Text- und Datenverkehrsausnahmen gemäß den Artikeln 3 und 4 der Richtlinie (EU) 2019/790, unter Berücksichtigung gültiger Opt-Outs durch Rechteinhaber) oder andere rechtliche Grundlage haben;
- die Extraktion oder Wiederverwendung wesentlicher Teile von Datenbanken, die durch das sui-generis-Datenbankrecht (Richtlinie 96/9/EG) geschützt sind, ohne Genehmigung des Datenbankherstellers;
- die unrechtmäßige Aneignung von Geschäftsgeheimnissen;
- systematische Missachtung von maschinenlesbaren rechten Vorbehalten (einschließlich, aber nicht beschränkt auf TDM-Opt-Outs in robots.txt, Metatags oder andere geeignete Mittel).
3.4 Störung des Dienstes und aggressives Crawling
- Crawling in einer Frequenz, Parallelität oder Menge, die die Funktion einer Zielwebseite überlastet, beeinträchtigt oder zu beeinträchtigen droht;
- den Dienst als Teil eines Denial-of-Service-, Distributed-Denial-of-Service- oder Belastungstests-Angriffs zu nutzen;
- mehrere Konten oder wiederholte kurze Crawls zu orchestrieren, um die zur Sicherung der Zielwebseiten beabsichtigen Rate-Limits zu umgehen.
3.5 Schädliche und illegale Inhalte
- das Crawlen oder Extrahieren von Inhalten, die gemäß geltendem Recht rechtswidrig sind, einschließlich kinderpornographischen Materials (null Toleranz mit Meldung an die Behörden), terroristischen Inhalten, Inhalte, die zu Gewalt oder Hass aufstacheln, oder Inhalte, deren Verbreitung durch Gerichtsbeschluss oder zuständige Behörden verboten ist;
- den Dienst zur Vorbereitung oder Verbreitung von Malware, Phishing-Kits, betrügerischen Seiten oder betrügerischer Infrastruktur zu verwenden;
- Sanktionen zu umgehen, Geldwäsche, Terrorismusfinanzierung oder Dienstleistungen für sanktionierte Personen oder Einrichtungen zu ermöglichen.
3.6 Irreführung und Kontomissbrauch
- Konten mit falschen, irreführenden oder gestohlenen Identifikations- oder Zahlungsinformationen zu erstellen;
- mehrere Konten zu erstellen, um Einschränkungen, Sperrungen oder Ratelimits zu umgehen;
- die Servicekapazität, Crawl-Ergebnisse oder Credit-Zugänge ohne vorherige schriftliche Zustimmung des Betreibers an Dritte zu verkaufen, es sei denn, der Nutzer verwendet den Dienst im Rahmen der normalen beruflichen Tätigkeit für eigene Kunden.
3.7 Integrität des Dienstes
- den Versuch zu unternehmen, unbefugten Zugang zur Infrastruktur des Dienstes oder zu den Konten oder Daten anderer Nutzer zu erlangen;
- den Dienst auf Schwachstellen zu überprüfen, zu scannen oder zu testen, außer im Rahmen eines koordinierten verantwortlichen Offenlegungsprozesses über support@crawlhawk.com;
- die Integrität, Verfügbarkeit oder Leistung des Dienstes zu stören;
- das Reverse Engineering oder das Scraping von Daten des Dienstes selbst, um ein konkurrierendes Produkt zu entwickeln.
3.8 Missbrauch der Kontaktdatenextraktion
- die Features zur Kontaktdatenextraktion zu nutzen, um personenbezogene Daten identifizierter oder identifizierbarer natürlicher Personen (wie Namen, Positionen, direkte E-Mail-Adressen oder direkte Telefonnummern) ohne eine gültige und dokumentierte rechtliche Grundlage gemäß der DSGVO zu erfassen, wie in Abschnitt 5.7 der Allgemeinen Geschäftsbedingungen erforderlich;
- extrahierte Kontaktdaten für unaufgeforderte Marketingkommunikation zu verwenden, im Widerspruch zu geltenden E-Privacy-, Anti-Spam- oder Direktmarketinggesetzen;
- es zu versäumen, die nach Artikel 13 und 14 DSGVO erforderlichen Informationen an die Personen zu liefern, deren personenbezogene Daten extrahiert wurden;
- die Verarbeitung extrahierter personenbezogener Daten nach einem gültigen Widerspruch, einem Einschränkungswunsch oder Löschungswunsch der betroffenen Person fortzusetzen.
4. Robots.txt, Nutzungsbedingungen und Rechtevorbehalte
Sie müssen das Protokoll zur Ausschluss von Robotern (robots.txt) jeder Zielwebsite und andere maschinenlesbare oder vertragliche Rechtevorbehalte, die auf den Inhalt der Zielwebsite angewendet werden, respektieren, einschließlich der Text- und Datenbergbaueinschränkungen, die gültig nach Artikel 4 (3) der Richtlinie (EU) 2019/790 ausgedrückt wurden.
Der Betreiber kann, als technische Fähigkeit, Modi anbieten, welche Websites mit dynamischem Laden, Zugangskontrollen oder automatisierten Zugangssignalen verarbeiten können, einschließlich Websites, die kein robots.txt implementiert haben oder deren Konfiguration nicht auf Plattformebene erzwungen wird. Diese Fähigkeiten werden nur für rechtmäßige und autorisierte Anwendungsfälle bereitgestellt — wie ein Nutzer, der seine eigenen Websites crawlt, ein Nutzer, der unter ausdrücklicher schriftlicher Genehmigung des Zielbetreibers handelt, oder andere legale Zwecke. Die Verfügbarkeit dieser technischen Fähigkeit stellt keine Zusicherung des Betreibers dar, dass ein bestimmter Crawl autorisiert oder rechtmäßig ist. Sie sind allein für diese Entscheidung verantwortlich.
5. KI-Produkt-Scraper — Zusätzliche Regeln
Bei der Verwendung des KI-Produkt-Scrapers oder anderer KI-unterstützter Funktionen dürfen Sie nicht:
- Eingaben einreichen oder Konfigurationen verwenden, die darauf abzielen, den zugrunde liegenden KI-Anbietern die Erzeugung von Inhalten zu verursachen, die durch ihre Nutzungsrichtlinien verboten sind;
- KI-extrahierte Ausgaben nutzen, um Verbraucher zu täuschen, unlautere Handelspraktiken durchzuführen oder zu begehen (zum Beispiel, indem Wettbewerbseigenschaften, -preise, -verfügbarkeit oder -herkunft von Produkten falsch dargestellt werden);
- KI-extrahierte Produktdaten unter Missachtung geltender Verbraucherschutz-, Werbe-, Lebensmittel-, Kennzeichnungs-, Arzneimittel- oder anderer sektorspezifischer Gesetze verwenden.
6. Meldung von Verstößen
Wenn Sie Crawls, Ergebnisse oder Verhaltensweisen feststellen, die Ihrer Meinung nach gegen diese RAN oder geltendes Recht verstoßen, oder wenn Sie der Betreiber einer Website sind, von der Sie glauben, dass sie in Verletzung dieser RAN gecrawlt wird, wenden Sie sich bitte an support@crawlhawk.com und nennen Sie dabei nach Möglichkeit den betreffenden Crawl, die URL oder das Konto und erläutern Sie das Problem. Meldungen von angeblich rechtswidrigen Inhalten werden gemäß Artikel 16 DSA und unserer Urheberrechts- und IP-Richtlinie behandelt.
7. Durchsetzung
Der Betreiber kann nach eigenem Ermessen und je nach Schwere und Wiederholung des Verstoßes eine der folgenden Maßnahmen ergreifen:
- eine Warnung ausgeben;
- laufende Crawls abbrechen oder beenden;
- den Zugang zu bestimmten Funktionen oder zum gesamten Konto einschränken, aussetzen oder beenden;
- bei schwerwiegendem oder wiederholtem Verstoß das Konto kündigen und ungenutzte Credits ohne Rückerstattung verfallen lassen, vorbehaltlich zwingender Verbraucherschutzregelungen;
- bestimmte Zielwebseiten oder Kategorien von Zielen vom Dienst blockieren;
- die Angelegenheit den zuständigen Behörden melden, einschließlich bei Verdacht auf Straftaten;
- alle rechtlichen Mittel in Anspruch nehmen, die ihr zur Verfügung stehen.
8. Interne Überprüfung von Durchsetzungsentscheidungen
Wenn wir eine der oben beschriebenen Maßnahmen gegen Sie ergreifen, können Sie innerhalb von sechs (6) Monaten nach der Entscheidung eine interne Beschwerde einreichen. Senden Sie dazu eine E-Mail an support@crawlhawk.com mit dem Betreff "Beschwerde — Moderationsentscheidung", und beschreiben Sie kurz die Entscheidung, die Sie anfechten, und die Gründe für die Beschwerde. Wir werden die Beschwerde unverzüglich und in nicht diskriminierender Weise prüfen und werden die Entscheidung aufheben, wenn sie unbegründet war. Entscheidungen über Beschwerden werden nicht allein auf der Grundlage automatisierter Mittel getroffen.
9. Weitere Abhilfemaßnahmen
Wenn Sie mit dem Ergebnis einer internen Überprüfung nicht einverstanden sind, können Sie, sofern nach dem Gesetz anwendbar, den Streitfall einer anerkannten außergerichtlichen Streitbeilegungsstelle vorlegen. Dies beeinträchtigt nicht Ihr Recht, rechtliche Schritte vor einem Gericht einzuleiten.
10. Änderungen dieser Richtlinie
Wir können diese RAN von Zeit zu Zeit aktualisieren. Wesentliche Änderungen werden über den Dienst bekanntgegeben.
11. Kontakt
Für Fragen zu dieser RAN wenden Sie sich bitte an support@crawlhawk.com.