TL;DR
8 Min. gelesenDas Scrapen öffentlich sichtbarer Reddit-Seiten ist in den Vereinigten Staaten nach Van Buren und hiQ keine Straftat auf Bundesebene, verstößt aber gegen das Reddit User Agreement, das Scraping der Services ohne vorherige schriftliche Zustimmung von Reddit verbietet und Crawling nur im Rahmen der robots.txt erlaubt, wo reddit.com derzeit an jeden User Agent ein Disallow Slash sendet. Reddit setzt diesen Vertrag mit Token-Entzug, Sperrung von Konten und Apps, Prüfrechten und Data-Licensing-Deals durch. Der regelkonforme Weg ist die offizielle Data API nach Freigabe, mit einer separaten schriftlichen Vereinbarung für jede kommerzielle Nutzung.
Ist Reddit-Scraping legal?
Kein Gesetz der Vereinigten Staaten beantwortet die Frage "ist Reddit-Scraping legal", deshalb beantwortet Reddit sie per Vertrag: Das Reddit User Agreement verbietet das Scraping der Services ohne vorherige schriftliche Zustimmung von Reddit und erteilt die Erlaubnis zum Crawlen nur im Rahmen der Parameter seiner robots.txt-Datei. Strafrechtliches Computerzugriffsrecht und Vertragsrecht entscheiden getrennt voneinander, und Reddit setzt auf der Vertragsseite durch, wo es keine Staatsanwaltschaft braucht. Lesen Sie Reddits eigene Bedingungen für Ihren Anwendungsfall, bevor Sie einen Client schreiben, denn diese Bedingungen binden Ihr Konto unabhängig von der strafrechtlichen Antwort.
Das allgemeine Recht dazu, einschließlich dessen, was Van Buren v. United States zu "exceeds authorized access" (überschreitet den zulässigen Zugriff) entschieden hat und was hiQ Labs v. LinkedIn zum Scrapen öffentlicher Seiten unter dem Computer Fraud and Abuse Act entschieden hat, steht auf der Seite dazu, wann Web Scraping legal ist. Diese Seite behandelt, was Reddit, Inc. verlangt. Keine der beiden ist eine Rechtsberatung.
Was sagt das Reddit User Agreement über Scraping?
Das Reddit User Agreement verbietet Scraping vollständig und erlaubt Crawling nur bedingt. Abschnitt 7, "Things You Cannot Do", besagt, Sie dürfen nicht "Access, search, or collect data from the Services by any means (automated or otherwise) except as permitted in these Terms or in a separate agreement with Reddit (we conditionally grant permission to crawl the Services in accordance with the parameters set forth in our robots.txt file, but scraping the Services without Reddit's prior written consent is prohibited)." Dieser Text stammt aus dem User Agreement mit Wirkung zum July 1, 2026, zuletzt überarbeitet am May 26, 2026, unter redditinc.com/policies/user-agreement.
Das Verbot erfasst die Erhebung "by any means (automated or otherwise)", also landen ein Headless Browser und eine curl-Schleife in derselben Klausel. Reddit führt Abschnitt 7 unter den Abschnitten auf, die eine Beendigung überdauern, das Löschen des Kontos, von dem aus Sie gescrapt haben, beendet die Pflicht also nicht.

Erlaubt die robots.txt von Reddit das Crawlen?
Die robots.txt von Reddit untersagt derzeit jedem Crawler jeden Pfad. Die Datei unter reddit.com/robots.txt enthält eine einzige Regelgruppe, "User-agent: *" gefolgt von "Disallow: /", unter einem Kopfkommentar mit dem Wortlaut "Reddit believes in an open internet, but not the misuse of public content", der auf Reddits Public Content Policy verweist. Die bedingte Crawl-Erlaubnis in Abschnitt 7 läuft für einen allgemeinen Crawler heute damit auf keine Erlaubnis hinaus.
Eine robots.txt-Datei hat aus sich heraus keine Bindungswirkung, wie die Erklärung zu robots.txt darlegt. Das User Agreement von Reddit macht sie zu einer vertraglichen Grenze, indem es die Crawl-Erlaubnis unter Verweis darauf erteilt, was die Datei zum Zeitpunkt Ihres Lesens sagt.
Was gilt als kommerzielle Nutzung von Reddit-Daten?
Reddit definiert kommerzielle Nutzung als jede Nutzung durch ein Unternehmen, im Auftrag eines Unternehmens oder als Teil eines monetarisierten Produkts oder Dienstes. Der Hilfeartikel "Developer Platform and Accessing Reddit Data" nennt mobile Apps mit Werbung oder Paywalls, Abodienste, Dienste oder Datenzugang gegen Gebühr, das Veröffentlichen von Reddit-Inhalten auf monetarisierten Seiten und den Verkauf von Zugang zu Modellen, die auf Reddit-Daten trainiert wurden. Derselbe Artikel stellt fest, dass Sie Reddit-Inhalte nicht anzeigen und gleichzeitig Werbung in Ihrer App, Website oder Ihrem Dienst schalten dürfen.
Beide Verträge leiten kommerzielle Nutzung in eine unterzeichnete Vereinbarung. Data API Terms 3.1 besagt, dass Sie für "commercial purposes, research in excess of rate limits, or for any use that is not expressly permitted" eine "separate agreement with Reddit" abschließen müssen. Developer Terms 4.1 wiederholt das und untersagt den Zugang "by or on behalf of a business or as part of a service or product that is monetized" ohne schriftliche Freigabe.
| Weg zu Reddit-Daten | Was Reddits Richtlinie sagt | Primärquelle |
|---|---|---|
| Scraping öffentlicher Seiten | Verboten ohne vorherige schriftliche Zustimmung von Reddit | User Agreement, Abschnitt 7 |
| Crawlen im Rahmen der robots.txt | Bedingt erlaubt, und die aktive Datei sendet Disallow: / an jeden User Agent | User Agreement Abschnitt 7, reddit.com/robots.txt |
| Data API, nicht kommerziell | Erlaubt, nachdem Sie Zugang beantragt haben und Reddit den Anwendungsfall freigibt | Responsible Builder Policy |
| Data API, kommerziell | Erfordert eine separate schriftliche Vereinbarung mit Reddit | Data API Terms 3.1, Developer Terms 4.1 |
| Akademische Forschung | Nur über das Programm Reddit for Researchers | Developer Platform and Accessing Reddit Data |
| Training eines KI-Modells | Verboten ohne Erlaubnis von Reddit und der Rechteinhaber | Data API Terms 2.4, Developer Terms 4.2 |
Was hat sich 2023 beim Zugang zu Reddit-Daten geändert?
Reddit hat neue Data API Terms mit Wirkung zum June 19, 2023 erlassen, und dieses Dokument gilt weiterhin, zuletzt überarbeitet am July 20, 2026. Es gibt Reddit unter Abschnitt 2.9 das Recht, nach eigenem Ermessen "set and enforce limits on your use of the Data APIs", untersagt Ihnen unter Abschnitt 3.2 das Umgehen dieser Limits und verlangt unter Abschnitt 6 das Löschen zwischengespeicherter User Content bei Beendigung. Die Aufschlüsselung der Reddit-API-Preise behandelt die Tarife, die darauf folgten, und Reddit API Rate Limits behandelt die Kontingentmechanik, die Ihr Client einhalten muss.
Pushshift, das Archiv, auf dem der Großteil der Reddit-Forschung lief, stellte im selben Zeitraum den Dienst für die breite Öffentlichkeit ein. Seine Dump-Reihe endet im March 2023, und genau dort setzt das Archiv Arctic Shift an. Pushshift beschränkt den Zugang inzwischen über eine Moderatorenprüfung: Die Anmeldebedingungen verlangen von der nutzenden Person die Bestätigung, dass sie registrierter Reddit-Moderator ist, und begrenzen den Zugang auf "community moderation, enforcing Reddit community guidelines, and ensuring community member safety".
Wie setzt Reddit seine Bedingungen durch?
Reddit setzt über Zugangskontrollen, Prüfungen und Lizenzierung durch statt über Strafanzeigen. Die Responsible Builder Policy listet die Durchsetzungsmaßnahmen unmissverständlich auf: Entzug Ihrer Access Tokens, Sperrung Ihrer App oder Ihres Kontos und Sperrung verbundener Konten, Bots, Domains oder Subreddits. Developer Terms 2.2 ergänzt ein Prüfrecht: Reddit überwacht Ihre Nutzung, verlangt Nachweise über die Einhaltung und darf "use any technical measures to prevent, block, or otherwise overcome the interference".
Die Lizenzseite kommt aus der Public Content Policy. Reddit erklärt, dass es Lizenzvereinbarungen eingeht, um zu wissen, wer aus welchem Grund auf öffentliche Inhalte zugreift, um vertragliche Nutzungsbeschränkungen zu setzen und um sicherzustellen, dass Lizenznehmer Löschungen durch Redditor respektieren. Diese Richtlinie benennt unbefugten Zugriff "by scraping or using data brokers" als das Verhalten, das das Lizenzprogramm verdrängen soll.

Was ist der regelkonforme Weg, Reddit-Daten zu erheben?
Registrieren Sie eine App, beantragen Sie Data-API-Zugang für einen genannten Anwendungsfall und schließen Sie eine separate Vereinbarung mit Reddit, bevor Geld das Ergebnis berührt. Die Responsible Builder Policy stellt drei Bedingungen an jeden Zugang zu Reddit-Daten: Freigabe, bevor Sie auf irgendetwas zugreifen, keine Verschleierung, wie und warum Sie auf Daten zugreifen, und kein Umgehen oder Überschreiten von Zugangslimits. Data API Terms 2.8 macht die zweite konkret und verlangt das von Reddit ausgegebene OAuth-Token und keine Verschleierung des User Agent oder der OAuth-Identität.
RedReplier
Loslegen
Reddit, X, Bluesky & HN
Echtzeit-Kaufabsicht-Alerts
Unbegrenzte KI-Antworten
Nach Kaufabsicht sortiert
Daraus folgen drei Pflichten. Data API Terms 3.2 verlangt, dass Sie alle Daten löschen, die für den freigegebenen Anwendungsfall nicht erforderlich sind. Developer Terms 3.3 verlangt, dass Sie User Content entfernen, sobald Reddit oder der Verfasser ihn löscht. Data API Terms 2.4 gewährt kein Trainingsrecht, ein Modell braucht also seine eigene Erlaubnis. Wenn sich dieser Entwicklungsaufwand nicht lohnt, kaufen Sie den Zugang: RedReplier im Vergleich zum Eigenbau auf der Reddit API legt die Abwägung dar, und Reddit Keyword Monitoring liefert dieselben Gespräche als Alerts.
Häufig gestellte Fragen
Ist Reddit-Scraping legal, wenn die Seiten öffentlich sind?
Öffentliche Sichtbarkeit klärt die strafrechtliche Frage und nicht die vertragliche. US-Gerichte behandeln den Zugriff auf öffentliche Seiten nicht mehr als Verstoß gegen den Computer Fraud and Abuse Act, was die allgemeine Seite zum Web Scraping behandelt, aber das User Agreement von Reddit verbietet Scraping ohne vorherige schriftliche Zustimmung, unabhängig davon, ob eine Seite einen Login verlangt. Reddits Public Content Policy sagt dasselbe: Dritte haben kein Recht, öffentliche Inhalte zu missbrauchen, nur weil sie öffentlich sind.
Blockiert die robots.txt von Reddit alle Crawler?
Ja. Die aktive Datei unter reddit.com/robots.txt enthält eine einzige Gruppe, "User-agent: *" mit "Disallow: /", sie nennt also für keinen Crawler eine Ausnahme. Das User Agreement von Reddit erteilt die Crawl-Erlaubnis nur "in accordance with the parameters set forth in our robots.txt file", die aktuelle Datei lässt diese Erlaubnis also leer.
Darf ich die Reddit Data API in einem kostenpflichtigen Produkt nutzen?
Nicht ohne eine separate Vereinbarung. Data API Terms 3.1 leitet kommerzielle Zwecke in eine separate Vereinbarung mit Reddit, und Developer Terms 4.1 untersagt den Zugang durch ein Unternehmen oder in dessen Auftrag oder als Teil eines monetarisierten Produkts ohne schriftliche Freigabe. Reddits Hilfedokumentation zählt Abodienste, Apps mit Paywall und Datenzugang gegen Gebühr als kommerziell.
Darf ich ein KI-Modell auf Reddit-Beiträgen trainieren?
Nicht ohne Erlaubnis von Reddit und von den Rechteinhabern. Data API Terms 2.4 gewährt kein Recht, User Content "for training a machine learning or AI model, without the express permission of rightsholders" zu nutzen, und Developer Terms 4.2 untersagt den Zugriff auf Reddit-Daten per API, Indexierung, Caching oder Crawling zum Training von Modellen ohne Erlaubnis von Reddit. Reddits Hilfedokumentation ergänzt, dass die kommerzielle Nutzung eines auf Reddit-Daten trainierten Modells eine ausdrückliche Freigabe braucht.
Ist Pushshift noch verfügbar?
Pushshift bedient inzwischen nur noch Reddit-Moderatoren. Die Anmeldebedingungen verlangen von der nutzenden Person die Bestätigung, dass sie registrierter Reddit-Moderator ist, und begrenzen die Nutzung auf Community-Moderation, Durchsetzung der Richtlinien und Sicherheit der Mitglieder. Die öffentliche Dump-Reihe endet im March 2023, und Arctic Shift führt die Reihe von dort fort.
Was passiert, wenn Reddit Sie beim Scrapen erwischt?
Reddit entzieht Access Tokens, sperrt die App oder das Konto und sperrt verbundene Konten, Bots, Domains oder Subreddits, was die Responsible Builder Policy als ihre Durchsetzungsmaßnahmen auflistet. Data API Terms 3.2 ergänzt eine dauerhafte Sperre des Data-API-Zugangs, wenn Reddit von einem Verstoß gegen die Limit-Klausel ausgeht. Weil der Verstoß vertraglicher Natur ist, handelt Reddit aus eigener Befugnis und wartet auf kein Gericht.
Was passiert mit meinem Zugriff, wenn ich mein Reddit-Konto nach dem Scraping lösche?
Das Löschen des Kontos hebt die Verpflichtung nicht auf. Reddit zählt Section 7, die Klausel, die Scraping verbietet, zu den Abschnitten, die eine Kündigung überdauern. Der vertragliche Anspruch stützt sich auf die Scraping-Handlung selbst, nicht darauf, ob das Konto noch existiert.
Wie entscheidet Reddit, wer einen Daten-Lizenzvertrag bekommt?
Reddits Public Content Policy versteht Lizenzierung als Mittel zur Zugriffskontrolle, nicht als offenen Marktplatz. Reddit geht diese Vereinbarungen ein, um zu wissen, wer auf öffentliche Inhalte zugreift und warum, um vertragliche Nutzungsbeschränkungen festzulegen und um Lizenznehmer zur Löschung von Inhalten zu verpflichten, die Nutzer entfernt haben. Die Richtlinie nennt unautorisiertes Scraping und Datenbroker als das Verhalten, das die Lizenzierung ersetzen soll.
Können Forscher an Universitäten besonderen Zugang zu Reddit-Daten bekommen?
Akademische Forschung läuft über einen eigenen Kanal, getrennt von der regulären Data API. Reddit leitet sie über das Programm Reddit for Researchers, nicht über die allgemeine API-Freigabe oder Scraping. Scraping und nicht genehmigte API-Nutzung bleiben für Forschungszwecke genauso ausgeschlossen wie für jeden anderen Anwendungsfall.
Kann Reddit die Data-API-Limits jederzeit ändern?
Diese Entscheidung behält sich Reddit vor. Data API Terms 2.9 räumt Reddit das Recht ein, Limits für die Nutzung der Data APIs nach eigenem Ermessen festzulegen und durchzusetzen, und Section 3.2 untersagt Entwicklern, das jeweils geltende Limit zu umgehen. Ein Client, der für die heutigen Limits gebaut ist, kann morgen ohne Verhandlung gedrosselt oder blockiert werden.
Sieh uns öfter bei Google
Ein Klick macht RedReplier zu einer bevorzugten Quelle. Unsere Artikel stehen dann weiter oben in deinen Top-Meldungen, im KI-Modus und in den KI-Übersichten.
Bevor du gehst...
RedReplier
Erreichen Sie jeden Käufer, der nach Ihrem Angebot sucht
RedReplier überwacht Reddit, X, Bluesky und Hacker News in Echtzeit, bewertet jeden Thread nach Kaufabsicht und entwirft Ihre Antwort, damit Sie als Erster da sind.
Reddit, X, Bluesky & HN
Echtzeit-Kaufabsicht-Alerts
Unbegrenzte KI-Antworten
Nach Kaufabsicht sortiert
Verwandte Artikel


Wann ist Web Scraping legal? Vier Fragen, vier getrennte Antworten
Kein Gesetz macht Web Scraping legal: CFAA, Vertragsrecht, Urheberrecht und GDPR antworten getrennt, und hiQ Labs v. LinkedIn trennte die ersten beiden.


Reddit-API-Rate-Limits im Detail: 100 Abfragen pro Minute, gemittelt über zehn
Wie Reddit-API-Rate-Limits wirklich greifen: 100 Abfragen pro Minute pro OAuth-Client-ID, gleitender Zehn-Minuten-Durchschnitt, drei X-Ratelimit-Header, 429.


Jede Reddit-Engagement-Rate, die Sie sehen, hat jemand anders gebaut
Eine Reddit-Engagement-Rate existiert in keinem Reddit-Produkt. Was die API liefert, was Post Insights zeigen und die drei Raten, die Menschen daraus bauen.

