📌 Wie können Sie Reddit-Suchergebnisse nach Schlüsselwort, Sortierreihenfolge und Datumsbereich extrahieren?
Diese Vorlage sammelt das eingegebene Schlüsselwort, die ausgewählte Sortierung und den Datumsbereich, die aktuelle Ergebnis-URL, den Subreddit, den Post-Titel, den Autor, die Post-Zeit und das Datum/die Uhrzeit, die Anzahl der Upvotes, die Anzahl der Kommentare und die Post-URL. Sie ist nützlich für Social-Listening-Analysten, Marktforscher und Community-Intelligence-Teams.
Die Daten werden von Old Reddit Search gesammelt. Die Reddit-Suche findet Beiträge in allen Communities und kann die Ergebnisse nach Relevanz, Aktualität, Beliebtheit oder Kommentaren ordnen.
💰 Preise
Aktueller Preis: $0,05/1.000 Zeilen. Die Abrechnung basiert auf der Anzahl der vom Task erzeugten Ausgabezeilen.
📦 Ausgabe
Die aktuell veröffentlichte Implementierung kann die folgenden Felder zurückgeben:
msg_typecontentInput_keywordInput_sorted_byInput_date_rangeCurrent_URLSubredditTitleAuthorPost_timeDatetimeUpvotes_countComment_countPost_URL
{
"msg_type": null,
"content": null,
"Input_keyword": null,
"Input_sorted_by": null,
"Input_date_range": null,
"Current_URL": null,
"Subreddit": "r/webscraping",
"Title": "Octoparse is a scam",
"Author": "canigetahoyahhh",
"Post_time": "2022-11-03 13:30:57",
"Datetime": null,
"Upvotes_count": null,
"Comment_count": null,
"Post_URL": "https://old.reddit.com/r/webscraping/comments/yl2xt5/octoparse_is_a_scam/"
}
🎯 Anwendungsfälle
- Überwachen Sie Marken- oder Themenerwähnungen mithilfe von Schlüsselwörtern, Titeln und Post-URLs.
- Vergleichen Sie das Engagement anhand der Anzahl der Upvotes und Kommentare.
- Segmentieren Sie Konversationen nach Subreddit.
- Analysieren Sie das Timing von Diskussionen mithilfe von Post-Zeit, Datum/Uhrzeit und Datumsbereichsfiltern.
🐙 Warum Octoparse
- Gebrauchsfertiger Workflow: Die Extraktionsschritte für die Old Reddit Search sind bereits konfiguriert, sodass Sie den Scraper nicht von Grund auf neu erstellen müssen.
- Flexible Ausführung: Führen Sie den vorgefertigten Task in der Cloud aus, ohne einen lokalen Computer für die Sammlung online halten zu müssen.
- Strukturierte, wiederholbare Ausgabe: Die Ergebnisse werden in konsistenten Zeilen zurückgegeben, die einfacher zu vergleichen, zu filtern, zu deduplizieren und zu verarbeiten sind als manuell kopierte Seiten.
- Verifizierte Eingabe-Leitplanken: Das Formular zeigt die aktuellen Eingaben, auswählbaren Werte und sinnvollen Grenzen an, die für diese Vorlage konfiguriert sind.
- Praktische Datenübergabe: Überprüfen Sie die Ergebnisse in Octoparse und exportieren oder verarbeiten Sie sie mit den von Ihrer Octoparse-Umgebung unterstützten Optionen.
📝 Eingabe
Füllen Sie die folgenden Felder aus:
- Suchbegriff (Erforderlich) — Suchbegriff. Bis zu 100.000 Einträge pro Durchlauf.
- Sortiert nach (Optional) — Sortiert nach.
- Datumsbereich (Optional) — Datumsbereich.
- Paginierung (Optional) — Legen Sie die Anzahl der zu sammelnden Suchergebnisseiten fest. Akzeptierter Bereich: 1 bis 10.
🚀 Wie man es benutzt
- Öffnen Sie die Vorlage und wählen Sie Ausprobieren oder Starten.
- Füllen Sie die oben aufgeführten Eingabefelder aus.
- Starten Sie den Task im unterstützten Cloud-Ausführungsmodus.
- Überprüfen Sie die Ausgabezeilen und exportieren oder verarbeiten Sie die strukturierten Daten.
⚠️ Einschränkungen
Die Ergebnisse hängen davon ab, was die Quellseite zur Laufzeit preisgibt. Ein aufgeführtes Ausgabefeld kann leer sein, wenn die Quellseite diesen Wert nicht bereitstellt. Die oben gezeigten Eingabegrenzen werden von der Vorlage erzwungen.
💡 Tipps
Verwenden Sie spezifische, gültige Eingaben und überprüfen Sie ein repräsentatives Ergebnis, bevor Sie einen großen Stapel starten. Entfernen Sie doppelte Eingaben, wenn wiederholte Datensätze nicht benötigt werden.
❓ FAQ
Wie sammelt Octoparse Daten von der Old Reddit Search?
Die Python-Automatisierung übermittelt jeden Suchbegriff an Old Reddit mit der ausgewählten Sortierung und dem Datumsbereich, paginiert durch die konfigurierte Anzahl von Ergebnisseiten, parst jede Beitrags-Karte und lädt strukturierte Suchergebniszeilen hoch.
Welche Eingaben benötigt dieser Reddit Search Scraper?
Verwenden Sie die im Abschnitt „Eingabe“ gezeigten Felder und akzeptierten Werte. Es werden nur benutzerrelevante Grenzwerte und auswählbare Optionen aufgeführt.
Welche Daten kann ich aus der Old Reddit Search extrahieren?
Die aktuellen Ausgabefelder und eine repräsentative JSON-Datenvorschau sind im Abschnitt „Ausgabe“ aufgeführt. Die Verfügbarkeit von Feldern kann variieren, wenn die Quellseite einen Wert nicht anzeigt.
Wie viel kostet dieser Reddit Search Scraper?
Der aktuelle Preis beträgt $0,05/1.000 Zeilen, und die Abrechnung basiert auf der Anzahl der vom Task erzeugten Ausgabezeilen.
Warum können einige Felder der Old Reddit Search leer sein?
Quellseiten geben nicht immer jeden Wert für jeden Datensatz preis, und Layouts können je nach Artikel, Markt oder aktueller Seitenantwort variieren. Die Vorlage gibt ein Feld zurück, wenn die aktuelle Seite es bereitstellt.
Kann ich die gesammelten Daten der Old Reddit Search exportieren?
Sie können die strukturierten Zeilen in Octoparse überprüfen und sie mit den von Ihrer Octoparse-Umgebung unterstützten Optionen exportieren oder verarbeiten.
🔗 Verwandte Vorlagen
- Reddit Post & Comments Scraper — Verwenden Sie den Reddit Post & Comments Scraper, wenn Datensätze auf Bewertungs- oder Kommentarebene benötigt werden.
- Reddit Subreddit Scraper — Verwenden Sie den Reddit Subreddit Scraper, wenn Datensätze auf Bewertungs- oder Kommentarebene benötigt werden.
- Reddit Post & Comments Scraper (Free) — Verwenden Sie den Reddit Post & Comments Scraper (Kostenlos), um entdeckte URLs mit Daten von Detailseiten anzureichern.