📌 Welche Xiaohongshu-Beitragsergebnisse können Sie nach Stichwort sammeln?
Diese Vorlage sammelt Suchergebnisdatensätze mit Titel, Bild-URL, Detailseiten-URL, Autoren-URL, Datum/Uhrzeit, Autor, eingegebenen Stichwörtern und Anzahl der Likes. Sie ist nützlich für Social-Media-Forscher, Content-Teams, Markenanalysten und Zielgruppenforscher.
Die Daten werden von Xiaohongshu gesammelt. Xiaohongshu ist eine soziale Entdeckungsplattform, die sich auf Nutzerbeiträge, Produkte, Lifestyle-Themen und Empfehlungen konzentriert.
💰 Preisgestaltung
Diese Vorlage ist derzeit kostenlos und hat keine Nutzungsgebühr pro Zeile. Tarif- oder Ressourcenbeschränkungen von Octoparse können weiterhin gelten.
📦 Ausgabe
Die aktuell veröffentlichte Implementierung kann die folgenden Felder zurückgeben:
Input_keywordsTitleImage_URLDetails_page_URLAuthorDatetimeAuthor_URLLike_countRecommended_reason
{
"Input_keywords": "web scraping",
"Title": "推荐3款自动爬虫神器,再也不用手撸代码了",
"Image_URL": "https://sns-webpic-qc.xhscdn.com/202511101556/e6aa53f42ed33364e0afd76422cd9bc3/1040g008314t3depl14005npqjgqg8e7a9v66v7g!nc_n_webp_mw_1",
"Details_page_URL": "https://www.xiaohongshu.com/search_result/66889d19000000000a026420?xsec_token=ABNlEB76L3vQ5N6cIYO-nnMuxpO0YslweSJOt3wLL32-8=&xsec_source=",
"Author": "Python大数据分析",
"Datetime": "2024-07-06",
"Author_URL": "https://www.xiaohongshu.com/user/profile/5f3a9c3500000000010038ea?channel_type=web_search_result_notes&parent_page_channel_type=web_profile_board&xsec_token=AB6uZC_94FYmu431pd_4pk8yP8HtOlqXAyi_kjD4UVbiA=&xsec_source=pc_search",
"Like_count": "511",
"Recommended_reason": null
}
🎯 Anwendungsfälle
- Erstellen Sie einen strukturierten Forschungsdatensatz, der nach eingegebenen Stichwörtern und Titeln geordnet ist.
- Analysieren Sie den Quellinhalt und das Timing anhand von Autor, Autoren-URL und Datum/Uhrzeit.
- Messen Sie die Zielgruppen- oder Kundenbindung anhand der Anzahl der Likes.
- Verwenden Sie die Bild-URL, die Detailseiten-URL und die Autoren-URL, um Quelldatensätze zu überprüfen oder verifizierte Seiten in nachgelagerte Arbeitsabläufe einzuspeisen.
🐙 Warum Octoparse
- Gebrauchsfertiger Arbeitsablauf: Die Extraktionsschritte für Xiaohongshu sind bereits konfiguriert, sodass Sie den Scraper nicht von Grund auf neu erstellen müssen.
- Flexible Ausführung: Wählen Sie den unterstützten lokalen oder Cloud-Ausführungsmodus, um einmalige Überprüfungen oder wiederholbare Sammelarbeiten durchzuführen.
- Strukturierte, wiederholbare Ausgabe: Die Ergebnisse werden in konsistenten Zeilen zurückgegeben, die einfacher zu vergleichen, zu filtern, zu deduplizieren und zu verarbeiten sind als manuell kopierte Seiten.
- Verifizierte Eingabeschutzmechanismen: Das Formular zeigt die aktuellen Eingaben, auswählbaren Werte und sinnvollen Grenzen an, die für diese Vorlage konfiguriert sind.
- Praktische Datenübergabe: Überprüfen Sie die Ergebnisse in Octoparse und exportieren oder verarbeiten Sie sie mit den von Ihrer Octoparse-Umgebung unterstützten Optionen.
📝 Eingabe
Füllen Sie die folgenden Felder aus:
- Pre-Login (Erforderlich) — Aktivieren Sie das Pre-Login, bevor Sie Xiaohongshu durchsuchen.
- Stichwörter (Erforderlich) — Geben Sie Xiaohongshu-Suchstichwörter ein, eines pro Zeile. Bis zu 100 Einträge pro Durchlauf.
🚀 Anwendung
- Öffnen Sie die Vorlage und wählen Sie Ausprobieren oder Starten.
- Füllen Sie die oben aufgeführten Eingabefelder aus.
- Starten Sie die Aufgabe im unterstützten lokalen oder Cloud-Ausführungsmodus.
- Überprüfen Sie die Ausgabezeilen und exportieren oder verarbeiten Sie die strukturierten Daten.
⚠️ Einschränkungen
Die Ergebnisse hängen davon ab, was die Quellseite zur Laufzeit bereitstellt. Ein aufgeführtes Ausgabefeld kann leer sein, wenn die Quellseite diesen Wert nicht liefert. Die oben gezeigten Eingabegrenzen werden von der Vorlage erzwungen.
💡 Tipps
Verwenden Sie spezifische, gültige Eingaben und überprüfen Sie ein repräsentatives Ergebnis, bevor Sie eine große Charge starten. Entfernen Sie doppelte Eingaben, wenn wiederholte Datensätze nicht benötigt werden.
❓ FAQ
Wie funktioniert dieser Scraper?
Die Automatisierung wendet Pre-Login und Stichwörter (bis zu 100 pro Durchlauf) an, verarbeitet die resultierenden Suchseiten und deren Ergebniselemente und schreibt strukturierte Zeilen, einschließlich eingegebener Stichwörter, Titel, Bild-URL und Detailseiten-URL.
Was muss ich eingeben?
Verwenden Sie die im Abschnitt „Eingabe“ gezeigten Felder und akzeptierten Werte. Es werden nur benutzerrelevante Grenzen und auswählbare Optionen aufgeführt.
Welche Daten gibt diese Vorlage zurück?
Die aktuellen Ausgabefelder und eine repräsentative JSON-Datenvorschau sind im Abschnitt „Ausgabe“ aufgeführt. Die Verfügbarkeit von Feldern kann variieren, wenn die Quellseite einen Wert nicht anzeigt.
Ist die Nutzung dieser Vorlage kostenlos?
Sie ist derzeit kostenlos und hat keine Nutzungsgebühr pro Zeile. Tarif- oder Ressourcenbeschränkungen von Octoparse können weiterhin gelten.
Warum können einige Ausgabefelder leer sein?
Quellseiten geben nicht immer jeden Wert für jeden Datensatz an, und die Layouts können je nach Artikel, Markt oder aktueller Seitenantwort variieren. Die Vorlage gibt ein Feld zurück, wenn die aktuelle Seite es bereitstellt.
Kann ich die gesammelten Daten exportieren?
Sie können die strukturierten Zeilen in Octoparse überprüfen und sie mit den von Ihrer Octoparse-Umgebung unterstützten Optionen exportieren oder verarbeiten.
🔗 Verwandte Vorlagen
- Xiaohongshu Post Details Scraper — Verwenden Sie den Xiaohongshu Post Details Scraper, um entdeckte URLs mit Daten von Detailseiten anzureichern.
- Xiaohongshu Search Results Scraper (nach URL) — Verwenden Sie den Xiaohongshu Search Results Scraper (nach URL) für einen ergänzenden Arbeitsablauf auf derselben Quellseite.
- Twitter (X) Comments Scraper — Verwenden Sie den Twitter (X) Comments Scraper, um vergleichbare Social-Media-Daten aus einer anderen Quelle zu sammeln.