📌 Welche Daten zur Buchentdeckung können Sie aus den Goodreads-Suchergebnissen sammeln?
Diese Vorlage sammelt strukturierte Datensätze von Suchergebnisseiten, einschließlich Keyword, Progress_result_count, Page_URL, Page, image_url, book_title, author, rating, rating_numbers, published_year, editions. Sie ist nützlich für Verleger, Autoren, Bibliothekare, Literaturforscher und Buchvermarkter.
Die Daten werden von Goodreads gesammelt. Goodreads ist eine Community zur Buchentdeckung und zum Lesen mit Titeln, Bewertungen, Ausgaben und Leserrezensionen.
💰 Preise
Diese Vorlage ist derzeit kostenlos und hat keine Nutzungsgebühr pro Zeile. Tarif- oder Ressourcenbeschränkungen von Octoparse können weiterhin gelten.
📦 Ausgabe
Die aktuell veröffentlichte Implementierung kann die folgenden Felder zurückgeben:
KeywordProgress_result_countPage_URLPageimage_urlbook_titleauthorratingrating_numberspublished_yeareditions
{
"Keyword": "education",
"Progress_result_count": null,
"Page_URL": null,
"Page": "1",
"image_url": "https://i.gr-assets.com/images/S/compressed.photo.goodreads.com/books/1375414895i/17851885._SY75_.jpg",
"book_title": "I Am Malala: The Story of the Girl Who Stood Up for Education and Was Shot by the Taliban",
"author": "Malala Yousafzai",
"rating": "4.14",
"rating_numbers": "504,883",
"published_year": "2012",
"editions": "170"
}
🎯 Anwendungsfälle
- Verwenden Sie rating, rating_numbers, um Bewertungen und Reputation zu vergleichen.
- Verwenden Sie image_url, book_title, um Produkt-, Inhalts- oder Menükataloge zu erstellen und zu vergleichen.
- Verwenden Sie author, um nach Autoren, Rezensenten, Verkäufern oder Geschäften zu recherchieren.
- Verwenden Sie Page_URL, um Datensätze mit Quellseiten oder nachgelagerten Detailerfassungen zu verknüpfen.
🐙 Warum Octoparse
- Gebrauchsfertiger Arbeitsablauf: Die Extraktionsschritte für Goodreads sind bereits konfiguriert, sodass Sie den Scraper nicht von Grund auf neu erstellen müssen.
- Flexible Ausführung: Wählen Sie den unterstützten lokalen oder Cloud-Ausführungsmodus, um einmalige Überprüfungen oder wiederholbare Sammelarbeiten durchzuführen.
- Strukturierte, wiederholbare Ausgabe: Die Ergebnisse werden in konsistenten Zeilen zurückgegeben, die im Vergleich zu manuell kopierten Seiten einfacher zu vergleichen, zu filtern, zu deduplizieren und zu verarbeiten sind.
- Verifizierte Eingabeschutzmechanismen: Das Formular zeigt die aktuellen Eingaben, auswählbaren Werte und sinnvollen Grenzen an, die für diese Vorlage konfiguriert sind.
- Praktische Datenübergabe: Überprüfen Sie die Ergebnisse in Octoparse und exportieren oder verarbeiten Sie sie mit den von Ihrer Octoparse-Umgebung unterstützten Optionen.
📝 Eingabe
Füllen Sie die folgenden Felder aus:
- Schlüsselwort (1 pro Zeile) (Erforderlich) — Geben Sie Schlüsselwörter für Buchkategorien oder Themen ein, eines pro Zeile.
- Anzahl der Seiten (Optional) — Legen Sie die Anzahl der zu verarbeitenden Goodreads-Suchergebnisseiten fest.
🚀 Wie man es benutzt
- Öffnen Sie die Vorlage und wählen Sie Ausprobieren oder Starten.
- Füllen Sie die oben aufgeführten Eingabefelder aus.
- Starten Sie die Aufgabe im unterstützten lokalen oder Cloud-Ausführungsmodus.
- Überprüfen Sie die Ausgabezeilen und exportieren oder verarbeiten Sie die strukturierten Daten.
⚠️ Einschränkungen
Die Ergebnisse hängen davon ab, was die Quellseite zur Laufzeit anzeigt. Ein aufgeführtes Ausgabefeld kann leer sein, wenn die Quellseite diesen Wert nicht bereitstellt. Die oben gezeigten Eingabegrenzen werden von der Vorlage erzwungen.
💡 Tipps
Verwenden Sie spezifische, gültige Eingaben und überprüfen Sie ein repräsentatives Ergebnis, bevor Sie eine große Charge starten. Entfernen Sie doppelte Eingaben, wenn wiederholte Datensätze nicht benötigt werden.
❓ FAQ
Wie funktioniert dieser Scraper?
Die Vorlage nimmt die konfigurierten Eingaben für Schlüsselwort (1 pro Zeile) und Anzahl der Seiten entgegen, übermittelt jeden angegebenen Wert und durchläuft die zurückgegebenen Datensätze auf den Goodreads-Suchergebnisseiten. Anschließend gibt sie strukturierte Zeilen aus, die Felder wie Keyword, Progress_result_count, Page_URL, Page, image_url enthalten.
Was muss ich eingeben?
Verwenden Sie die im Abschnitt „Eingabe“ gezeigten Felder und akzeptierten Werte. Es werden nur benutzerrelevante Grenzwerte und auswählbare Optionen aufgeführt.
Welche Daten gibt diese Vorlage zurück?
Die aktuellen Ausgabefelder und eine repräsentative JSON-Datenvorschau sind im Abschnitt „Ausgabe“ aufgeführt. Die Verfügbarkeit von Feldern kann variieren, wenn die Quellseite einen Wert nicht anzeigt.
Ist diese Vorlage kostenlos?
Sie ist derzeit kostenlos und hat keine Nutzungsgebühr pro Zeile. Tarif- oder Ressourcenbeschränkungen von Octoparse können weiterhin gelten.
Warum können einige Ausgabefelder leer sein?
Quellseiten zeigen nicht immer jeden Wert für jeden Datensatz an, und das Layout kann je nach Artikel, Markt oder aktueller Seitenantwort variieren. Die Vorlage gibt ein Feld zurück, wenn die aktuelle Seite es bereitstellt.
Kann ich die gesammelten Daten exportieren?
Sie können die strukturierten Zeilen in Octoparse überprüfen und sie mit den von Ihrer Octoparse-Umgebung unterstützten Optionen exportieren oder verarbeiten.
🔗 Verwandte Vorlagen
- Goodreads Comments Scraper — Verwenden Sie den Goodreads Comments Scraper, wenn Leserrezensionstexte, Bewertungen, Daten und Likes benötigt werden.
- Google Books Scraper — Verwenden Sie den Google Books Scraper für vergleichbare Buchentdeckungen sowie für Felder wie ISBN, Verlag, Beschreibung, Thema und Kauflink.