Datenfeeds aus öffentlichen Quellen, die weiterlaufen.

Wenn Apify, Octoparse oder ein ChatGPT-Skript blockiert wird und leere Seiten liefert, übernehme ich die Extraktion und halte sie am Leben.

Zwei Minuten. Schicken Sie die öffentliche URL und die Felder, die Sie brauchen. Ich antworte mit dem, was extrahierbar ist, wie, und zu welchem Preis.

rohes öffentliches web → strukturierter feed live
title price availability rating source fetched_at 0000 Zeilen geliefert

Leistungen

Mit einem Audit starten. Zum betreuten Feed ausbauen.

Vier Einstiege, von der risikoarmen Prüfung bis zum Feed, den ich am Leben halte.

Hidden-API-Audit

Details ansehen

Ich prüfe eine öffentliche Website, finde den saubersten Datenweg und sende Ihnen rund 50 echte Beispielzeilen. Der risikoarme Einstieg.

150 €Festpreis

Einmaliger Scraper

Details ansehen

Ein robuster Scraper für eine öffentliche Quelle, geliefert als getesteter Code, der Ihnen gehört. Saubere Ausgabe als CSV, JSON oder API.

600 €bis 1.500, einmalig

Betreuter Datenfeed

Details ansehen

Scraper, geplante Lieferung und Monitoring. Die Quelle ändert sich, etwas bricht, ich repariere, meist bevor Sie es merken.

500 €Einrichtung, dann 150 bis 500 € / Monat

Discord-Bot

Details ansehen

Ein maßgeschneiderter Bot für Ihre Community: Automatisierungen, Abfragen öffentlicher Daten, geplante Posts. Gebaut und gehostet.

500 €bis 2.500, zzgl. Hosting

Vom blockierten Scraper zum Feed, auf den Verlass ist.

1

Audit

Ich prüfe die öffentliche Quelle und finde den verlässlichsten Extraktionsweg, eine Hidden API, wo es sie gibt.

2

Bauen

Ein getesteter Scraper, der JS-lastige und Cloudflare-geschützte öffentliche Seiten beherrscht und saubere Daten liefert.

3

Planen & überwachen

Lieferung in Ihrem Rhythmus, mit Monitoring. Ändert sich die Quelle und etwas bricht, repariere ich.

4

Sie betreiben & besitzen

Sie betreiben das Tool und besitzen die Daten. Ich baue und warte es: ein Werkzeug, kein Betreiberdienst.

Das Ergebnis

Ein Datensatz, den Sie prüfen können, kein Versprechen.

Echte Ausgabe des Open-Source-Starters hinter dem Angebot Betreuter Datenfeed, ausgeführt auf einem öffentlichen Test-Katalog. Genau die Form, die in Ihrem Postfach oder Ihrer Datenbank landet.

books-demo.csv · run 2026-06-17 21:05 UTCCSV
title price availability rating source
A Light in the Attic£51.77In stockThreebooks.toscrape.com
Tipping the Velvet£53.74In stockOnebooks.toscrape.com
Soumission£50.10In stockOnebooks.toscrape.com
Sharp Objects£47.82In stockFourbooks.toscrape.com
Sapiens: A Brief History of Humankind£54.23In stockFivebooks.toscrape.com
Öffentliche Test-Quelle. Faktische, nicht personenbezogene Felder. Eine Zeile pro Produkt, eine Spalte pro Feld, mit erhaltenem Abruf-Zeitstempel.

Ihr Feed trägt Ihre Felder und sonst nichts: die Spalten, die Sie wollten, im Format, das Sie wollten.

Rahmen

Verlässlichkeit statt Umgehung.

  • Nur öffentliche Seiten, ohne Login. Faktische und geschäftliche Daten: Preise, Spezifikationen, Bestände, Inserate, Marktdaten, Fahrpläne. Keine Logins, keine Paywalls, keine Konten.
  • Keine personenbezogenen Daten. Strikt ohne PII. Keine Namen mit Kontaktdaten, keine Profile, keine Fotos. Nur B2B- und Sachdaten.
  • robots.txt und Rate-Limits respektiert. Seiten werden gelesen wie von einem normalen Besucher, in respektvollem Tempo. Die Ausgabe ist strukturiert und transformiert.
  • Sie betreiben und besitzen die Daten. Ich baue und warte das Tool, Sie betreiben es und kontrollieren die Daten. Eine saubere, dokumentierte Übergabe, jedes Mal.

Typisch im Rahmen

Produktpreise, Specs, Beständee-commerce
Inserate (Preis, Fläche, Lage)immobilien
Katalog- und Marktplatzdatenmarktplatz
Marktdaten, Fahrpläne, Preisereise · finanzen
Feedsmith baut ein Werkzeug zum Lesen öffentlicher, faktischer Daten. Es dient nicht dem Zugriff auf Logins, Paywalls oder personenbezogene Daten. Sie bleiben Betreiber und Eigentümer der Daten und bestätigen Ihr Recht auf Zugriff auf die Quelle.

Belege

Open Source, getestet, lauffähig.

Kein Foliensatz. Echter Code zum Lesen, Klonen und Ausführen: die schwierigen 20 % des Scrapings, an denen No-Code-Tools scheitern.

feeds/books_demo.yamlconfig
id: books-demo
source: books.toscrape.com
fields: [title, price, availability, rating]
rate_limit_seconds: 1.5
urls: ["https://books.toscrape.com/catalogue/page-1.html"]
schedule:
  interval_seconds: 30
output:
  kind: csv
  path: data/books-demo.csv
Ein Feed, eine Datei. Das ist die gesamte Konfiguration hinter dem Beispiel oben.
starter

managed-data-feed-starter

Das Angebot Betreuter Datenfeed als Code: robustes Fetching, No-PII-Policy, Zeitplan, selbstheilendes Monitoring, Ausgabe als CSV / JSON / Webhook.

Auf GitHub ansehen
template

hidden-api-extraction-template

Die interne JSON-API einer Website direkt lesen statt fragiles HTML zu parsen: schneller und deutlich stabiler.

Auf GitHub ansehen
demo

tls-fingerprint-scraper-demo

Warum eine öffentliche Seite leer zurückkommt: ein TLS-Fingerprint-Check vor dem Rendern. Wie man sie wie ein normaler Browser liest, regelkonform.

Auf GitHub ansehen

Kostenlose Machbarkeitsprüfung anfragen

Nennen Sie mir die öffentliche Website und die Daten, die Sie brauchen. Ich sage Ihnen, ob es machbar ist, wie, und in welcher Sprache.

Oder per E-Mail: hello@feedsmith.net · Sitz in der Schweiz · DE / FR / IT / EN.