Datenfeeds aus öffentlichen Quellen, die weiterlaufen.
Wenn Apify, Octoparse oder ein ChatGPT-Skript blockiert wird und leere Seiten liefert, übernehme ich die Extraktion und halte sie am Leben.
Zwei Minuten. Schicken Sie die öffentliche URL und die Felder, die Sie brauchen. Ich antworte mit dem, was extrahierbar ist, wie, und zu welchem Preis.
Leistungen
Mit einem Audit starten. Zum betreuten Feed ausbauen.
Vier Einstiege, von der risikoarmen Prüfung bis zum Feed, den ich am Leben halte.
Hidden-API-Audit
Details ansehen →Ich prüfe eine öffentliche Website, finde den saubersten Datenweg und sende Ihnen rund 50 echte Beispielzeilen. Der risikoarme Einstieg.
Einmaliger Scraper
Details ansehen →Ein robuster Scraper für eine öffentliche Quelle, geliefert als getesteter Code, der Ihnen gehört. Saubere Ausgabe als CSV, JSON oder API.
Betreuter Datenfeed
Details ansehen →Scraper, geplante Lieferung und Monitoring. Die Quelle ändert sich, etwas bricht, ich repariere, meist bevor Sie es merken.
Discord-Bot
Details ansehen →Ein maßgeschneiderter Bot für Ihre Community: Automatisierungen, Abfragen öffentlicher Daten, geplante Posts. Gebaut und gehostet.
Vom blockierten Scraper zum Feed, auf den Verlass ist.
Audit
Ich prüfe die öffentliche Quelle und finde den verlässlichsten Extraktionsweg, eine Hidden API, wo es sie gibt.
Bauen
Ein getesteter Scraper, der JS-lastige und Cloudflare-geschützte öffentliche Seiten beherrscht und saubere Daten liefert.
Planen & überwachen
Lieferung in Ihrem Rhythmus, mit Monitoring. Ändert sich die Quelle und etwas bricht, repariere ich.
Sie betreiben & besitzen
Sie betreiben das Tool und besitzen die Daten. Ich baue und warte es: ein Werkzeug, kein Betreiberdienst.
Das Ergebnis
Ein Datensatz, den Sie prüfen können, kein Versprechen.
Echte Ausgabe des Open-Source-Starters hinter dem Angebot Betreuter Datenfeed, ausgeführt auf einem öffentlichen Test-Katalog. Genau die Form, die in Ihrem Postfach oder Ihrer Datenbank landet.
| title | price | availability | rating | source |
|---|---|---|---|---|
| A Light in the Attic | £51.77 | In stock | Three | books.toscrape.com |
| Tipping the Velvet | £53.74 | In stock | One | books.toscrape.com |
| Soumission | £50.10 | In stock | One | books.toscrape.com |
| Sharp Objects | £47.82 | In stock | Four | books.toscrape.com |
| Sapiens: A Brief History of Humankind | £54.23 | In stock | Five | books.toscrape.com |
Ihr Feed trägt Ihre Felder und sonst nichts: die Spalten, die Sie wollten, im Format, das Sie wollten.
Rahmen
Verlässlichkeit statt Umgehung.
- Nur öffentliche Seiten, ohne Login. Faktische und geschäftliche Daten: Preise, Spezifikationen, Bestände, Inserate, Marktdaten, Fahrpläne. Keine Logins, keine Paywalls, keine Konten.
- Keine personenbezogenen Daten. Strikt ohne PII. Keine Namen mit Kontaktdaten, keine Profile, keine Fotos. Nur B2B- und Sachdaten.
- robots.txt und Rate-Limits respektiert. Seiten werden gelesen wie von einem normalen Besucher, in respektvollem Tempo. Die Ausgabe ist strukturiert und transformiert.
- Sie betreiben und besitzen die Daten. Ich baue und warte das Tool, Sie betreiben es und kontrollieren die Daten. Eine saubere, dokumentierte Übergabe, jedes Mal.
Typisch im Rahmen
Belege
Open Source, getestet, lauffähig.
Kein Foliensatz. Echter Code zum Lesen, Klonen und Ausführen: die schwierigen 20 % des Scrapings, an denen No-Code-Tools scheitern.
id: books-demo source: books.toscrape.com fields: [title, price, availability, rating] rate_limit_seconds: 1.5 urls: ["https://books.toscrape.com/catalogue/page-1.html"] schedule: interval_seconds: 30 output: kind: csv path: data/books-demo.csv
managed-data-feed-starter
Das Angebot Betreuter Datenfeed als Code: robustes Fetching, No-PII-Policy, Zeitplan, selbstheilendes Monitoring, Ausgabe als CSV / JSON / Webhook.
Auf GitHub ansehen →hidden-api-extraction-template
Die interne JSON-API einer Website direkt lesen statt fragiles HTML zu parsen: schneller und deutlich stabiler.
Auf GitHub ansehen →tls-fingerprint-scraper-demo
Warum eine öffentliche Seite leer zurückkommt: ein TLS-Fingerprint-Check vor dem Rendern. Wie man sie wie ein normaler Browser liest, regelkonform.
Auf GitHub ansehen →Das Warum hinter der Arbeit.
Warum Ihr No-Code-Scraper immer wieder bricht
Layout-Änderungen, JS-gerenderte Daten, Fingerprint-Checks, und was wirklich hilft.
Guide lesen →Was ist eine Hidden API
Die internen JSON-Endpunkte hinter einer Seite, und warum sie das HTML-Parsing schlagen.
Guide lesen →Cloudflare-geschützte öffentliche Seiten
Leere Seiten sind meist ein TLS-Fingerprint-Check und kein CAPTCHA, und es gibt einen regelkonformen Weg, sie zu lesen.
Guide lesen →Kostenlose Machbarkeitsprüfung anfragen
Nennen Sie mir die öffentliche Website und die Daten, die Sie brauchen. Ich sage Ihnen, ob es machbar ist, wie, und in welcher Sprache.
Oder per E-Mail: hello@feedsmith.net · Sitz in der Schweiz · DE / FR / IT / EN.