Web-Scraping auf VM0
Geben Sie einem Agenten einen Link, und er kommt mit dem zurück, was auf der Seite wirklich steht — als sauber lesbarer Text. Ohne sich bei einem Scraping-Anbieter anzumelden.
Webdaten · Keine Einrichtung · Zwei Abrechnungsmodi, standard und enhanced
Zeigen Sie einem Agenten einen öffentlichen Link, und er liest die Seite für Sie: den Text, nicht die Navigationsmenüs, Cookie-Banner und Fußzeilen. Fragen Sie die Seite als sauberen Text ab — oder nur die Liste ihrer Links, wenn es darum geht, was als Nächstes zu lesen ist.
VM0 lässt das Lesen über Firecrawl laufen und bezahlt es, sodass sich niemand in Ihrem Team anmeldet, einen Schlüssel verwahrt oder eine zweite Rechnung abgleicht. Der Umfang bleibt bewusst schmal: eine Seite pro Anfrage. Seiten zu finden ist Aufgabe der Websuche, und alles hinter einem Login oder einem Klick gehört dem entfernten Browser.
Was Web-Scraping ist
Jede Recherche kommt an den Punkt, an dem ein Suchtreffer nicht mehr genügt und Sie brauchen, was auf der Seite tatsächlich steht. Das richtig hinzubekommen ist schwerer, als es aussieht. Seiten laden die Hälfte ihres Inhalts per Skript nach, und der nützliche Text steht zwischen Menüs, Bannern und Werbung.
VM0 bezahlt das als Dienst, damit Ihre Agenten es nicht selbst tun müssen. Der Agent schickt einen öffentlichen Link und bekommt die Seite als sauberen Text zurück, den er lesen und zusammenfassen kann — oder als Liste aller Links darauf.
Manche Seiten wehren sich gegen ein normales Auslesen. Dafür gibt es einen stärkeren Modus, den der Agent ausdrücklich anfordern muss, weil er pro Seite mehr kostet und sichtbar sein soll, wenn ein Workflow ihn gewählt hat.
Es ist dasselbe, wonach Leute als Web-Scraping-API suchen, und dieselbe Engine, die man heranzieht, wenn man Firecrawl-Preise gegen einen selbst geschriebenen Scraper abwägt. Der Unterschied liegt darin, wo das Konto liegt: Auf Ihrer Seite gibt es keine Anmeldung, keinen API-Schlüssel und keinen Monatstarif, und Sie zahlen je Seite in Credits.
Was Web-Scraping kann
Was ein Agent damit tun kann und was dabei zurückkommt.
Umfang und Grenzen
Was der Dienst nicht tut, gleich vorweg — damit niemand einen Workflow um etwas herum plant, das gar nicht dazugehört.
Nur öffentliche Seiten
Es ist keine Anmeldung im Spiel, also liegt eine Seite hinter Login, Paywall oder Bot-Sperre außerhalb des Umfangs. Dafür gibt es den entfernten Browser.
Eine Seite auf einmal
Gelesen wird die Seite, auf die Sie zeigen. Der Dienst wandert nicht durch den Rest der Website — eine ganze Website zu lesen heißt also, Seite für Seite zu fragen und Seite für Seite zu bezahlen.
Der teure Modus ist eine Entscheidung
Die meisten Seiten lassen sich normal lesen. Der stärkere Modus kostet mehr und muss vom Agenten angefordert werden, damit ein Workflow nie stillschweigend teurer wird.
Was zurückkommt, sind Informationen, keine Anweisungen
Text von einer Webseite wird als etwas behandelt, das man liest, nie als Anweisung, der man folgt. Genau das hindert eine feindselige Seite daran, einen Agenten zu etwas anderem zu überreden.
Was Web-Scraping kostet
Web-Dienste werden je Aufruf in Credits abgerechnet, nicht je Token. Es gibt keine separate Anbieterrechnung abzugleichen.
zero scrapeSie zahlen Credits je gelesener Seite, und der stärkere Modus kostet mehr als der normale. Darunter liegt kein Firecrawl-Abo und kein Mindestumsatz — ein Workflow, der drei Seiten pro Woche liest, zahlt drei Seiten pro Woche.
Einrichtung und Zugriff
Nichts einzurichten
Nichts zu verbinden. Keine Firecrawl-Anmeldung, kein Schlüssel zum Einfügen, nichts, was in Ihrer Konnektorliste auftaucht. Das ist der Unterschied zum Firecrawl-Konnektor im VM0-Katalog: Der läuft auf Ihrem Firecrawl-Konto und Ihrer Firecrawl-Rechnung, dieser hier auf unserer.
Wer es nutzen darf
Webseiten zu lesen ist eine Berechtigung, die Sie erteilen, und nicht etwas, das jeder Agent von sich aus hat. Geben Sie sie den Agenten und Personen, die sie brauchen, so lange sie sie brauchen, und nehmen Sie sie zurück, ohne an irgendetwas anderem zu rühren, was dieser Agent kann.
Wofür Teams Web-Scraping nutzen
Die Seite hinter einem Suchtreffer lesen
Die Suche liefert eine Überschrift und zwei Zeilen. Die meiste Arbeit braucht den Fließtext, also ist das Muster: erst suchen, die zwei oder drei relevanten Treffer auswählen, dann nur diese lesen.
Seiten beobachten, zu denen es keinen anderen Zugang gibt
Preisseiten von Wettbewerbern, Changelogs, Statusseiten, behördliche Mitteilungen. Ein geplanter Agent liest die Seite, vergleicht sie mit der letzten Woche und meldet sich nur, wenn sich etwas bewegt hat.
Aus einem langen Dokument Arbeitsmaterial machen
Eine Spezifikation, ein Geschäftsbericht, ein Hilfecenter. Sauberer Text ist der Unterschied zwischen einer Zusammenfassung des Dokuments und einer Zusammenfassung seines Navigationsmenüs.
Wann Sie Web-Scraping nicht nutzen sollten
Lassen Sie es, wenn die Seite eine Anmeldung, einen Klick oder ein Formular braucht — nehmen Sie dann den entfernten Browser. Lassen Sie es beim Lesen einer ganzen Website, wo sich die Kosten je Seite schneller summieren, als die Antwort wert ist. Und lassen Sie es, wenn die Quelle eigene, ordentliche Daten veröffentlicht: die sind fast immer stabiler, als ihre Seiten zu lesen.
Wie das anderswo heißt
Dieselbe Sache trägt am Markt mehrere Namen. Wenn Sie nach einem davon gesucht haben, sehen Sie hier, was dem entspricht.
Web-Scraping-API
Der übliche Name dafür, einen Dienst dafür zu bezahlen, eine Seite zu holen und ihren Text zurückzugeben. Genau das ist es. Konto und Schlüssel gehören VM0 und nicht Ihnen.
Die Firecrawl-API ohne Firecrawl-Schlüssel
Firecrawl ist die Engine darunter. Sie bekommen ihre Ausgabe, ohne sich zu registrieren, einen API-Schlüssel zu erzeugen oder einen Firecrawl-Tarif zu wählen, und die Nutzung erscheint auf Ihren VM0-Credits statt auf einer zweiten Rechnung.
HTML zu Markdown
Die Umwandlung, die man sonst selbst schreibt: eine HTML-Seite hinein, sauberes Markdown heraus. Sie passiert, bevor der Text den Agenten überhaupt erreicht — deshalb verwendet ein Modell seine Aufmerksamkeit auf den Inhalt statt auf das Markup.
KI- oder LLM-Web-Scraping
Scraping, dessen Ausgabe von einem Modell gelesen und nicht von Code geparst werden soll. Es ist derselbe Abruf, bewertet daran, ob der Text lesbar ist, und nicht daran, ob ein Selektor noch passt.
No-Code-Web-Scraping
Hier schreibt niemand einen Scraper. Sie fragen in einer Nachricht nach der Seite, und der Agent holt sie — genau das suchen Leute, wenn sie nach Scraping ohne Code suchen.
Web-Scraping im Vergleich
Web-Scraping vs. Firecrawl selbst betreiben
Dieselbe Engine, ein sehr unterschiedlicher Aufwand. Auf eigene Faust heißt das: ein Konto, ein Schlüssel, den jemand sicher verwahren muss, ein Tarif zum Auswählen und eine zweite Rechnung zum Abgleichen — und jede Kollegin, die den Workflow ausführen will, braucht diesen Schlüssel auch. Hier liegen Lesen und Rechnung bei VM0, und der Zugriff ist eine Berechtigung statt eines geteilten Geheimnisses.
Web-Scraping vs. dem Firecrawl-Konnektor
VM0 liefert auch einen Firecrawl-Konnektor, und der ist die richtige Wahl, wenn Sie Firecrawl ohnehin bezahlen und die Nutzung auf Ihrem eigenen Konto sehen wollen — oder etwas brauchen, das dieser Dienst nicht abdeckt. Der eingebaute ist richtig, wenn Sie das Konto am liebsten gar nicht hätten.
Web-Scraping vs. einen Browser selbst steuern
Ein Browser, den Sie bedienen, kann mehr und macht deutlich mehr Arbeit — und die Seite in lesbaren Text zu verwandeln steht danach immer noch an. Nehmen Sie den entfernten Browser, wenn die Aufgabe wirklich Klicks braucht, und diesen Dienst, wenn Sie einfach wissen wollen, was auf der Seite steht.
Kurz gesagt
Der Standardweg, auf VM0 eine Webseite zu lesen. Wenn die Seite öffentlich ist und Sie wissen wollen, was darauf steht, ist das ein Schritt, kein Konto und eine Gebühr je Seite. Alles, was sich anmelden oder klicken muss, gehört dem entfernten Browser.
Häufige Fragen
Brauche ich ein Firecrawl-Konto?
Nein. VM0 liest die Seite in Ihrem Auftrag und rechnet das Lesen in Credits ab. Sie legen nie ein Konto an und halten nie einen Schlüssel.
Worin unterscheidet sich das vom Firecrawl-Konnektor?
Der Konnektor läuft auf Ihrem Firecrawl-Konto und Ihrer Firecrawl-Rechnung. Dieser Dienst läuft auf unserer. Nehmen Sie den Konnektor, wenn Sie Firecrawl ohnehin bezahlen oder etwas brauchen, das dieser Dienst nicht abdeckt.
Kann es Seiten hinter einem Login lesen?
Nein. Es öffnet öffentliche Seiten ohne Anmeldung. Nehmen Sie den entfernten Browser, der angemeldet bleiben und mittendrin von einer Person übernommen werden kann.
Kann es eine ganze Website lesen?
Nicht von sich aus. Jeder Abruf ist eine Seite, eine Website abzudecken heißt also Seite für Seite zu fragen, und jede Seite wird berechnet. Es lohnt sich, ein Limit zu setzen.
Was kostet das Lesen einer Seite?
Credits je erfolgreichem Abruf, mit einem höheren Betrag für den stärkeren Modus, der bei Seiten nötig ist, die sich einem normalen Abruf widersetzen. Dieser Modus wird nie stillschweigend gewählt.
Kann ich auf das Zurückgekommene hin handeln?
Behandeln Sie es als Information. VM0 behandelt Text von einer Webseite als Material zum Lesen und nicht als Anweisung — das hindert eine Seite daran, den Agenten umzulenken, der sie gelesen hat.
Ist das eine Firecrawl-Alternative?
Wenn Sie Firecrawls Ausgabe ohne Firecrawl-Konto wollen: ja. Wenn Sie Firecrawls eigenes Dashboard, seinen Tarif und den vollen Funktionsumfang wollen, nehmen Sie stattdessen den Firecrawl-Konnektor mit Ihrem eigenen Schlüssel.
Wie steht der Preis zu einem eigenen Scraping-Tarif?
Scraping-Dienste verkaufen Monatstarife mit Mindestumsatz. Hier zahlen Sie je Seite in Credits ohne monatliche Bindung — für einen Workflow, der ein paar Seiten pro Woche liest, ist das meist günstiger, bei sehr hohem Volumen schlechter.
Kann es Markdown zurückgeben, das ein Modell lesen kann?
Ja. Sauberes Markdown ist die Standardform, und genau das macht eine Seite als Kontext nutzbar statt als Wand aus Markup.
Muss ich einen Scraper schreiben oder Selektoren pflegen?
Nein. Es gibt nichts zu schreiben und nichts, was bei einem Redesign kaputtgeht, weil Sie nach dem Text der Seite fragen und nicht nach dem Inhalt eines bestimmten Elements.
So fragen Sie nach Web-Scraping
Sie beschreiben in normaler Sprache, was Sie wollen. Der Agent findet heraus, welchen Dienst er dafür braucht, und macht die Aufrufe.
“Lies diese Seite und gib mir die fünf wichtigsten Punkte, jeweils mit dem genauen Wortlaut.”
“Hol die Links von dieser Dokumentationsübersicht, lies dann die drei zum Thema Preise und vergleiche sie.”
“Prüfe jeden Montag die Preisseite unseres Wettbewerbers und melde dich nur, wenn sich etwas geändert hat.”