Todos os serviços web

Scraping web na VM0

Dê um link ao agente e ele volta com o que a página realmente diz, em texto limpo e legível. Sem se cadastrar em nenhum serviço de scraping.

Dados da web · Sem configuração · Dois modos de cobrança, padrão e enhanced

Aponte um agente para um link público e ele lê a página para você: as palavras, não os menus de navegação, os avisos de cookies e os rodapés. Peça a página como texto limpo, ou só a lista de links quando a tarefa for decidir o que ler em seguida.

A VM0 roda a leitura no Firecrawl e paga por ela, então ninguém do seu time se cadastra, guarda uma chave ou concilia uma segunda fatura. O escopo é propositalmente estreito: uma página por requisição. Encontrar páginas é tarefa da busca na web, e tudo que exige login ou clique pertence ao navegador remoto.

O que é Scraping web

Toda pesquisa chega ao ponto em que um resultado de busca não basta e você precisa do que a página realmente diz. Acertar isso é mais difícil do que parece. As páginas carregam metade do conteúdo com scripts, e o texto útil fica entre menus, faixas e anúncios.

A VM0 paga por isso como serviço para que os seus agentes não precisem. O agente envia um link público e recebe a página como texto limpo, que ele pode ler e resumir, ou como a lista de todos os seus links.

Algumas páginas resistem a uma leitura normal. Para essas existe um modo mais forte, e o agente precisa pedi-lo, porque custa mais por página e você deve conseguir ver quando um fluxo o escolheu.

É a mesma coisa que se procura como API de scraping web, e o mesmo motor que se considera ao comparar os preços do Firecrawl com escrever um scraper próprio. A diferença é onde fica a conta: aqui não há cadastro, chave de API nem plano mensal do seu lado, e você paga por página em créditos.

O que Scraping web faz

O que um agente consegue fazer com isso, e o que volta quando ele faz.

O que você dáO link de uma página web pública
O que voltaA página como texto limpo e legível, ou a lista de seus links
Para páginas difíceisUm modo mais forte que o agente pede de propósito
O que ele não abreQualquer coisa atrás de um login

Cobertura e limites

O que ele não faz, dito de saída, para ninguém montar um fluxo em cima de algo que está fora do escopo.

Apenas páginas públicas

Não há login envolvido, então uma página atrás de acesso, paywall ou barreira antibot está fora do escopo. É para isso que existe o navegador remoto.

Uma página por vez

Ele lê a página que você apontar. Não sai vagando pelo resto do site: ler um site inteiro significa pedir página por página e pagar página por página.

O modo caro é uma escolha

A maioria das páginas é lida bem do jeito normal. O modo mais forte custa mais e o agente precisa pedi-lo, então um fluxo nunca fica mais caro em silêncio.

O que volta é informação, não ordem

O texto de uma página web é tratado como algo a ler, nunca como instrução a seguir. É isso que impede uma página hostil de convencer um agente a fazer outra coisa.

Quanto custa Scraping web

Os serviços web são cobrados em créditos por chamada, não por token. Não há uma fatura separada de fornecedor para conciliar.

CobrançaDois modos de cobrança, padrão e enhanced
Roda emFirecrawl
Comandozero scrape

Você paga em créditos por página lida, e o modo mais forte custa mais que o normal. Não há assinatura do Firecrawl por baixo nem mínimo, então um fluxo que lê três páginas por semana paga por três páginas por semana.

Configuração e acesso

Nada para configurar

Nada para conectar. Sem cadastro no Firecrawl, sem chave para colar, nada acrescentado à sua lista de conectores. É essa a diferença entre isto e o conector Firecrawl do catálogo da VM0: o conector roda na sua conta e na sua fatura do Firecrawl, e este roda nas nossas.

Quem pode usar

Ler páginas web é uma permissão que você distribui, não algo que todo agente tem. Dê aos agentes e às pessoas que precisam, pelo tempo que precisarem, e retire sem tocar em mais nada que aquele agente saiba fazer.

Para que os times usam Scraping web

Ler a página por trás de um resultado de busca

A busca te dá um título e duas linhas. Quase todo trabalho precisa do corpo do texto, então o padrão é buscar primeiro, escolher os dois ou três resultados que importam e ler só esses.

Acompanhar páginas que não têm outra porta de entrada

Preços de concorrentes, changelogs, páginas de status, avisos regulatórios. Um agente agendado lê a página, compara com a da semana passada e só avisa quando algo mudou.

Transformar um documento longo em material de trabalho

Uma especificação, um relatório anual, uma central de ajuda. Texto limpo é a diferença entre um resumo do documento e um resumo do menu de navegação dele.

Quando não usar Scraping web

Pule quando a página exigir login, clique ou formulário, e use o navegador remoto. Pule para ler um site inteiro, onde o custo por página cresce mais rápido do que a resposta vale. E pule quando a fonte publica dados próprios, quase sempre mais estáveis do que ler as páginas dela.

Como isso se chama em outros lugares

A mesma coisa aparece no mercado com vários nomes. Se você já pesquisou por algum deles, é assim que ele corresponde ao que você recebe aqui.

API de scraping web

O nome usual para pagar um serviço que busca uma página e devolve o texto dela. É exatamente isso. A conta e a chave são da VM0, não suas.

A API do Firecrawl sem uma chave do Firecrawl

O Firecrawl é o motor por baixo. Você recebe a saída dele sem se registrar, gerar chave ou escolher plano, e o uso aparece nos seus créditos VM0 em vez de numa segunda fatura.

De HTML para Markdown

A conversão que normalmente se escreve à mão: entra uma página HTML, sai Markdown limpo. Acontece antes de o texto chegar ao agente, e é por isso que um modelo gasta atenção no conteúdo em vez de na marcação.

Scraping para IA ou LLM

Scraping cuja saída é para ser lida por um modelo e não analisada por código. É a mesma busca, avaliada pelo quanto o texto é legível e não por um seletor continuar batendo.

Scraping sem código

Aqui ninguém escreve scraper. Você pede a página numa mensagem e o agente busca — é o que se procura quando se procura scraping sem escrever código.

Scraping web em comparação

Scraping web versus rodar o Firecrawl por conta própria

Mesmo motor, uma quantidade de trabalho bem diferente. Por conta própria significa uma conta, uma chave que alguém precisa guardar, um plano a escolher e uma segunda fatura a conciliar, e cada colega que quiser rodar o fluxo também precisa dessa chave. Aqui a leitura e a conta ficam com a VM0, e o acesso é uma permissão em vez de um segredo compartilhado.

Scraping web versus o conector Firecrawl

A VM0 também oferece um conector Firecrawl, e ele é a escolha certa se você já paga o Firecrawl e quer o uso na sua conta, ou se precisa de algo que este serviço não cobre. O integrado é certo quando você prefere não ter a conta.

Scraping web versus dirigir um navegador você mesmo

Um navegador que você opera é mais capaz e muito mais trabalhoso, e no fim você ainda precisa transformar a página em texto legível. Use o navegador remoto quando o trabalho realmente exigir cliques, e isto quando você só precisa do que a página diz.

Em poucas palavras

A forma padrão de ler uma página web na VM0. Se a página é pública e você quer o que está nela, isto é um passo só, sem conta, com cobrança por página. Tudo que exige login ou clique pertence ao navegador remoto.

Perguntas frequentes

Preciso de uma conta no Firecrawl?

Não. A VM0 lê a página em seu nome e cobra a leitura em créditos. Você nunca cria conta nem guarda chave.

Qual a diferença para o conector Firecrawl?

O conector roda na sua conta e na sua fatura do Firecrawl. Este roda nas nossas. Use o conector se você já paga o Firecrawl ou precisa de algo que este serviço não cobre.

Ele lê páginas atrás de login?

Não. Ele abre páginas públicas, sem login. Use o navegador remoto, que pode ficar conectado e ser assumido por uma pessoa no meio do caminho.

Ele lê um site inteiro?

Sozinho, não. Cada leitura é uma página, então cobrir um site significa pedir página por página, e cada página é cobrada. Vale definir um limite.

Quanto custa ler uma página?

Créditos por leitura bem-sucedida, com cobrança maior no modo mais forte usado em páginas que resistem à leitura normal. Esse modo nunca é escolhido em silêncio.

É seguro agir com base no que volta?

Trate como informação. A VM0 lida com texto de página web como material de leitura e não como instrução a seguir, e é isso que impede uma página de redirecionar o agente que a leu.

Isto é uma alternativa ao Firecrawl?

Se o que você quer é a saída do Firecrawl sem uma conta do Firecrawl, sim. Se quer o painel, o plano e o conjunto completo de recursos dele, use o conector Firecrawl com a sua própria chave.

Como o custo se compara a um plano de scraping meu?

Serviços de scraping vendem planos mensais com mínimo. Aqui você paga por página em créditos, sem compromisso mensal, o que costuma sair mais barato para um fluxo que lê algumas páginas por semana e pior em volume muito alto.

Ele devolve Markdown para um modelo ler?

Sim. Markdown limpo é o formato padrão, e é isso que torna uma página utilizável como contexto em vez de um muro de marcação.

Preciso escrever um scraper ou manter seletores?

Não. Não há nada para escrever e nada que quebre quando uma página é redesenhada, porque você está pedindo o texto da página e não o conteúdo de um elemento específico.

Como você pede Scraping web

Você descreve o que quer em linguagem comum. O agente descobre de qual serviço precisa e faz as chamadas.

Leia uma página

Leia esta página e me dê as cinco coisas que importam, com as palavras exatas de cada uma.

Descubra o que ler e leia

Pegue os links deste índice da documentação e leia os três sobre preços, comparando-os.

Acompanhe uma página ao longo do tempo

Confira a página de preços do nosso concorrente toda segunda-feira e me avise só se algo mudou.