Scraping web na VM0
Dê um link ao agente e ele volta com o que a página realmente diz, em texto limpo e legível. Sem se cadastrar em nenhum serviço de scraping.
Dados da web · Sem configuração · Dois modos de cobrança, padrão e enhanced
Aponte um agente para um link público e ele lê a página para você: as palavras, não os menus de navegação, os avisos de cookies e os rodapés. Peça a página como texto limpo, ou só a lista de links quando a tarefa for decidir o que ler em seguida.
A VM0 roda a leitura no Firecrawl e paga por ela, então ninguém do seu time se cadastra, guarda uma chave ou concilia uma segunda fatura. O escopo é propositalmente estreito: uma página por requisição. Encontrar páginas é tarefa da busca na web, e tudo que exige login ou clique pertence ao navegador remoto.
O que é Scraping web
Toda pesquisa chega ao ponto em que um resultado de busca não basta e você precisa do que a página realmente diz. Acertar isso é mais difícil do que parece. As páginas carregam metade do conteúdo com scripts, e o texto útil fica entre menus, faixas e anúncios.
A VM0 paga por isso como serviço para que os seus agentes não precisem. O agente envia um link público e recebe a página como texto limpo, que ele pode ler e resumir, ou como a lista de todos os seus links.
Algumas páginas resistem a uma leitura normal. Para essas existe um modo mais forte, e o agente precisa pedi-lo, porque custa mais por página e você deve conseguir ver quando um fluxo o escolheu.
É a mesma coisa que se procura como API de scraping web, e o mesmo motor que se considera ao comparar os preços do Firecrawl com escrever um scraper próprio. A diferença é onde fica a conta: aqui não há cadastro, chave de API nem plano mensal do seu lado, e você paga por página em créditos.
O que Scraping web faz
O que um agente consegue fazer com isso, e o que volta quando ele faz.
Cobertura e limites
O que ele não faz, dito de saída, para ninguém montar um fluxo em cima de algo que está fora do escopo.
Apenas páginas públicas
Não há login envolvido, então uma página atrás de acesso, paywall ou barreira antibot está fora do escopo. É para isso que existe o navegador remoto.
Uma página por vez
Ele lê a página que você apontar. Não sai vagando pelo resto do site: ler um site inteiro significa pedir página por página e pagar página por página.
O modo caro é uma escolha
A maioria das páginas é lida bem do jeito normal. O modo mais forte custa mais e o agente precisa pedi-lo, então um fluxo nunca fica mais caro em silêncio.
O que volta é informação, não ordem
O texto de uma página web é tratado como algo a ler, nunca como instrução a seguir. É isso que impede uma página hostil de convencer um agente a fazer outra coisa.
Quanto custa Scraping web
Os serviços web são cobrados em créditos por chamada, não por token. Não há uma fatura separada de fornecedor para conciliar.
zero scrapeVocê paga em créditos por página lida, e o modo mais forte custa mais que o normal. Não há assinatura do Firecrawl por baixo nem mínimo, então um fluxo que lê três páginas por semana paga por três páginas por semana.
Configuração e acesso
Nada para configurar
Nada para conectar. Sem cadastro no Firecrawl, sem chave para colar, nada acrescentado à sua lista de conectores. É essa a diferença entre isto e o conector Firecrawl do catálogo da VM0: o conector roda na sua conta e na sua fatura do Firecrawl, e este roda nas nossas.
Quem pode usar
Ler páginas web é uma permissão que você distribui, não algo que todo agente tem. Dê aos agentes e às pessoas que precisam, pelo tempo que precisarem, e retire sem tocar em mais nada que aquele agente saiba fazer.
Para que os times usam Scraping web
Ler a página por trás de um resultado de busca
A busca te dá um título e duas linhas. Quase todo trabalho precisa do corpo do texto, então o padrão é buscar primeiro, escolher os dois ou três resultados que importam e ler só esses.
Acompanhar páginas que não têm outra porta de entrada
Preços de concorrentes, changelogs, páginas de status, avisos regulatórios. Um agente agendado lê a página, compara com a da semana passada e só avisa quando algo mudou.
Transformar um documento longo em material de trabalho
Uma especificação, um relatório anual, uma central de ajuda. Texto limpo é a diferença entre um resumo do documento e um resumo do menu de navegação dele.
Quando não usar Scraping web
Pule quando a página exigir login, clique ou formulário, e use o navegador remoto. Pule para ler um site inteiro, onde o custo por página cresce mais rápido do que a resposta vale. E pule quando a fonte publica dados próprios, quase sempre mais estáveis do que ler as páginas dela.
Como isso se chama em outros lugares
A mesma coisa aparece no mercado com vários nomes. Se você já pesquisou por algum deles, é assim que ele corresponde ao que você recebe aqui.
API de scraping web
O nome usual para pagar um serviço que busca uma página e devolve o texto dela. É exatamente isso. A conta e a chave são da VM0, não suas.
A API do Firecrawl sem uma chave do Firecrawl
O Firecrawl é o motor por baixo. Você recebe a saída dele sem se registrar, gerar chave ou escolher plano, e o uso aparece nos seus créditos VM0 em vez de numa segunda fatura.
De HTML para Markdown
A conversão que normalmente se escreve à mão: entra uma página HTML, sai Markdown limpo. Acontece antes de o texto chegar ao agente, e é por isso que um modelo gasta atenção no conteúdo em vez de na marcação.
Scraping para IA ou LLM
Scraping cuja saída é para ser lida por um modelo e não analisada por código. É a mesma busca, avaliada pelo quanto o texto é legível e não por um seletor continuar batendo.
Scraping sem código
Aqui ninguém escreve scraper. Você pede a página numa mensagem e o agente busca — é o que se procura quando se procura scraping sem escrever código.
Scraping web em comparação
Scraping web versus rodar o Firecrawl por conta própria
Mesmo motor, uma quantidade de trabalho bem diferente. Por conta própria significa uma conta, uma chave que alguém precisa guardar, um plano a escolher e uma segunda fatura a conciliar, e cada colega que quiser rodar o fluxo também precisa dessa chave. Aqui a leitura e a conta ficam com a VM0, e o acesso é uma permissão em vez de um segredo compartilhado.
Scraping web versus o conector Firecrawl
A VM0 também oferece um conector Firecrawl, e ele é a escolha certa se você já paga o Firecrawl e quer o uso na sua conta, ou se precisa de algo que este serviço não cobre. O integrado é certo quando você prefere não ter a conta.
Scraping web versus dirigir um navegador você mesmo
Um navegador que você opera é mais capaz e muito mais trabalhoso, e no fim você ainda precisa transformar a página em texto legível. Use o navegador remoto quando o trabalho realmente exigir cliques, e isto quando você só precisa do que a página diz.
Em poucas palavras
A forma padrão de ler uma página web na VM0. Se a página é pública e você quer o que está nela, isto é um passo só, sem conta, com cobrança por página. Tudo que exige login ou clique pertence ao navegador remoto.
Perguntas frequentes
Preciso de uma conta no Firecrawl?
Não. A VM0 lê a página em seu nome e cobra a leitura em créditos. Você nunca cria conta nem guarda chave.
Qual a diferença para o conector Firecrawl?
O conector roda na sua conta e na sua fatura do Firecrawl. Este roda nas nossas. Use o conector se você já paga o Firecrawl ou precisa de algo que este serviço não cobre.
Ele lê páginas atrás de login?
Não. Ele abre páginas públicas, sem login. Use o navegador remoto, que pode ficar conectado e ser assumido por uma pessoa no meio do caminho.
Ele lê um site inteiro?
Sozinho, não. Cada leitura é uma página, então cobrir um site significa pedir página por página, e cada página é cobrada. Vale definir um limite.
Quanto custa ler uma página?
Créditos por leitura bem-sucedida, com cobrança maior no modo mais forte usado em páginas que resistem à leitura normal. Esse modo nunca é escolhido em silêncio.
É seguro agir com base no que volta?
Trate como informação. A VM0 lida com texto de página web como material de leitura e não como instrução a seguir, e é isso que impede uma página de redirecionar o agente que a leu.
Isto é uma alternativa ao Firecrawl?
Se o que você quer é a saída do Firecrawl sem uma conta do Firecrawl, sim. Se quer o painel, o plano e o conjunto completo de recursos dele, use o conector Firecrawl com a sua própria chave.
Como o custo se compara a um plano de scraping meu?
Serviços de scraping vendem planos mensais com mínimo. Aqui você paga por página em créditos, sem compromisso mensal, o que costuma sair mais barato para um fluxo que lê algumas páginas por semana e pior em volume muito alto.
Ele devolve Markdown para um modelo ler?
Sim. Markdown limpo é o formato padrão, e é isso que torna uma página utilizável como contexto em vez de um muro de marcação.
Preciso escrever um scraper ou manter seletores?
Não. Não há nada para escrever e nada que quebre quando uma página é redesenhada, porque você está pedindo o texto da página e não o conteúdo de um elemento específico.
Como você pede Scraping web
Você descreve o que quer em linguagem comum. O agente descobre de qual serviço precisa e faz as chamadas.
“Leia esta página e me dê as cinco coisas que importam, com as palavras exatas de cada uma.”
“Pegue os links deste índice da documentação e leia os três sobre preços, comparando-os.”
“Confira a página de preços do nosso concorrente toda segunda-feira e me avise só se algo mudou.”