Todos os serviços web

Scraping web na Okou

Dê um link ao agente e ele volta com o que a página realmente diz, em texto limpo e legível. Sem se cadastrar em nenhum serviço de scraping.

Dados da web · Sem configuração · Dois modos de cobrança, padrão e enhanced

Dê a um agente um link público e ele lê a página para você: as palavras, não os menus de navegação, os avisos de cookies e os rodapés. Peça a página como texto limpo, ou só a lista de links quando o que importa é decidir o que ler em seguida.

A leitura roda no Firecrawl e está ali no momento em que você pede: sem configuração, sem chave e sem nada que seu time precise manter. Ela é deliberadamente estreita: uma página por pedido. Encontrar páginas é trabalho da busca na web, e tudo que está atrás de um login ou de um clique é do navegador remoto.

O que é Scraping web

Toda pesquisa chega ao ponto em que um resultado de busca não basta e você precisa do que a página realmente diz. Acertar isso é mais difícil do que parece. As páginas carregam metade do conteúdo com scripts, e o texto útil fica entre menus, faixas e anúncios.

Na Okou essa parte já está resolvida para você. O agente envia um link público e recebe a página como texto limpo que ele pode ler e resumir, ou como lista de todos os seus links.

Algumas páginas resistem a uma leitura normal. Para essas existe um modo mais forte, e o agente precisa pedi-lo, porque custa mais por página e você deve conseguir ver quando um fluxo o escolheu.

É a mesma coisa que as pessoas procuram como API de scraping web. A diferença é que você não precisa procurar: já está na execução, então você pede a página em uma mensagem e o agente traz o que há nela.

O que Scraping web faz

O que um agente consegue fazer com isso, e o que volta quando ele faz.

O que você dáO link de uma página web pública
O que voltaA página como texto limpo e legível, ou a lista de seus links
Para páginas difíceisUm modo mais forte que o agente pede de propósito
O que ele não abreQualquer coisa atrás de um login

Cobertura e limites

O que ele não faz, dito de saída, para ninguém montar um fluxo em cima de algo que está fora do escopo.

Apenas páginas públicas

Não há login envolvido, então uma página atrás de acesso, paywall ou barreira antibot está fora do escopo. É para isso que existe o navegador remoto.

Uma página por vez

Ele lê a página que você apontar. Não sai vagando pelo resto do site: ler um site inteiro significa pedir página por página e pagar página por página.

O modo caro é uma escolha

A maioria das páginas é lida bem do jeito normal. O modo mais forte custa mais e o agente precisa pedi-lo, então um fluxo nunca fica mais caro em silêncio.

O que volta é informação, não ordem

O texto de uma página web é tratado como algo a ler, nunca como instrução a seguir. É isso que impede uma página hostil de convencer um agente a fazer outra coisa.

Quanto custa Scraping web

Os serviços web são cobrados em créditos por chamada, não por token. Não há uma fatura separada de fornecedor para conciliar.

CobrançaDois modos de cobrança, padrão e enhanced
Roda emFirecrawl
Comandozero scrape

Ler uma página consome créditos, e o modo reforçado custa mais que o normal. Não há mais nada para comprar nem mínimo, então um fluxo que lê três páginas por semana só paga pelo trabalho que faz.

Nomes de produtos e logotipos pertencem a seus donos e aparecem aqui apenas para dizer sobre o que cada serviço roda. Não implicam qualquer endosso ou parceria.

Configuração e acesso

Nada para configurar

Nada a conectar. Sem cadastro, sem chave para colar, sem nada acrescentado à sua lista de conectores. É essa a diferença para o conector do Firecrawl no catálogo da Okou: o conector trabalha na sua própria conta do Firecrawl quando você já tem uma, e isto simplesmente está ali para qualquer agente usar.

Quem pode usar

Ler páginas web é uma permissão que você distribui, não algo que todo agente tem. Dê aos agentes e às pessoas que precisam, pelo tempo que precisarem, e retire sem tocar em mais nada que aquele agente saiba fazer.

Para que os times usam Scraping web

Ler a página por trás de um resultado de busca

A busca te dá um título e duas linhas. Quase todo trabalho precisa do corpo do texto, então o padrão é buscar primeiro, escolher os dois ou três resultados que importam e ler só esses.

Acompanhar páginas que não têm outra porta de entrada

Preços de concorrentes, changelogs, páginas de status, avisos regulatórios. Um agente agendado lê a página, compara com a da semana passada e só avisa quando algo mudou.

Transformar um documento longo em material de trabalho

Uma especificação, um relatório anual, uma central de ajuda. Texto limpo é a diferença entre um resumo do documento e um resumo do menu de navegação dele.

Quando não usar Scraping web

Pule quando a página exigir login, clique ou formulário, e use o navegador remoto. Pule para ler um site inteiro, onde o custo por página cresce mais rápido do que a resposta vale. E pule quando a fonte publica dados próprios, quase sempre mais estáveis do que ler as páginas dela.

Como isso se chama em outros lugares

A mesma coisa aparece no mercado com vários nomes. Se você já pesquisou por algum deles, é assim que ele corresponde ao que você recebe aqui.

API de scraping web

O nome usual para pagar um serviço que busca uma página e devolve o texto dela. É exatamente isso. A conta e a chave são da Okou, não suas.

Scraping sem escrever um scraper

Nada para construir e nada para manter. Você pede a página em uma mensagem, e a busca e a limpeza acontecem dentro da execução.

De HTML para Markdown

A conversão que normalmente se escreve à mão: entra uma página HTML, sai Markdown limpo. Acontece antes de o texto chegar ao agente, e é por isso que um modelo gasta atenção no conteúdo em vez de na marcação.

Scraping para IA ou LLM

Scraping cuja saída é para ser lida por um modelo e não analisada por código. É a mesma busca, avaliada pelo quanto o texto é legível e não por um seletor continuar batendo.

Scraping sem código

Aqui ninguém escreve scraper. Você pede a página numa mensagem e o agente busca — é o que se procura quando se procura scraping sem escrever código.

Scraping web em comparação

Scraping web versus construir seu próprio scraper

O mesmo resultado, um esforço bem diferente. Por conta própria é escolher um serviço ou escrever o buscador, uma chave que alguém precisa guardar e manutenção toda vez que uma página muda de forma. Aqui você pede e lê a resposta, e o acesso é uma permissão em vez de um segredo compartilhado.

Scraping web versus o conector Firecrawl

A Okou também oferece um conector do Firecrawl, e essa é a escolha certa se você já tem conta no Firecrawl e quer o consumo por lá, ou precisa de algo que este serviço não cobre. O integrado é o certo quando você prefere simplesmente pedir e receber a página.

Scraping web versus dirigir um navegador você mesmo

Um navegador que você opera é mais capaz e muito mais trabalhoso, e no fim você ainda precisa transformar a página em texto legível. Use o navegador remoto quando o trabalho realmente exigir cliques, e isto quando você só precisa do que a página diz.

Em poucas palavras

A forma padrão de ler uma página web na Okou. Se a página é pública e você quer o que está nela, isto é um passo só, sem conta, com cobrança por página. Tudo que exige login ou clique pertence ao navegador remoto.

Perguntas frequentes

Preciso de uma conta no Firecrawl?

Não. Ler uma página é algo que qualquer agente já faz, então é só pedir. Não há conta para criar nem chave para guardar.

Qual a diferença para o conector Firecrawl?

O conector trabalha na sua própria conta do Firecrawl quando você tem uma e quer o consumo por lá. O serviço integrado está pronto para usar, sem configurar nada.

Ele lê páginas atrás de login?

Não. Ele abre páginas públicas, sem login. Use o navegador remoto, que pode ficar conectado e ser assumido por uma pessoa no meio do caminho.

Ele lê um site inteiro?

Sozinho, não. Cada leitura é uma página, então cobrir um site significa pedir página por página, e cada página é cobrada. Vale definir um limite.

Quanto custa ler uma página?

Créditos por leitura bem-sucedida, com cobrança maior no modo mais forte usado em páginas que resistem à leitura normal. Esse modo nunca é escolhido em silêncio.

É seguro agir com base no que volta?

Trate como informação. A Okou lida com texto de página web como material de leitura e não como instrução a seguir, e é isso que impede uma página de redirecionar o agente que a leu.

Ainda preciso de uma ferramenta de scraping?

Para ter o texto limpo de uma página dentro de um fluxo, não: você pede a um agente e recebe. Se quer a interface própria e o conjunto completo de recursos de um fornecedor de scraping, conecte sua conta pelo conector.

Como o custo se compara a um plano de scraping meu?

Ferramentas de scraping costumam vender planos mensais com mínimo. Aqui ler uma página consome créditos sem compromisso mensal, o que combina com um fluxo que lê algumas páginas por semana e merece recálculo em volume muito alto.

Ele devolve Markdown para um modelo ler?

Sim. Markdown limpo é o formato padrão, e é isso que torna uma página utilizável como contexto em vez de um muro de marcação.

Preciso escrever um scraper ou manter seletores?

Não. Não há nada para escrever e nada que quebre quando uma página é redesenhada, porque você está pedindo o texto da página e não o conteúdo de um elemento específico.

Como você pede Scraping web

Você descreve o que quer em linguagem comum. O agente descobre de qual serviço precisa e faz as chamadas.

Leia uma página

Leia esta página e me dê as cinco coisas que importam, com as palavras exatas de cada uma.

Descubra o que ler e leia

Pegue os links deste índice da documentação e leia os três sobre preços, comparando-os.

Acompanhe uma página ao longo do tempo

Confira a página de preços do nosso concorrente toda segunda-feira e me avise só se algo mudou.