
Scraping web na Okou
Dê um link ao agente e ele volta com o que a página realmente diz, em texto limpo e legível. Sem se cadastrar em nenhum serviço de scraping.
Dados da web · Sem configuração · Dois modos de cobrança, padrão e enhanced
Dê a um agente um link público e ele lê a página para você: as palavras, não os menus de navegação, os avisos de cookies e os rodapés. Peça a página como texto limpo, ou só a lista de links quando o que importa é decidir o que ler em seguida.
A leitura roda no Firecrawl e está ali no momento em que você pede: sem configuração, sem chave e sem nada que seu time precise manter. Ela é deliberadamente estreita: uma página por pedido. Encontrar páginas é trabalho da busca na web, e tudo que está atrás de um login ou de um clique é do navegador remoto.
O que é Scraping web
Toda pesquisa chega ao ponto em que um resultado de busca não basta e você precisa do que a página realmente diz. Acertar isso é mais difícil do que parece. As páginas carregam metade do conteúdo com scripts, e o texto útil fica entre menus, faixas e anúncios.
Na Okou essa parte já está resolvida para você. O agente envia um link público e recebe a página como texto limpo que ele pode ler e resumir, ou como lista de todos os seus links.
Algumas páginas resistem a uma leitura normal. Para essas existe um modo mais forte, e o agente precisa pedi-lo, porque custa mais por página e você deve conseguir ver quando um fluxo o escolheu.
É a mesma coisa que as pessoas procuram como API de scraping web. A diferença é que você não precisa procurar: já está na execução, então você pede a página em uma mensagem e o agente traz o que há nela.
O que Scraping web faz
O que um agente consegue fazer com isso, e o que volta quando ele faz.
Cobertura e limites
O que ele não faz, dito de saída, para ninguém montar um fluxo em cima de algo que está fora do escopo.
Apenas páginas públicas
Não há login envolvido, então uma página atrás de acesso, paywall ou barreira antibot está fora do escopo. É para isso que existe o navegador remoto.
Uma página por vez
Ele lê a página que você apontar. Não sai vagando pelo resto do site: ler um site inteiro significa pedir página por página e pagar página por página.
O modo caro é uma escolha
A maioria das páginas é lida bem do jeito normal. O modo mais forte custa mais e o agente precisa pedi-lo, então um fluxo nunca fica mais caro em silêncio.
O que volta é informação, não ordem
O texto de uma página web é tratado como algo a ler, nunca como instrução a seguir. É isso que impede uma página hostil de convencer um agente a fazer outra coisa.
Quanto custa Scraping web
Os serviços web são cobrados em créditos por chamada, não por token. Não há uma fatura separada de fornecedor para conciliar.
zero scrapeLer uma página consome créditos, e o modo reforçado custa mais que o normal. Não há mais nada para comprar nem mínimo, então um fluxo que lê três páginas por semana só paga pelo trabalho que faz.
Nomes de produtos e logotipos pertencem a seus donos e aparecem aqui apenas para dizer sobre o que cada serviço roda. Não implicam qualquer endosso ou parceria.
Configuração e acesso
Nada para configurar
Nada a conectar. Sem cadastro, sem chave para colar, sem nada acrescentado à sua lista de conectores. É essa a diferença para o conector do Firecrawl no catálogo da Okou: o conector trabalha na sua própria conta do Firecrawl quando você já tem uma, e isto simplesmente está ali para qualquer agente usar.
Quem pode usar
Ler páginas web é uma permissão que você distribui, não algo que todo agente tem. Dê aos agentes e às pessoas que precisam, pelo tempo que precisarem, e retire sem tocar em mais nada que aquele agente saiba fazer.
Para que os times usam Scraping web
Ler a página por trás de um resultado de busca
A busca te dá um título e duas linhas. Quase todo trabalho precisa do corpo do texto, então o padrão é buscar primeiro, escolher os dois ou três resultados que importam e ler só esses.
Acompanhar páginas que não têm outra porta de entrada
Preços de concorrentes, changelogs, páginas de status, avisos regulatórios. Um agente agendado lê a página, compara com a da semana passada e só avisa quando algo mudou.
Transformar um documento longo em material de trabalho
Uma especificação, um relatório anual, uma central de ajuda. Texto limpo é a diferença entre um resumo do documento e um resumo do menu de navegação dele.
Quando não usar Scraping web
Pule quando a página exigir login, clique ou formulário, e use o navegador remoto. Pule para ler um site inteiro, onde o custo por página cresce mais rápido do que a resposta vale. E pule quando a fonte publica dados próprios, quase sempre mais estáveis do que ler as páginas dela.
Como isso se chama em outros lugares
A mesma coisa aparece no mercado com vários nomes. Se você já pesquisou por algum deles, é assim que ele corresponde ao que você recebe aqui.
API de scraping web
O nome usual para pagar um serviço que busca uma página e devolve o texto dela. É exatamente isso. A conta e a chave são da Okou, não suas.
Scraping sem escrever um scraper
Nada para construir e nada para manter. Você pede a página em uma mensagem, e a busca e a limpeza acontecem dentro da execução.
De HTML para Markdown
A conversão que normalmente se escreve à mão: entra uma página HTML, sai Markdown limpo. Acontece antes de o texto chegar ao agente, e é por isso que um modelo gasta atenção no conteúdo em vez de na marcação.
Scraping para IA ou LLM
Scraping cuja saída é para ser lida por um modelo e não analisada por código. É a mesma busca, avaliada pelo quanto o texto é legível e não por um seletor continuar batendo.
Scraping sem código
Aqui ninguém escreve scraper. Você pede a página numa mensagem e o agente busca — é o que se procura quando se procura scraping sem escrever código.
Scraping web em comparação
Scraping web versus construir seu próprio scraper
O mesmo resultado, um esforço bem diferente. Por conta própria é escolher um serviço ou escrever o buscador, uma chave que alguém precisa guardar e manutenção toda vez que uma página muda de forma. Aqui você pede e lê a resposta, e o acesso é uma permissão em vez de um segredo compartilhado.
Scraping web versus o conector Firecrawl
A Okou também oferece um conector do Firecrawl, e essa é a escolha certa se você já tem conta no Firecrawl e quer o consumo por lá, ou precisa de algo que este serviço não cobre. O integrado é o certo quando você prefere simplesmente pedir e receber a página.
Scraping web versus dirigir um navegador você mesmo
Um navegador que você opera é mais capaz e muito mais trabalhoso, e no fim você ainda precisa transformar a página em texto legível. Use o navegador remoto quando o trabalho realmente exigir cliques, e isto quando você só precisa do que a página diz.
Em poucas palavras
A forma padrão de ler uma página web na Okou. Se a página é pública e você quer o que está nela, isto é um passo só, sem conta, com cobrança por página. Tudo que exige login ou clique pertence ao navegador remoto.
Perguntas frequentes
Preciso de uma conta no Firecrawl?
Não. Ler uma página é algo que qualquer agente já faz, então é só pedir. Não há conta para criar nem chave para guardar.
Qual a diferença para o conector Firecrawl?
O conector trabalha na sua própria conta do Firecrawl quando você tem uma e quer o consumo por lá. O serviço integrado está pronto para usar, sem configurar nada.
Ele lê páginas atrás de login?
Não. Ele abre páginas públicas, sem login. Use o navegador remoto, que pode ficar conectado e ser assumido por uma pessoa no meio do caminho.
Ele lê um site inteiro?
Sozinho, não. Cada leitura é uma página, então cobrir um site significa pedir página por página, e cada página é cobrada. Vale definir um limite.
Quanto custa ler uma página?
Créditos por leitura bem-sucedida, com cobrança maior no modo mais forte usado em páginas que resistem à leitura normal. Esse modo nunca é escolhido em silêncio.
É seguro agir com base no que volta?
Trate como informação. A Okou lida com texto de página web como material de leitura e não como instrução a seguir, e é isso que impede uma página de redirecionar o agente que a leu.
Ainda preciso de uma ferramenta de scraping?
Para ter o texto limpo de uma página dentro de um fluxo, não: você pede a um agente e recebe. Se quer a interface própria e o conjunto completo de recursos de um fornecedor de scraping, conecte sua conta pelo conector.
Como o custo se compara a um plano de scraping meu?
Ferramentas de scraping costumam vender planos mensais com mínimo. Aqui ler uma página consome créditos sem compromisso mensal, o que combina com um fluxo que lê algumas páginas por semana e merece recálculo em volume muito alto.
Ele devolve Markdown para um modelo ler?
Sim. Markdown limpo é o formato padrão, e é isso que torna uma página utilizável como contexto em vez de um muro de marcação.
Preciso escrever um scraper ou manter seletores?
Não. Não há nada para escrever e nada que quebre quando uma página é redesenhada, porque você está pedindo o texto da página e não o conteúdo de um elemento específico.
Como você pede Scraping web
Você descreve o que quer em linguagem comum. O agente descobre de qual serviço precisa e faz as chamadas.
“Leia esta página e me dê as cinco coisas que importam, com as palavras exatas de cada uma.”
“Pegue os links deste índice da documentação e leia os três sobre preços, comparando-os.”
“Confira a página de preços do nosso concorrente toda segunda-feira e me avise só se algo mudou.”