For the complete documentation index, see llms.txt. This page is also available as Markdown.

LangChain

Use o framework LangChain junto com o Web Scraper API da Oxylabs para coletar dados da web e alimentá-los em fluxos de trabalho de LLM – colete, processe, analise em um único pipeline.

O LangChain integração com o Oxylabs Web Scraper API permite que você colete e processe dados da web por meio de um LLM (Large Language Model) no mesmo fluxo de trabalho.

Visão geral

LangChain é um framework para criar aplicativos que usam LLMs junto com ferramentas, APIs e dados da web. Ele suporta tanto Python quanto JavaScript. Use-o com Oxylabs Web Scraper API para:

  • Extraia dados estruturados sem lidar com CAPTCHAs, bloqueios de IP ou renderização de JS

  • Processe os resultados com um LLM no mesmo pipeline

  • Crie fluxos de trabalho completos, da extração à saída com IA

Como começar

Crie suas credenciais de usuário da API: cadastre-se para um teste gratuito ou adquira o produto na painel da Oxylabs para criar suas credenciais de usuário da API (USERNAME e PASSWORD).

Neste guia, usaremos a linguagem de programação Python. Instale as bibliotecas necessárias usando pip:

pip install -qU langchain-oxylabs langchain-openai langgraph requests python-dotenv

Configuração do ambiente

Crie um .env arquivo em seu diretório do projeto com suas credenciais de usuário da Oxylabs API e da OpenAI:

OXYLABS_USERNAME=your-username
OXYLABS_PASSWORD=your-password
OPENAI_API_KEY=your-openai-key

Carregue essas variáveis de ambiente no seu script Python:

Métodos de integração

Há duas formas principais de integrar a Oxylabs Web Scraper API com LangChain:

Usando o pacote langchain-oxylabs

Para consultas de pesquisa do Google, use o dedicado langchain-oxylabs pacote, que oferece uma integração pronta para uso:

Usando a Web Scraper API

Para acessar outros sites além da pesquisa do Google, você pode enviar diretamente uma solicitação para a Web Scraper API:

Scrapers específicos por alvo

A Oxylabs oferece scrapers especializados para vários sites populares. Aqui estão alguns exemplos de fontes disponíveis:

Site
Parâmetro de source
Parâmetros obrigatórios

Google

google_search

query

Amazon

amazon_search

query, domain (opcional)

Walmart

walmart_search

query

Target

target_search

query

Kroger

kroger_search

query, store_id

Staples

staples_search

query

Para usar um scraper específico, modifique o payload na scrape_website função:

Configuração avançada

Como lidar com conteúdo dinâmico

A Web Scraper API pode lidar com renderização de JavaScript adicionando o render parâmetro:

Definindo o tipo de user agent

Você pode especificar diferentes agentes de usuário para simular diferentes dispositivos:

Usando parâmetros específicos do alvo

Muitos scrapers específicos por alvo suportam parâmetros adicionais:

Tratamento de erros

Implemente um tratamento adequado de erros para aplicações de produção:

Atualizado

Isto foi útil?