For the complete documentation index, see llms.txt. This page is also available as Markdown.

Web Unblocker

Aprende a usar Web Unblocker, una solución de proxy impulsada por IA que te permite llegar incluso a los sitios más difíciles.

Web Unblocker es un Solución de proxy impulsada por IA que gestiona el proceso de gestión de solicitudes para extraer datos públicos incluso de los sitios web más difíciles.

Puedes probar Web Unblocker gratis durante 1 semana. Regístrate en Oxylabs panel de control para empezar.

El producto no es un proxy normal, sino un sistema más avanzado que gestiona múltiples procesos de scraping, como:

  • Gestión automática del tipo de proxy

  • Generación de huellas digitales del navegador

  • Reintentos automáticos

  • Mantenimiento de sesiones

  • renderizado de JavaScript

Web Unblocker garantiza una tasa de éxito mucho mayor en comparación con los proxies normales. También admite encabezados personalizados definidos por el usuario y persistencia de IP junto con cookies reutilizables y Solicitudes POST.

Introducción

Integrar Web Unblocker es fácil, especialmente si has utilizado anteriormente proxies para el scraping web. La única diferencia es que te pedimos que ignores el certificado SSL mediante las -k o --insecure opciones de cURL (o una expresión equivalente en el lenguaje que elijas).

Para realizar una solicitud con Web Unblocker, debes usar el unblock.oxylabs.io:60000 Proxy Endpoint. Consulta un ejemplo de cURL a continuación. Puedes encontrar ejemplos de código en otros lenguajes aquí o ejemplos de código completos en nuestra GitHub.

Usa ip.oxylabs.io/location para comprobar los parámetros de tus IP: este dominio proporciona información de cuatro bases de datos de geolocalización: MaxMind, IP2Location, DB-IP e IPinfo.io. Los parámetros incluyen dirección IP, proveedor, país, ciudad, código postal, ASN, nombre de la organización, zona horaria y metadatos (cuando la base de datos los divulga).

curl -k -x https://unblock.oxylabs.io:60000 \\
-U 'USERNAME:PASSWORD' \
'https://ip.oxylabs.io/location'
import requests

# Use your Web Unblocker credentials here.
USERNAME, PASSWORD = 'YOUR_USERNAME', 'YOUR_PASSWORD'

# Define proxy dict.
proxies = {
  'http': f'http://{USERNAME}:{PASSWORD}@unblock.oxylabs.io:60000',
  'https': f'https://{USERNAME}:{PASSWORD}@unblock.oxylabs.io:60000',
}

response = requests.request(
    'GET',
    'https://ip.oxylabs.io/location',
    verify=False,  # Ignore the SSL certificate
    proxies=proxies,
)

# Print result page to stdout
print(response.text)

# Save returned HTML to result.html file
with open('result.html', 'w') as f:
    f.write(response.text)

Si observas tasas de éxito bajas o recuperas contenido vacío, prueba a añadir "x-oxylabs-render: html" encabezado con tu solicitud.

Mira el siguiente video para ver un ejemplo de scraping de un objetivo difícil sin interrupciones:

Lección

Si quieres aprender más sobre cómo obtener datos a gran escala con Web Unblocker - te sugerimos ver esta lección de expertos en scraping:

Última actualización

¿Te fue útil?