Web Unblocker
Aprende a usar Web Unblocker, una solución de proxy impulsada por IA que te permite llegar incluso a los sitios más difíciles.
Web Unblocker es un Solución de proxy impulsada por IA que gestiona el proceso de gestión de solicitudes para extraer datos públicos incluso de los sitios web más difíciles.
El producto no es un proxy normal, sino un sistema más avanzado que gestiona múltiples procesos de scraping, como:
Gestión automática del tipo de proxy
Generación de huellas digitales del navegador
Reintentos automáticos
Mantenimiento de sesiones
renderizado de JavaScript
Web Unblocker garantiza una tasa de éxito mucho mayor en comparación con los proxies normales. También admite encabezados personalizados definidos por el usuario y persistencia de IP junto con cookies reutilizables y Solicitudes POST.
Introducción
Integrar Web Unblocker es fácil, especialmente si has utilizado anteriormente proxies para el scraping web. La única diferencia es que te pedimos que ignores el certificado SSL mediante las -k o --insecure opciones de cURL (o una expresión equivalente en el lenguaje que elijas).
Para realizar una solicitud con Web Unblocker, debes usar el unblock.oxylabs.io:60000 Proxy Endpoint. Consulta un ejemplo de cURL a continuación. Puedes encontrar ejemplos de código en otros lenguajes aquí o ejemplos de código completos en nuestra GitHub.
curl -k -x https://unblock.oxylabs.io:60000 \\
-U 'USERNAME:PASSWORD' \
'https://ip.oxylabs.io/location'import requests
# Use your Web Unblocker credentials here.
USERNAME, PASSWORD = 'YOUR_USERNAME', 'YOUR_PASSWORD'
# Define proxy dict.
proxies = {
'http': f'http://{USERNAME}:{PASSWORD}@unblock.oxylabs.io:60000',
'https': f'https://{USERNAME}:{PASSWORD}@unblock.oxylabs.io:60000',
}
response = requests.request(
'GET',
'https://ip.oxylabs.io/location',
verify=False, # Ignore the SSL certificate
proxies=proxies,
)
# Print result page to stdout
print(response.text)
# Save returned HTML to result.html file
with open('result.html', 'w') as f:
f.write(response.text)Si se utiliza Web Unblocker para hacer scraping de sitios web que dependen de la carga de datos mediante JavaScript, consulta la renderizado de JavaScript sección. El producto no está diseñado para usarse directamente con navegadores sin interfaz gráfica (p. ej., Chromium, PhantomJS, Splash, etc.) y sus controladores (p. ej., Playwright, Selenium, Puppeteer, etc.).
Mira el siguiente video para ver un ejemplo de scraping de un objetivo difícil sin interrupciones:
Lección
Si quieres aprender más sobre cómo obtener datos a gran escala con Web Unblocker - te sugerimos ver esta lección de expertos en scraping:
Última actualización
¿Te fue útil?

