Búsqueda web
Scraper completo de Google Search con datos analizados para resultados orgánicos, anuncios, fragmentos, noticias destacadas y más.
La google_search source está diseñado para recuperar Google Search (SERPs) y Google AI Overviews resultados. Esta subpágina presenta específicamente información relacionada con la Búsqueda web de Google. Para explorar otros tipos de resultados, lea Image Search o News Search.
Ejemplos de solicitud
En los ejemplos siguientes, hacemos una solicitud para obtener 2 páginas de resultados, desde el número 11 hasta el número 12 para el término de búsqueda adidas. La API devolverá resultados analizados.
curl 'https://realtime.oxylabs.io/v1/queries' \
--user 'USERNAME:PASSWORD' \
-H 'Content-Type: application/json' \
-d '{
"source": "google_search",
"query": "adidas",
"start_page": 11,
"pages": 2,
"parse": true
}'import requests
from pprint import pprint
# Structure payload.
payload = {
'source': 'google_search',
'query': 'adidas',
'start_page': 11,
'pages': 2,
'parse': True,
}
# Get response.
response = requests.request(
'POST',
'https://realtime.oxylabs.io/v1/queries',
auth=('USERNAME', 'PASSWORD'),
json=payload,
)
# Print prettified response to stdout.
pprint(response.json())Usamos un método de integración Realtime síncrono en nuestros ejemplos. Si desea usar Proxy Endpoint o la integración asíncrona Push-Pull , consulte la sección de métodos de integración .
Valores de los parámetros de solicitud
General
Opciones básicas de configuración y personalización para extraer resultados de la búsqueda web de Google.
source
Configura el scraper. Use google_search.
–
query
La palabra clave o frase para buscar.
–
parse
Devuelve datos analizados cuando se establece en true. Explore la salida diccionario de datos.
false
- parámetro obligatorio
Operadores avanzados de búsqueda de Google
Al extraer datos, puede resultarle útil combinar los operadores avanzados de búsqueda de Google con su consulta. Le permite personalizar el alcance de la búsqueda, garantizando que los resultados sean más relevantes y específicos. Explore estos comandos especiales aquí y aquí. Vea un ejemplo abajo.
Localización
Adapte los resultados de búsqueda a ubicaciones geográficas, configuraciones regionales e idiomas específicos.
geo_location
La ubicación geográfica para la que se debe adaptar el resultado. Usar correctamente este parámetro es extremadamente importante para obtener los datos correctos. Para más información, lea sobre nuestras geo_location estructuras de parámetros aquí.
-
locale
valor del encabezado Accept-Language que cambia el idioma de la interfaz web de la página de búsqueda de Google. Más información.
-
Paginación
Controles para gestionar la paginación y la recuperación de resultados de búsqueda.
start_page
Número de página inicial.
1
pages
Número de páginas que se recuperarán.
1
limit
Número de resultados que se recuperarán en cada página.
10
contexto:limit_per_page
Extrae varias páginas usando la misma dirección IP y sesión (cookie set). Al especificar los números de página en una matriz JSON con la page clave e indicar el número de resultados orgánicos por página usando la limit clave, puede minimizar la posibilidad de ver resultados orgánicos superpuestos entre páginas (por ejemplo, que el último resultado orgánico de la primera página sea el mismo que el primero de la segunda página). Ver ejemplo.
-
Compatibilidad con desplazamiento continuo
Web Scraper API admite completamente el desplazamiento continuo de Google Search. Detecta automáticamente diseños de desplazamiento continuo y carga de forma eficiente los resultados orgánicos solicitados sin necesidad de parámetros adicionales.
Límite por página
Debido a recientes cambios en los límites de Google, hemos ajustado el comportamiento de Web Scraper API. El máximo de resultados por página coincidirá con la salida orgánica de Google, que normalmente es de 10 resultados.
Para usar esta función, incluya una matriz JSON con objetos JSON que contengan los siguientes datos:
page
El número de la página que desea extraer. Cualquier valor entero mayor que 0 funcionará
1
limit
El número de resultados en la página en cuestión. Cualquier valor entero entre 1 y 100 (inclusive) funcionará.
90
Ejemplo de solicitud
Filtrado
Opciones para filtrar y refinar los resultados de búsqueda según varios criterios. Aprenda a usar los parámetros de contexto aquí.
contexto:
filter
Establecer el valor de este parámetro en 0 le permite ver resultados que, de otro modo, se excluirían debido a su similitud con otros resultados.
1
contexto:
safe_search
Búsqueda segura. Establézcalo en true para activarla.
false
contexto:
udm
udm el parámetro permite alternar entre diferentes pestañas de búsqueda, como imágenes, lugares o videos, para personalizar el tipo de resultados mostrados. Encuentre los valores aceptados aquí.
-
contexto:
tbm
Para coincidir o tbm parámetro. Valores disponibles: bks (libros), isch (imágenes), nws (noticias), vid (videos), lcl (locales) resultados.
-
contexto:
tbs
Este parámetro es como un contenedor para parámetros de Google más oscuros, como limitar/ordenar resultados por fecha, así como otros filtros, algunos de los cuales dependen del tbm parámetro. Más información aquí.
-
udm y tbm Los parámetros de contexto no se pueden usar juntos en una sola solicitud de extracción; seleccione solo uno. Usar ambos simultáneamente puede provocar conflictos o un comportamiento inesperado.
Otro
Configuraciones y controles avanzados adicionales para requisitos especializados.
contexto:
fpstate
Configurando el fpstate valor en aig hará que Google cargue más aplicaciones. Este parámetro solo es útil si se usa junto con el render parámetro.
-
contexto:
nfpr
true desactivará la autocorrección ortográfica
false
Parámetros de contexto
Todos los parámetros de contexto deben añadirse al contexto arreglo como objetos con clave y valor pares, por ejemplo:
Datos estructurados
Web Scraper API es capaz de extraer un objeto HTML o JSON que contiene resultados de búsqueda de Google, ofreciendo datos estructurados sobre varios elementos de la página de resultados.
Para ayudarte a identificar ciertos elementos, consulta los diccionarios de datos para cada tipo de resultado de búsqueda de Google, ya sea obtenido de búsquedas en escritorio o en móvil.
Diccionario de datos de salida
Navega por los detalles usando la navegación de la derecha o desplazándote hacia abajo en la página.
Estructura JSON
La salida estructurada de Google Web Search incluye campos como URL, page, results, y otros. La tabla siguiente presenta una lista detallada de cada función de SERP que analizamos, junto con su descripción y tipo de datos. La tabla también incluye algunos metadatos.
url
La URL de la página de búsqueda de Google.
cadena
page
Número de página relativo a la paginación de la SERP de Google.
entero
results
Un diccionario que contiene los resultados de la búsqueda.
objeto
results.pla
Una lista de anuncios de productos con sus respectivos detalles.
objeto
results.paid
Una lista de resultados patrocinados con sus respectivos detalles.
arreglo
results.images
Una lista de resultados de imágenes con sus respectivos detalles.
objeto
results.flights
Una lista de vuelos con sus respectivos detalles.
objeto
results.organic
Una lista de listados no pagados con sus respectivos detalles.
arreglo
results.organic_videos
Una lista de videos orgánicos con sus respectivos detalles.
arreglo
results.top_sights
Una lista de lugares emblemáticos o atracciones notables con sus respectivos detalles.
arreglo
results.jobs
Una lista de ofertas de empleo con sus respectivos detalles.
objeto
results.local_service_ads
Una lista de proveedores locales patrocinados de servicios.
objeto
results.video_boxes
Cajas de video en la SERP con sus respectivos detalles.
arreglo
results.recipes
Una lista de recetas con sus respectivos detalles.
objeto
results.twitter
Una lista de resultados de Twitter (X) con sus respectivos detalles.
arreglo
results.local_pack
Una lista que contiene listados de negocios locales relevantes para la búsqueda.
objeto
results.item_carousel
Una lista de elementos ilustrativos para consultas informativas con sus respectivos detalles.
objeto
results.videos
Una lista de videos con sus respectivos detalles.
objeto
results.hotels
Una lista de hoteles relevantes para la ubicación utilizada en la consulta de búsqueda.
objeto
results.apps
Una lista de aplicaciones con sus respectivos detalles.
arreglo
results.finance
Un resumen de datos financieros de empresas, incluidos precios de acciones, capitalización bursátil y otras métricas clave.
objeto
results.sports_games
Información sobre partidos deportivos recientes, con detalles de puntuaciones, equipos, tipos de partido y destacados.
objeto
results.discussions_and_forums
Una lista de hilos de discusión y publicaciones de foros con URL, títulos, fuentes y recuentos de comentarios.
objeto
results.featured_snippet
Una lista de resultados específicos recuperados de la parte orgánica de las SERP.
arreglo
results.top_stories
Una lista de artículos con sus respectivos detalles cuando una consulta de búsqueda se identifica como orientada a noticias.
objeto
results.popular_products
Una lista de exhibiciones no pagadas y orgánicas de listados de productos de Google Shopping con sus respectivos detalles.
objeto
results.related_searches
Una lista de uno o más bloques de búsquedas relacionadas presentados en diferentes posiciones en la página de búsqueda.
arreglo
results.related_questions
Una lista de consultas de búsqueda interrogativas relacionadas con sus respectivos detalles.
objeto
results.what_people_are_saying
Una lista de hilos de discusión y publicaciones de foros con URL, títulos, fuentes, comentarios principales, nivel de interacción y periodos de tiempo.
arreglo
results.search_information
Una lista de detalles de la consulta de búsqueda enviada.
objeto
total_results_count
El número total de resultados encontrados para la consulta de búsqueda.
cadena
last_visible_page
Valor que identifica el número máximo de página visible en la página de resultados de la consulta de búsqueda. (-1 cuando la carga de más resultados se inicia mediante desplazamiento).
entero
parse_status_code
El código de estado del trabajo de análisis. Puedes ver los códigos de estado del analizador descritos aquí.
entero
created_at
La marca de tiempo en que se creó el trabajo de scraping.
marca de tiempo
updated_at
La marca de tiempo en que finalizó el trabajo de scraping.
marca de tiempo
job_id
El ID del trabajo asociado con el trabajo de scraping.
cadena
status_code
El código de estado del trabajo de scraping. Puedes ver los códigos de estado del scraper descritos aquí.
entero
parser_type
El tipo de analizador usado para descomponer el contenido HTML.
cadena
Anuncios de listado de productos (PLA)
La pla La sección de resultados de búsqueda se refiere a los Anuncios de listado de productos, también conocidos como anuncios de Google Shopping, mostrados de forma destacada en la parte superior de la página de búsqueda en formato carrusel.
items
Todos los PLA disponibles dentro de la página.
arreglo
Escritorio y móvil
items.pos
Un indicador que denota la posición de un elemento dado entre los resultados de PLA.
entero
Escritorio y móvil
items.title
El título del producto en el anuncio de listado.
cadena
Escritorio y móvil
items.url
La URL del producto
cadena
Escritorio y móvil
items.price
El precio del producto en el anuncio de listado.
cadena
Escritorio y móvil
items.seller
El vendedor del producto en el anuncio de listado.
cadena
Escritorio y móvil
items.url_image
La URL de la imagen del producto.
cadena
Escritorio
items.image_data
La imagen en miniatura del producto codificada en base64.
cadena
Escritorio y móvil
pos_overall
Una indicación de la posición de la función SERP PLA dentro de la SERP.
entero
Escritorio y móvil
Pagado
La paid la sección se refiere a anuncios impulsados por Google Ads, que normalmente aparecen encima de los resultados orgánicos (no pagados).

pos
Un indicador que denota la posición de un elemento dado entre los resultados pagados.
entero
Escritorio y móvil
url
La URL del resultado pagado.
cadena
Escritorio y móvil
desc
Una breve descripción del resultado pagado.
cadena
Escritorio y móvil
title
El título del resultado pagado.
cadena
Escritorio y móvil
data_rw
URL de redirección del resultado pagado.
cadena
Escritorio y móvil
sitelinks
Un objeto que contiene información sobre enlaces internos a un sitio web que aparece debajo del primer resultado de búsqueda en Google.
objeto
Escritorio y móvil
sitelinks.inline/expanded
Una lista de URL con sus respectivos detalles. El nombre de la clave (`inline`/`expanded`) especifica el tipo de sitelinks elemento.
arreglo
Escritorio y móvil
sitelinks.inline.url
La URL del sitio vinculado.
cadena
Escritorio y móvil
sitelinks.inline.title
El título del sitio vinculado.
cadena
Escritorio y móvil
sitelinks.inline.description
Una breve descripción del sitio vinculado.
cadena
Escritorio
url_shown
La URL abreviada visible justo debajo de la descripción.
cadena
Escritorio y móvil
pos_overall
Una indicación de la posición del resultado pagado dentro de la SERP.
entero
Escritorio y móvil
Imágenes
La images la sección se refiere a resultados de imágenes mostrados en diferentes secciones de una página de SERP, ya sea como una sección dedicada o en la parte superior. Es importante señalar que la estructura de los datos extraídos de los resultados de Búsqueda de Google puede diferir de la de los datos extraídos de los resultados de Google Image Search.
items
Una lista de imágenes con sus respectivos detalles.
arreglo
Escritorio y móvil
items.alt
El texto alternativo de la imagen.
cadena
Escritorio y móvil
items.pos
Un indicador único que denota la posición de la imagen en la lista.
entero
Escritorio y móvil
items.url
La URL de la página web que contiene la imagen.
cadena
Escritorio y móvil
pos_overall
Una indicación de la posición de la función Images SERP dentro de la SERP.
entero
Escritorio y móvil
Orgánico
La orgánico La sección se refiere a listados no pagados en los resultados orgánicos de Google Search, determinados por la relevancia mediante el algoritmo de Google. Estos listados aparecen debajo de los anuncios pagados en las páginas de resultados.
Ejemplo 1

Ejemplo 2

pos
Un indicador que denota la posición de un elemento dado entre los resultados orgánicos.
entero
Escritorio y móvil
url
La URL del resultado orgánico.
cadena
Escritorio y móvil
desc
Una breve descripción del resultado orgánico.
cadena
Escritorio y móvil
title
El título del resultado orgánico.
cadena
Escritorio y móvil
images
Las imágenes en miniatura codificadas en base64 del resultado orgánico.
cadena
Escritorio y móvil
sitelinks
El objeto contiene el elemento `expanded` o `inline` con más detalles sobre los enlaces de sitio.
objeto
Escritorio y móvil
sitelinks.expanded/inline
Una lista de enlaces de sitio del resultado orgánico. El nombre de la clave (inline/expanded) especifica el tipo del elemento de enlaces de sitio.
arreglo
Escritorio y móvil
sitelinks.expanded.url
La URL del sitio vinculado.
cadena
Escritorio y móvil
sitelinks.expanded.title
El título del sitio vinculado.
cadena
Escritorio y móvil
url_shown
La URL abreviada visible justo debajo de la descripción.
cadena
Escritorio y móvil
pos_overall
Una indicación de la posición del resultado orgánico dentro de la SERP.
entero
Escritorio y móvil
favicon_text
El texto o nombre asociado con el favicon (icono del sitio web).
cadena
Escritorio
rating
La calificación promedio del producto o contenido.
número decimal
Escritorio
review_count
El número de reseñas asociadas con el producto o contenido.
entero
Escritorio
additional_info
Contiene detalles sobre precios, disponibilidad, calificaciones del producto, opciones de entrega y políticas de devolución.
lista de cadenas
Escritorio
Vídeos orgánicos
La results.organic_videos contiene un array de listados de videos que se muestran orgánicamente en los resultados de búsqueda, lo que significa que no son anuncios pagados. Cada listado de video incluye detalles relevantes como el título del video, la URL y la descripción.

pos
Un indicador que denota la posición de un elemento dado entre los resultados de Vídeos orgánicos.
entero
Escritorio
url
La URL del video.
cadena
Escritorio
desc
Breve descripción del video.
cadena
Escritorio
title
El título del video.
cadena
Escritorio
pos_overall
Una indicación de la posición del resultado de Video orgánico dentro de la SERP.
entero
Escritorio
Principales atractivos
La results.top_sights contiene una lista de lugares emblemáticos o atracciones destacadas que normalmente se asocian con la ubicación o el tema de búsqueda. Cada elemento incluye detalles como la posición en la lista y el título.
items
Una lista de principales atractivos con sus respectivos detalles.
arreglo
Escritorio
items.pos
La posición del resultado de Top Sights dentro de la función Top Sights de la SERP.
entero
Escritorio
items.title
El título del sitio de la atracción turística.
cadena
Escritorio
pos_overall
Una indicación de la posición del resultado de Top Sights dentro de la SERP.
entero
Escritorio
Empleos
La results.jobs contiene listados de empleos extraídos de los resultados de búsqueda. Cada listado incluye detalles como la URL que dirige a la oferta de trabajo, el título del puesto, la fuente, el empleador y la ubicación. Los listados provienen de varias bolsas de trabajo, sitios web de empleo y otras plataformas indexadas por Google.

listings
Un array de todos los listados de empleos disponibles dentro de la página.
arreglo
Escritorio
listings.url
La URL del listado de empleo completo.
cadena
Escritorio
listings.title
El título del puesto.
cadena
Escritorio
listings.source
La fuente que contiene la publicación original del empleo.
cadena
Escritorio
listings.employer
La organización que contrata para el puesto identificado.
cadena
Escritorio
listings.location
La ubicación del puesto.
cadena
Escritorio
pos_overall
Una indicación de la posición de la función Jobs dentro de la SERP.
entero
Escritorio
Twitter (X)
La twitter esta función aparece con frecuencia para marcas, películas, músicos y otras celebridades, normalmente ubicada directamente debajo del resultado de búsqueda del sitio web de la marca. Esta función ofrece un enlace directo al feed de Twitter de la marca y muestra un carrusel de sus tuits más recientes.

pos
Un indicador que denota la posición de un elemento dado entre los resultados orgánicos.
entero
Escritorio
url
La URL del perfil que contiene las publicaciones de Twitter (X).
cadena
Escritorio
items
Una lista de publicaciones de Twitter (X) con sus respectivos detalles.
arreglo
Escritorio
items.pos
Un indicador que denota la posición de un tuit dado dentro de la función SERP de Twitter (X).
cadena
Escritorio
items.url
La URL de la publicación de Twitter (X).
cadena
Escritorio
items.content
Una breve descripción que denota todo el texto de la publicación relevante de Twitter (X).
cadena
Escritorio
items.timeframe
Describe hace cuánto tiempo se creó el tuit.
cadena
Escritorio
title
El título del perfil de Twitter (X).
cadena
Escritorio
pos_overall
Una indicación de la posición del resultado de Twitter dentro de la SERP.
entero
Escritorio
Paquete local
La local_pack muestra los tres principales resultados de búsqueda local basados en la ubicación del usuario o la ubicación de búsqueda especificada, e incluye un mapa e información adicional.
items
Una lista de ubicaciones con sus respectivos detalles.
arreglo
Escritorio y móvil
items.cid
Un número de identificación único asignado a un listado de empresa específico.
cadena
Escritorio y móvil
items.pos
La posición del resultado local dentro del paquete local.
entero
Escritorio y móvil
items.title
El título de la entidad local.
cadena
Escritorio y móvil
items.rating
La calificación de la entidad local.
entero
Escritorio y móvil
items.address
La dirección de la entidad local.
cadena
Escritorio y móvil
items.rating_count
El número de calificaciones de la entidad local.
entero
Escritorio y móvil
pos_overall
Una indicación de la posición del resultado de Local Pack dentro de la SERP.
entero
Escritorio y móvil
Noticias destacadas
top_stories es una sección dedicada que aparece en Google Search para consultas orientadas a noticias.

items
Una lista de artículos de noticias seleccionados con sus respectivos detalles.
arreglo
Escritorio y móvil
items.pos
La posición del artículo dentro de la función Top Stories de la SERP.
entero
Escritorio y móvil
items.url
La URL del artículo completo.
cadena
Escritorio y móvil
items.title
El título del artículo.
cadena
Escritorio y móvil
items.section
El nombre de la sección de Top Stories.
cadena
Móvil
items.source
El nombre del sitio donde se publica el artículo.
cadena
Escritorio y móvil
items.timeframe
Describe hace cuánto tiempo se publicó el artículo.
cadena
Escritorio
pos_overall
Indica la posición general de la función Top Stories dentro de la SERP.
entero
Escritorio y móvil
Productos populares
La popular_products La función SERP presenta un carrusel de varios productos determinados por su popularidad y relevancia para la consulta del usuario. Esto difiere de los anuncios de listado de productos (PLAs), que están influenciados por los anunciantes. Cabe señalar que varios popular_products carruseles pueden aparecer en una sola página SERP.
items
Una lista de productos populares con sus respectivos detalles.
arreglo
Escritorio y móvil
items.pos
Un indicador único para la posición de un producto popular dado dentro de la función SERP de Productos populares.
entero
Escritorio y móvil
items.url
La URL de la página de Google Shopping del producto.
cadena
Escritorio y móvil
items.title
El título del producto.
cadena
Escritorio y móvil
items.token
Token del producto (usado con google_shopping_product source para vendedor, precios y detalles del producto).
cadena
Escritorio y móvil
items.rating
La calificación de un producto popular dado.
cadena
Escritorio y móvil
items.sellers
Una lista de vendedores que ofrecen el producto, con sus respectivos detalles.
arreglo
Escritorio y móvil
items.sellers.pos
La posición del vendedor dentro de la lista de vendedores.
entero
Escritorio y móvil
items.sellers.price_str
El precio del producto por parte del vendedor.
cadena
Escritorio y móvil
items.sellers.seller_name
El nombre del vendedor del producto.
cadena
Escritorio y móvil
items.currency
El código de moneda del precio listado.
cadena
Escritorio y móvil
items.image_data
La imagen en miniatura del producto codificada en base64.
cadena
Escritorio y móvil
items.description
Breve descripción del vendedor del producto.
cadena
Escritorio y móvil
items.rating_count
El número de calificaciones del producto.
entero
Escritorio y móvil
pos_overall
Indica la posición general de la función Popular Products dentro de la SERP.
entero
Escritorio y móvil
Búsquedas relacionadas
La related_searches La función SERP muestra consultas de búsqueda alternativas relacionadas con la palabra clave de búsqueda inicial, normalmente ubicadas en la parte inferior de la SERP.
pos_overall
Indica la posición general de este bloque de búsquedas relacionadas dentro de la página de búsqueda.
entero
Escritorio y móvil
related_searches
Una lista de cadenas de búsqueda relacionadas dentro de este bloque.
arreglo
Escritorio y móvil
Preguntas relacionadas
La related_questions la función se sitúa debajo de los resultados de búsqueda principales y presenta una lista de preguntas directamente relacionadas con la consulta de búsqueda original del usuario. Al ofrecer un conjunto seleccionado de preguntas relacionadas, los usuarios pueden explorar diferentes aspectos de su tema y mejorar su experiencia de búsqueda general.

items
Una lista que contiene todas las preguntas relacionadas.
arreglo
Escritorio y móvil
items.pos
Un indicador único que denota la posición de cualquier pregunta relacionada dentro de la función SERP de Preguntas relacionadas.
entero
Escritorio y móvil
items.answer
La respuesta a la pregunta relacionada.

