Busca na Web
Raspador abrangente do Google Search com dados parseados para resultados orgânicos, anúncios, trechos, principais notícias e muito mais.
O google_search fonte foi projetada para recuperar resultados do Google Search (SERPs) e do Google AI Overviews AI Overviews resultados. Esta subpágina apresenta especificamente informações relacionadas à Pesquisa na Web do Google. Para explorar outros tipos de resultado, leia Pesquisa de imagens ou Pesquisa de notícias.
Exemplos de requisição
Nos exemplos abaixo, fazemos uma requisição para obter 2 páginas de resultados, do número 11 ao número 12 , para o termo de pesquisa adidas. A API retornará resultados analisados.
curl 'https://realtime.oxylabs.io/v1/queries' \
--user 'USERNAME:PASSWORD' \
-H 'Content-Type: application/json' \
-d '{
"source": "google_search",
"query": "adidas",
"start_page": 11,
"pages": 2,
"parse": true
}'import requests
from pprint import pprint
# Structure payload.
payload = {
'source': 'google_search',
'query': 'adidas',
'start_page': 11,
'pages': 2,
'parse': True,
}
# Get response.
response = requests.request(
'POST',
'https://realtime.oxylabs.io/v1/queries',
auth=('USERNAME', 'PASSWORD'),
json=payload,
)
# Print prettified response to stdout.
pprint(response.json())Usamos o método síncrono Realtime de integração em nossos exemplos. Se você quiser usar Proxy Endpoint ou assíncrono Push-Pull de integração, consulte a seção de métodos de integração .
Valores dos parâmetros da requisição
Geral
Configurações básicas e opções de personalização para coletar resultados da pesquisa na Web do Google.
source
Define o scraper. Use google_search.
–
query
A palavra-chave ou frase a ser pesquisada.
–
- parâmetro obrigatório
Operadores avançados de pesquisa do Google
Ao fazer scraping, você pode achar útil combinar os operadores avançados de pesquisa do Google com sua consulta. Isso permite personalizar o escopo da pesquisa, garantindo que os resultados sejam mais relevantes e focados. Explore estes comandos especiais aqui e aqui. Veja um exemplo abaixo.
Localização
Adapte os resultados da pesquisa para locais geográficos, localidades e idiomas específicos.
geo_location
A localização geográfica para a qual o resultado deve ser adaptado. Usar esse parâmetro corretamente é extremamente importante para obter os dados corretos. Para mais informações, leia sobre nossas geo_location estruturas de parâmetros sugeridas aqui.
-
locale
Accept-Language valor do cabeçalho que altera o idioma da interface web da sua página de pesquisa do Google. Mais informações.
-
Paginação
Controles para gerenciar a paginação e a recuperação dos resultados da pesquisa.
start_page
Número inicial da página.
1
pages
Número de páginas a recuperar.
1
limit
Número de resultados a recuperar em cada página.
10
context:limit_per_page
Cole várias páginas usando o mesmo endereço IP e sessão (cookie definido). Ao especificar os números das páginas em um array JSON com a page chave e indicar o número de resultados orgânicos por página usando a limit chave, você pode minimizar a chance de ver resultados orgânicos sobrepostos entre as páginas (por exemplo, o último resultado orgânico da primeira página ser o mesmo que o primeiro resultado orgânico da segunda página). Veja o exemplo.
-
Suporte a rolagem contínua
Web Scraper API oferece suporte total à rolagem contínua da Pesquisa do Google. Ele detecta automaticamente layouts de rolagem contínua, carregando com eficiência os resultados orgânicos solicitados sem necessidade de parâmetros extras.
Limite por página
Devido a mudanças recentes nos limites do Google, ajustamos o comportamento do Web Scraper API. O máximo de resultados por página corresponderá à saída orgânica do Google, que normalmente é de 10 resultados.
Para usar este recurso, inclua um array JSON com objetos JSON contendo os seguintes dados:
page
O número da página que você deseja coletar. Qualquer valor inteiro maior que 0 funcionará
1
limit
O número de resultados na página em questão. Qualquer valor inteiro entre 1 e 100 (inclusive) funcionará.
90
Exemplo de requisição
Filtragem
Opções para filtrar e refinar os resultados da pesquisa com base em vários critérios. Aprenda a usar parâmetros de contexto aqui.
context:
filter
Definir o valor deste parâmetro como 0 permite ver resultados que, de outra forma, seriam excluídos por semelhança com outros resultados.
1
context:
safe_search
Pesquisa segura. Defina como true para ativá-la.
false
context:
udm
udm O parâmetro permite alternar entre diferentes abas de pesquisa, como imagens, lugares ou vídeos, para personalizar o tipo de resultados exibidos. Encontre os valores aceitos aqui.
-
context:
tbm
A ser correspondido ou tbm parâmetro. Valores disponíveis: bks (livros), isch (imagens), nws (notícias), vid (vídeos), lcl resultados (locais).
-
context:
tbs
Este parâmetro é como um contêiner para parâmetros do Google mais obscuros, como limitar/ordenar resultados por data, bem como outros filtros, alguns dos quais dependem do tbm parâmetro. Mais informações aqui.
-
udm e tbm parâmetros de contexto não podem ser usados juntos em uma única requisição de scraping; selecione apenas um. Usar ambos simultaneamente pode levar a conflitos ou comportamento inesperado.
Outro
Configurações e controles avançados adicionais para requisitos especializados.
context:
fpstate
Definindo o fpstate valor para aig fará com que o Google carregue mais apps. Este parâmetro só é útil se usado em conjunto com o render parâmetro.
-
context:
nfpr
true desativará a correção ortográfica automática
false
Parâmetros de contexto
Todos os parâmetros de contexto devem ser adicionados ao context array como objetos com chave e valor pares, por exemplo:
Dados estruturados
Web Scraper API é capaz de extrair um objeto HTML ou JSON que contenha resultados de pesquisa do Google, oferecendo dados estruturados sobre vários elementos da página de resultados.
Para ajudá-lo a identificar certos elementos, consulte os dicionários de dados de cada tipo de resultado de pesquisa do Google, seja obtido em pesquisas desktop ou mobile.
Dicionário de dados de saída
Navegue pelos detalhes usando a navegação do lado direito ou rolando a página para baixo.
Estrutura JSON
A saída estruturada da Pesquisa na Web do Google inclui campos como URL, page, resultse outros. A tabela abaixo apresenta uma lista detalhada de cada recurso de SERP que analisamos, junto com sua descrição e tipo de dado. A tabela também inclui alguns metadados.
url
O URL da página de pesquisa do Google.
cadeia de caracteres
page
Número da página em relação à paginação da SERP do Google.
inteiro
results
Um dicionário contendo os resultados da pesquisa.
objeto
results.pla
Uma lista de anúncios de listagem de produtos com seus respectivos detalhes.
objeto
results.paid
Uma lista de resultados patrocinados com seus respectivos detalhes.
array
results.images
Uma lista de resultados de imagens com seus respectivos detalhes.
objeto
results.flights
Uma lista de voos com seus respectivos detalhes.
objeto
results.organic
Uma lista de listagens não pagas com seus respectivos detalhes.
array
results.organic_videos
Uma lista de vídeos orgânicos com seus respectivos detalhes.
array
results.top_sights
Uma lista de marcos ou atrações notáveis com seus respectivos detalhes.
array
results.jobs
Uma lista de vagas com seus respectivos detalhes.
objeto
results.local_service_ads
Uma lista de provedores de serviços locais patrocinados.
objeto
results.video_boxes
Caixas de vídeo na SERP com seus respectivos detalhes.
array
results.recipes
Uma lista de receitas com seus respectivos detalhes.
objeto
results.twitter
Uma lista de resultados do Twitter (X) com seus respectivos detalhes.
array
results.local_pack
Uma lista contendo listagens de empresas locais relevantes para a pesquisa.
objeto
results.item_carousel
Uma lista de itens ilustrativos para consultas informativas com seus respectivos detalhes.
objeto
results.videos
Uma lista de vídeos com seus respectivos detalhes.
objeto
results.hotels
Uma lista de hotéis relevantes para a localização usada na consulta de pesquisa.
objeto
results.apps
Uma lista de aplicativos com seus respectivos detalhes.
array
results.finance
Um resumo de dados financeiros de empresas, incluindo preços das ações, valor de mercado e outras métricas principais.
objeto
results.sports_games
Informações sobre jogos esportivos recentes, detalhando pontuações, equipes, tipos de jogo e destaques.
objeto
results.discussions_and_forums
Uma lista de tópicos de discussão e posts de fórum com URLs, títulos, fontes e contagens de comentários.
objeto
results.featured_snippet
Uma lista de resultados específicos recuperados da parte orgânica das SERPs.
array
results.top_stories
Uma lista de artigos com seus respectivos detalhes quando uma consulta de pesquisa é identificada como voltada para notícias.
objeto
results.popular_products
Uma lista de exibições não pagas e orgânicas de listagens de produtos do Google Shopping com seus respectivos detalhes.
objeto
results.related_searches
Uma lista de um ou mais blocos de pesquisas relacionadas apresentados em diferentes posições na página de pesquisa.
array
results.related_questions
Uma lista de consultas de pesquisa interrogativas relacionadas com seus respectivos detalhes.
objeto
results.what_people_are_saying
Uma lista de tópicos de discussão e posts de fórum com URLs, títulos, fontes, principais comentários, nível de engajamento e períodos.
array
results.search_information
Uma lista de detalhes da consulta de pesquisa enviada.
objeto
total_results_count
O número total de resultados encontrados para a consulta de pesquisa.
cadeia de caracteres
last_visible_page
Valor que identifica o número máximo de página visível na página de resultados da consulta de pesquisa. (-1 quando o carregamento de mais resultados é iniciado por rolagem).
inteiro
parse_status_code
O código de status da tarefa de parsing. Você pode ver os códigos de status do parser descritos aqui.
inteiro
created_at
O timestamp em que a tarefa de scraping foi criada.
timestamp
updated_at
O timestamp em que a tarefa de scraping foi concluída.
timestamp
job_id
O ID da tarefa associada à tarefa de scraping.
cadeia de caracteres
status_code
O código de status da tarefa de scraping. Você pode ver os códigos de status do scraper descritos aqui.
inteiro
parser_type
O tipo de parser usado para decompor o conteúdo HTML.
cadeia de caracteres
Anúncios de listagem de produtos (PLA)
O pla seção de resultados de pesquisa refere-se a anúncios de listagem de produtos, também conhecidos como Google Shopping Ads, exibidos em destaque no topo da página de pesquisa em formato de carrossel.
itens
Todos os PLAs disponíveis na página.
array
Desktop e mobile
items.pos
Um indicador que denota a posição de um determinado item entre os resultados de PLA.
inteiro
Desktop e mobile
items.title
O título do produto no anúncio de listagem.
cadeia de caracteres
Desktop e mobile
items.url
O URL do produto
cadeia de caracteres
Desktop e mobile
items.price
O preço do produto no anúncio de listagem.
cadeia de caracteres
Desktop e mobile
items.seller
O vendedor do produto no anúncio de listagem.
cadeia de caracteres
Desktop e mobile
items.url_image
O URL da imagem do produto.
cadeia de caracteres
Desktop
items.image_data
A imagem em miniatura codificada em base64 do produto.
cadeia de caracteres
Desktop e mobile
pos_overall
Uma indicação da posição do recurso de SERP PLA dentro da SERP.
inteiro
Desktop e mobile
Pago
O paid seção refere-se a anúncios veiculados pelo Google Ads, normalmente exibidos acima dos resultados orgânicos (não pagos).

pos
Um indicador que denota a posição de um determinado item entre os resultados pagos.
inteiro
Desktop e mobile
url
O URL do resultado pago.
cadeia de caracteres
Desktop e mobile
desc
Uma breve descrição do resultado pago.
cadeia de caracteres
Desktop e mobile
title
O título do resultado pago.
cadeia de caracteres
Desktop e mobile
data_rw
URL de redirecionamento do resultado pago.
cadeia de caracteres
Desktop e mobile
sitelinks
Um objeto contendo informações sobre links internos para um site que aparece abaixo do primeiro resultado de pesquisa no Google.
objeto
Desktop e mobile
sitelinks.inline/expanded
Uma lista de URLs com seus respectivos detalhes. O nome da chave (`inline`/`expanded`) especifica o tipo do sitelinks elemento.
array
Desktop e mobile
sitelinks.inline.url
O URL do site vinculado.
cadeia de caracteres
Desktop e mobile
sitelinks.inline.title
O título do site vinculado.
cadeia de caracteres
Desktop e mobile
sitelinks.inline.description
Uma breve descrição do site vinculado.
cadeia de caracteres
Desktop
url_shown
O URL abreviado visível logo abaixo da descrição.
cadeia de caracteres
Desktop e mobile
pos_overall
Uma indicação da posição do resultado pago dentro da SERP.
inteiro
Desktop e mobile
Imagens
O images seção refere-se a resultados de imagens exibidos em diferentes seções em uma página de SERP, seja como uma seção dedicada ou no topo. É importante observar que a estrutura dos dados extraídos dos resultados da Pesquisa do Google pode diferir da dos dados extraídos dos resultados da Pesquisa de Imagens do Google.
itens
Uma lista de imagens com seus respectivos detalhes.
array
Desktop e mobile
items.alt
O texto alternativo da imagem.
cadeia de caracteres
Desktop e mobile
items.pos
Um indicador único que denota a posição da imagem na lista.
inteiro
Desktop e mobile
items.url
A URL da página da web que contém a imagem.
cadeia de caracteres
Desktop e mobile
pos_overall
Uma indicação da posição do recurso Images no SERP.
inteiro
Desktop e mobile
Orgânico
O orgânico section refere-se a listagens não pagas nos resultados orgânicos da Pesquisa Google, determinadas pela relevância por meio do algoritmo do Google. Essas listagens aparecem abaixo dos anúncios pagos nas páginas de pesquisa.
Exemplo 1

Exemplo 2

pos
Um indicador que denota a posição de um determinado item entre os resultados orgânicos.
inteiro
Desktop e mobile
url
A URL do resultado orgânico.
cadeia de caracteres
Desktop e mobile
desc
Uma breve descrição do resultado orgânico.
cadeia de caracteres
Desktop e mobile
title
O título do resultado orgânico.
cadeia de caracteres
Desktop e mobile
images
As imagens em miniatura codificadas em base64 do resultado orgânico.
cadeia de caracteres
Desktop e mobile
sitelinks
O objeto contém o elemento `expanded` ou `inline` com mais detalhes sobre os sitelinks.
objeto
Desktop e mobile
sitelinks.expanded/inline
Uma lista de sitelinks do resultado orgânico. O nome da chave (inline/expanded) especifica o tipo do elemento de sitelinks.
array
Desktop e mobile
sitelinks.expanded.url
O URL do site vinculado.
cadeia de caracteres
Desktop e mobile
sitelinks.expanded.title
O título do site vinculado.
cadeia de caracteres
Desktop e mobile
url_shown
O URL abreviado visível logo abaixo da descrição.
cadeia de caracteres
Desktop e mobile
pos_overall
Uma indicação da posição do resultado orgânico dentro do SERP.
inteiro
Desktop e mobile
favicon_text
O texto ou nome associado ao favicon (ícone do site).
cadeia de caracteres
Desktop
rating
A classificação média do produto ou conteúdo.
número de ponto flutuante
Desktop
review_count
O número de avaliações associadas ao produto ou conteúdo.
inteiro
Desktop
additional_info
Contém detalhes sobre preços, disponibilidade, classificações do produto, opções de entrega e políticas de devolução.
lista de cadeias de caracteres
Desktop
Vídeos orgânicos
O results.organic_videos contém um array de listagens de vídeos exibidas de forma orgânica nos resultados de pesquisa, o que significa que não são anúncios pagos. Cada listagem de vídeo inclui detalhes relevantes, como o título do vídeo, a URL e a descrição.

pos
Um indicador que denota a posição de um determinado item entre os resultados de Vídeos orgânicos.
inteiro
Desktop
url
A URL do vídeo.
cadeia de caracteres
Desktop
desc
Breve descrição do vídeo.
cadeia de caracteres
Desktop
title
O título do vídeo.
cadeia de caracteres
Desktop
pos_overall
Uma indicação da posição do resultado de Vídeo orgânico dentro do SERP.
inteiro
Desktop
Principais atrações
O results.top_sights contém uma lista de pontos turísticos ou atrações importantes normalmente associados ao local ou tópico pesquisado. Cada item inclui detalhes como a posição na lista e o título.
itens
Uma lista das principais atrações com seus respectivos detalhes.
array
Desktop
items.pos
A posição do resultado Top Sights dentro do recurso SERP Top Sights.
inteiro
Desktop
items.title
O título do local turístico.
cadeia de caracteres
Desktop
pos_overall
Uma indicação da posição do resultado Top Sights dentro do SERP.
inteiro
Desktop
Empregos
O results.jobs contém listagens de empregos extraídas dos resultados de pesquisa. Cada listagem inclui detalhes como a URL que direciona para a vaga, o título da vaga, a fonte, o empregador e a localização. As listagens são obtidas de vários sites de vagas, sites de carreira e outras plataformas indexadas pelo Google.

listagens
Um vetor de todas as listagens de empregos disponíveis na página.
array
Desktop
listings.url
A URL da listagem completa de emprego.
cadeia de caracteres
Desktop
listings.title
O título da vaga.
cadeia de caracteres
Desktop
listings.source
A fonte que contém a postagem original da vaga.
cadeia de caracteres
Desktop
listings.employer
A organização contratando para a posição identificada.
cadeia de caracteres
Desktop
listings.location
A localização da posição.
cadeia de caracteres
Desktop
pos_overall
Uma indicação da posição do recurso Jobs no SERP.
inteiro
Desktop
Twitter (X)
O twitter o recurso aparece com frequência para marcas, filmes, músicos e outras celebridades, geralmente posicionado diretamente abaixo do resultado de pesquisa do site da marca. Este recurso oferece um link direto para o feed do Twitter da marca, exibindo um carrossel de seus tweets mais recentes.

pos
Um indicador que denota a posição de um determinado item entre os resultados orgânicos.
inteiro
Desktop
url
A URL do perfil que contém as postagens do Twitter (X).
cadeia de caracteres
Desktop
itens
Uma lista de postagens do Twitter (X) com seus respectivos detalhes.
array
Desktop
items.pos
Um indicador que denota a posição de um determinado tweet dentro do recurso SERP Twitter (X).
cadeia de caracteres
Desktop
items.url
A URL da postagem no Twitter (X).
cadeia de caracteres
Desktop
items.content
Uma breve descrição que denota todo o texto da postagem relevante no Twitter (X).
cadeia de caracteres
Desktop
items.timeframe
Descreve há quanto tempo o tweet foi criado.
cadeia de caracteres
Desktop
title
O título do perfil do Twitter (X).
cadeia de caracteres
Desktop
pos_overall
Uma indicação da posição do resultado do Twitter no SERP.
inteiro
Desktop
Pacote local
O local_pack exibe os três principais resultados de pesquisa local com base na localização do usuário ou na localização de pesquisa especificada, incluindo um mapa e informações adicionais.
itens
Uma lista de locais com seus respectivos detalhes.
array
Desktop e mobile
items.cid
Um número de identificação único atribuído a uma listagem comercial específica.
cadeia de caracteres
Desktop e mobile
items.pos
A posição do resultado local dentro do pacote local.
inteiro
Desktop e mobile
items.title
O título da entidade local.
cadeia de caracteres
Desktop e mobile
items.rating
A classificação da entidade local.
inteiro
Desktop e mobile
items.address
O endereço da entidade local.
cadeia de caracteres
Desktop e mobile
items.rating_count
O número de avaliações da entidade local.
inteiro
Desktop e mobile
pos_overall
Uma indicação da posição do resultado do Pacote Local dentro do SERP.
inteiro
Desktop e mobile
Principais notícias
top_stories é uma seção dedicada que aparece na Pesquisa Google para consultas com foco em notícias.

itens
Uma lista de artigos de notícias selecionados com seus respectivos detalhes.
array
Desktop e mobile
items.pos
A posição do artigo dentro do recurso SERP Principais notícias.
inteiro
Desktop e mobile
items.url
A URL do artigo completo.
cadeia de caracteres
Desktop e mobile
items.title
O título do artigo.
cadeia de caracteres
Desktop e mobile
items.section
O nome da seção Principais notícias.
cadeia de caracteres
Móvel
items.source
O nome do site onde o artigo é publicado.
cadeia de caracteres
Desktop e mobile
items.timeframe
Descreve há quanto tempo o artigo foi publicado.
cadeia de caracteres
Desktop
pos_overall
Indica a posição geral do recurso SERP Principais notícias dentro do SERP.
inteiro
Desktop e mobile
Produtos populares
O popular_products O recurso SERP apresenta um carrossel de vários produtos determinados por sua popularidade e relevância para a consulta do usuário. Isso difere dos anúncios de listagem de produtos (PLAs), que são influenciados pelos anunciantes. Vale notar que vários popular_products carrosséis podem aparecer em uma única página do SERP.
itens
Uma lista de produtos populares com seus respectivos detalhes.
array
Desktop e mobile
items.pos
Um indicador único para a posição de um determinado produto popular dentro do recurso SERP Produtos populares.
inteiro
Desktop e mobile
items.url
A URL da página do Google Shopping do produto.
cadeia de caracteres
Desktop e mobile
items.title
O título do produto.
cadeia de caracteres
Desktop e mobile
items.token
Token do produto (usado com google_shopping_product source para vendedor, preços, detalhes do produto).
cadeia de caracteres
Desktop e mobile
items.rating
A classificação de um determinado produto popular.
cadeia de caracteres
Desktop e mobile
items.sellers
Uma lista de vendedores que oferecem o produto, com seus respectivos detalhes.
array
Desktop e mobile
items.sellers.pos
A posição do vendedor na lista de vendedores.
inteiro
Desktop e mobile
items.sellers.price_str
O preço do produto oferecido pelo vendedor.
cadeia de caracteres
Desktop e mobile
items.sellers.seller_name
O nome do vendedor do produto.
cadeia de caracteres
Desktop e mobile
items.currency
O código da moeda do preço listado.
cadeia de caracteres
Desktop e mobile
items.image_data
A imagem em miniatura codificada em base64 do produto.
cadeia de caracteres
Desktop e mobile
items.description
Breve descrição do vendedor do produto.
cadeia de caracteres
Desktop e mobile
items.rating_count
O número de avaliações do produto.
inteiro
Desktop e mobile
pos_overall
Indica a posição geral do recurso SERP Produtos populares dentro do SERP.
inteiro
Desktop e mobile
Pesquisas relacionadas
O related_searches O recurso SERP exibe consultas de pesquisa alternativas relacionadas à palavra-chave de pesquisa inicial, geralmente localizadas na parte inferior do SERP.
pos_overall
Indica a posição geral desse bloco de pesquisas relacionadas na página de pesquisa.
inteiro
Desktop e mobile
related_searches
Uma lista de strings de pesquisa relacionadas neste bloco.
array
Desktop e mobile
Perguntas relacionadas
O related_questions o recurso fica posicionado abaixo dos principais resultados de pesquisa, apresentando uma lista de perguntas diretamente relacionadas à consulta de pesquisa original do usuário. Ao oferecer um conjunto selecionado de perguntas relacionadas, os usuários podem explorar diferentes aspectos do tema, aprimorando sua experiência geral de pesquisa.

itens
Uma lista contendo todas as perguntas relacionadas.
array
Desktop e mobile
items.pos
Um indicador único que denota a posição de qualquer pergunta relacionada dentro do recurso SERP Perguntas relacionadas.
inteiro
Desktop e mobile
items.answer
A resposta à pergunta relacionada.

