Busca de imagens
Extraia resultados do Google Image Search com dados parseados, incluindo listagens orgânicas de imagens, URLs das imagens, domínios de origem, títulos, buscas sugeridas e informações de busca.
A google_search A fonte foi projetada para recuperar resultados da Pesquisa Google (SERPs). Esta subpágina apresenta especificamente dados relacionados à Pesquisa de Imagens do Google. Para explorar outros tipos de resultado, leia aqui: Pesquisa na Web, Pesquisa de Notícias.
Para fazer scraping da Pesquisa de Imagens do Google, inclua o context:udm parâmetro com o valor definido como 2 ou context:tbm parâmetro com o valor definido como isch.
Exemplos de solicitação
Nos exemplos abaixo, fazemos uma solicitação para obter páginas de resultados da pesquisa de imagens para o termo de pesquisa adidas.
udm
curl 'https://realtime.oxylabs.io/v1/queries' \
--user 'USERNAME:PASSWORD' \
-H 'Content-Type: application/json' \
-d '{
"source": "google_search",
"query": "adidas",
"parse": true,
"context": [
{
"key": "udm",
"value": 2
}
]
}'import requests
from pprint import pprint
# Structure payload.
payload = {
'source': 'google_search',
'query': 'adidas',
'parse': True,
'context': [
{'key': 'udm', 'value': 2},
],
}
# Get response.
response = requests.post(
'https://realtime.oxylabs.io/v1/queries',
auth=('USERNAME', 'PASSWORD'),
json=payload,
)
# Print prettified response to stdout.
pprint(response.json())tbm
Usamos o método de integração síncrona Realtime em nossos exemplos. Se você quiser usar Proxy Endpoint ou a integração assíncrona Push-Pull de integração, consulte a seção de métodos de integração .
Valores dos parâmetros da solicitação
Geral
Opções básicas de configuração e personalização para fazer scraping dos resultados de pesquisa de imagens do Google.
source
Define o scraper. Use google_search.
–
query
A palavra-chave ou frase a ser pesquisada.
–
context:
udm
Para obter resultados da pesquisa de imagens, defina o valor como 2. Encontre outros valores aceitos aqui.
–
context:
tbm
Para obter resultados da pesquisa de imagens, defina o valor como isch. Outros valores aceitos: app, blg, bks, dsc, nws, pts, plcs, rcp, lcl.
–
- parâmetro obrigatório
udm e tbm os parâmetros de contexto não podem ser usados juntos em uma única solicitação de scraping; escolha um deles. Usar ambos simultaneamente pode levar a conflitos ou comportamento inesperado.
Operadores avançados de pesquisa do Google
Ao fazer scraping, você pode achar útil combinar operadores avançados de pesquisa do Google com sua consulta. Isso permite personalizar o escopo da pesquisa, garantindo que os resultados sejam mais relevantes e focados. Explore esses comandos especiais aqui e aqui. Veja um exemplo abaixo.
Localização
Adapte os resultados da pesquisa para locais geográficos e idiomas específicos.
geo_location
A localização geográfica para a qual o resultado deve ser adaptado. Usar este parâmetro corretamente é extremamente importante para obter os dados certos. Para mais informações, leia sobre nossas geo_location estruturas de parâmetros aqui.
-
locale
Accept-Language valor do cabeçalho que altera o idioma da interface web da sua página de pesquisa do Google. Mais informações.
-
Paginação
Controles para gerenciar a paginação e a recuperação dos resultados da pesquisa.
start_page
Número inicial da página.
1
pages
Número de páginas a recuperar.
1
Filtragem
Opções para filtrar e refinar os resultados da pesquisa com base em vários critérios.
context:safe_search
Pesquisa segura. Defina como true para ativá-la.
false
context:
tbs
tbs parâmetro. Contêiner para parâmetros mais obscuros do Google, como limitar/classificar resultados por data ou outros filtros que dependem do tbm (por exemplo, tbs=app_os:1 está disponível apenas com tbm valor app). Mais informações aqui.
-
Outros
Configurações e controles avançados adicionais para requisitos especializados.
context:
fpstate
Definir o fpstate valor para aig fará o Google carregar mais aplicativos. Esse parâmetro só é útil se usado junto com o render parâmetro.
-
context:
nfpr
true desativará a autocorreção ortográfica
false
Parâmetros de contexto
Todos os parâmetros de contexto devem ser adicionados ao context vetor como objetos com chave e valor pares, por exemplo:
Dados estruturados
SERP Scraper API é capaz de extrair um objeto HTML ou JSON que contém resultados de pesquisa do Google, oferecendo dados estruturados sobre vários elementos da página de resultados.
Dicionário de dados de saída
Exemplo de HTML

Estrutura JSON
A saída estruturada da Pesquisa de Imagens do Google inclui campos como URL, page, resultse outros. A tabela abaixo apresenta uma lista detalhada de cada recurso de SERP que analisamos, junto com sua descrição e tipo de dado. A tabela também inclui alguns metadados.
url
A URL da página de pesquisa do Google.
cadeia de caracteres
results
Um dicionário contendo os resultados da pesquisa.
vetor
results.organic
Uma lista de resultados orgânicos com seus respectivos detalhes.
vetor
resaults.search_information
Uma lista de detalhes da consulta de pesquisa enviada.
objeto
results.suggested_searches
Uma lista de pesquisas sugeridas exibidas logo abaixo da consulta de pesquisa original.
vetor
parse_status_code
O código de status da tarefa de parsing. Você pode ver os códigos de status do parser descritos aqui.
inteiro
created_at
O carimbo de data/hora em que o trabalho de scraping foi criado.
carimbo de data/hora
updated_at
O carimbo de data/hora em que o trabalho de scraping foi concluído.
carimbo de data/hora
page
Número da página em relação à paginação da SERP do Google.
inteiro
job_id
O ID do trabalho associado ao trabalho de scraping.
cadeia de caracteres
status_code
O código de status da tarefa de scraping. Você pode ver os códigos de status do scraper descritos aqui.
inteiro
Orgânico
A Pesquisa de Imagens organic Esta seção mostra listagens não pagas nos resultados da Pesquisa de Imagens do Google, organizadas por relevância pelo algoritmo do Google. Esses resultados são apresentados a usuários que buscam conteúdo visual e são exibidos em uma seção dedicada, distinta de outros tipos de resultados de pesquisa.
pos
Um indicador exclusivo que indica a posição da imagem na lista.
cadeia de caracteres
link
A URL do site em que a imagem está inserida.
vetor
image
A URL da imagem.
vetor
title
O título do artigo em que a imagem está inserida.
objeto
domain
O domínio do site que contém o resultado da imagem.
vetor
pos_overall
Um indicador exclusivo que indica a posição da imagem na lista.
inteiro
Informações de pesquisa
informações de pesquisa é uma seção que fornece detalhes sobre a consulta de pesquisa. Ela inclui informações como o termo de pesquisa original e, se aplicável, quaisquer autocorreções feitas pelo Google.

query
O termo de pesquisa original.
cadeia de caracteres
showing_results_for
O termo de pesquisa para o qual os resultados são exibidos. query e showing_results_for pode diferir se o Google tiver corrigido automaticamente o termo de pesquisa fornecido.
vetor
Pesquisas sugeridas
A suggested_searches (vetor) na Pesquisa de Imagens do Google fornece uma lista de termos de pesquisa sugeridos relacionados à consulta original. Os usuários podem explorar essas opções adicionais de pesquisa para refinar ou expandir sua pesquisa de imagens.
Atualizado
Isto foi útil?

