For the complete documentation index, see llms.txt. This page is also available as Markdown.

Target

了解如何使用网页爬虫API 获取 Target 网页数据,并了解所有受支持的 Target 源。

使用网页爬虫API,您可以抓取并解析各种类型的 Target 页面;以下是所有受支持的采集器及其对应值的概览。 source 值。

入门

来源
描述
专用解析器

target

可通过额外本地化选项,直接访问任何 Target URL。

target_search

搜索页面 适用于您选择的搜索词。

target_product

商品页面 适用于您选择的商品ID。

target_category

分类页面 基于 Target 的分类法节点 ID。

创建您的 API 用户凭据:注册免费试用,或在 Oxylabs 仪表板 创建您的 API 用户凭据(USERNAMEPASSWORD).

我们在示例中使用同步 Realtime 集成方法。如果您想使用 Proxy Endpoint 或异步 Push-Pull 集成,请参阅 集成方法 部分。

您还可以选择包含其他参数,例如 user_agent_type, 解析, render 等,以自定义您的抓取请求。了解更多:

功能

Target 来源

target source 允许你通过提供直接 URL 检索任何 Target 页面。这对于访问专门来源未覆盖的特定 Target 页面很有用。

请求示例

curl 'https://realtime.oxylabs.io/v1/queries' \\
--user 'USERNAME:PASSWORD' \\
-H 'Content-Type: application/json' \\
-d '{
    "source": "target",
    "url": "https://www.target.com/deals/all",
    "render": "html"
}'
import requests
from pprint import pprint

# Structure payload
payload = {
    'source': 'target',
    'url': 'https://www.target.com/deals/all',
    'render': 'html',
}

# Get response
response = requests.request(
    'POST',
    'https://realtime.oxylabs.io/v1/queries',
    auth=('USERNAME', 'PASSWORD'),
    json=payload,
)

# Print the response
pprint(response.json())

请求参数值

通用

参数
描述
默认值

source

设置抓取器。

target

url

到任何 Target 页面的直接 URL(链接)。

-

render

设置为 html 时启用 JavaScript 渲染。 更多信息.

-

callback_url

回调端点的 URL。 更多信息.

user_agent_type

设备类型和浏览器。完整列表可在 此处.

desktop

- 必填参数

本地化

将结果适配到特定商店和配送地点。

参数
描述
类型

store_id

设置商店位置。

整数

delivery_zip

设置配送目的地。

字符串

最后更新于

这有帮助吗?