For the complete documentation index, see llms.txt. This page is also available as Markdown.

Cdiscount

了解如何使用网页爬虫API 抓取各种类型的 Cdiscount 页面,包括受支持的源、参数和示例请求。

使用网页爬虫API,您可以抓取和解析各种类型的 Cdiscount 的 页面。以下是所有支持的爬虫及其对应的 source 值:

来源
描述
专用解析器

cdiscount_search

搜索页面 用于您选择的搜索词。

cdiscount_product

产品页面 用于您选择的产品 ID。

cdiscount

提交任意 Cdiscount URL 即可。

入门

创建您的 API 用户凭证:注册免费试用或在 Oxylabs 控制台 中购买产品,以创建您的 API 用户凭证(USERNAMEPASSWORD).

请求示例

curl 'https://realtime.oxylabs.io/v1/queries' \\
--user 'USERNAME:PASSWORD' \\
-H 'Content-Type: application/json' \\
-d '{
        "source": "cdiscount_search", 
        "query": "tv"
    }'
import requests
from pprint import pprint


# 结构化载荷。
payload = {
    'source': 'cdiscount_search',
    'query': 'tv'
}

# 获取响应。
response = requests.request(
    'POST',
    'https://realtime.oxylabs.io/v1/queries',
    auth=('USERNAME', 'PASSWORD'),
    json=payload,
)

# 不会返回包含作业状态和结果 url 的响应,而是返回
# 包含结果的 JSON 响应。
pprint(response.json())

我们在示例中使用同步 Realtime 集成方法。如果您想使用 Proxy Endpoint 或异步 Push-Pull 集成,请参阅 集成方法 部分。

可选地,您还可以包含诸如 user_agent_type, render 以及更多参数,以自定义您的抓取请求。阅读更多:

功能

最后更新于

这有帮助吗?