畅销榜
使用网页爬虫API 发现 Amazon Best Sellers 数据。借助可自定义参数,收集排名靠前的产品详情、分类和价格。
该 amazon_bestsellers 数据源旨在抓取 Amazon Best Sellers 页面。要查看包含已抓取数据的响应示例,请下载此 示例输出 HTML 格式文件,或查看结构化数据输出 此处.
请求示例
在下面的代码示例中,我们发起请求以获取 2类目中 Best Sellers 的第 nd 页,其 ID 为 172541,位于 amazon.com 市场。
curl 'https://realtime.oxylabs.io/v1/queries' \\
--user 'USERNAME:PASSWORD' \\
-H 'Content-Type: application/json' \\
-d '{
"source": "amazon_bestsellers",
"domain": "com",
"query": "172541",
"render": "html",
"start_page": 2,
"parse": true
}'import requests
from pprint import pprint
# 结构化载荷。
payload = {
'source': 'amazon_bestsellers',
'domain': 'com',
'query': '172541',
'render': 'html',
'start_page': 2,
'parse': True,
}
# 获取响应。
response = requests.request(
'POST',
'https://realtime.oxylabs.io/v1/queries',
auth=('USERNAME', 'PASSWORD'),
json=payload,
)
# Print prettified response to stdout.
pprint(response.json())我们在示例中使用同步 Realtime 集成方法。如果您想使用 Proxy Endpoint 或异步 Push-Pull 集成,请参阅 集成方法 部分。
请求参数值
通用
抓取 Amazon Best Sellers 页面时的基础设置和自定义选项。
- 必填参数
本地化
将结果适配到特定地理位置、域名和语言。
重要: 在大多数页面类型上,Amazon 会根据客户的配送位置定制返回结果。因此,我们建议使用 geo_location 参数来设置你偏好的配送位置。你可以阅读更多关于使用 geo_location 与 Amazon 配合使用 此处.
分页
用于管理搜索结果分页和检索的控件。
start_page
起始页码。
1
pages
要检索的页数。
1
其他
针对特殊需求的其他高级设置和控件。
代码示例
结构化数据
下面可以找到一个 结构化输出示例 用于 amazon_bestsellers.
数据字典
HTML 示例

JSON 结构
该 amazon_bestsellers 提供 Amazon 上畅销产品的完整数据。下表列出了我们解析的每个字段,以及其描述和数据类型。表中还包含一些元数据。
url
Amazon Best Sellers 页面的网址。
字符串
page
当前页码。
整数
pages
总页数。
整数
查询
原始搜索词。
字符串
results
包含搜索结果的字典。
对象
results.pos
表示畅销商品位置的指标。
整数
results.url
畅销商品的网址。
字符串
results.asin
Amazon 标准识别号。
字符串
results.price
产品价格。
字符串
results.title
产品标题。
字符串
results.rating
产品评分。
浮点数
results.currency
价格所使用的货币。
字符串
results.is_prime
表示该产品是否符合 Amazon Prime 资格。
布尔值
results.price_str
任何折扣或促销前的原价
浮点数
results.price_upper
适用时的价格上限。
浮点数
results_ratings_count
产品获得的评分总数。
整数
创建时间
抓取任务创建时的时间戳。
时间戳
更新时间
抓取任务完成时的时间戳。
时间戳
任务ID
与该抓取任务关联的任务 ID。
字符串
parser_type
用于解析数据的解析器类型。
字符串
最后更新于
这有帮助吗?

