For the complete documentation index, see llms.txt. This page is also available as Markdown.

网页爬虫API Playground

掌握网页爬虫API Playground 以构建和测试请求。制作爬虫原型,使用 OxyCopilot 进行 AI 解析,并导出代码片段。

网页爬虫API Playground 是 Oxylabs 仪表盘中的一个交互式工具。它可让你在简化环境中构建和测试网页爬虫API 请求。

通过网页爬虫API Playground,你可以尝试不同目标、调整请求参数、预览结果,并导出可直接使用的代码片段。它适用于初学者和高级用户,也适合快速原型验证和检查请求配置。

它还集成了 OxyCopilot,这是一个由 AI 驱动的助手,可帮助生成解析规则、创建解析器预设、构建爬虫,并根据自然语言提示生成浏览器指令。

主要功能

网页爬虫API Playground 是用于实验网页爬虫API 请求的主要环境。其主要功能包括:

  • 交互式请求构建器 – 选择一个来源(Universal、Amazon、Google、YouTube 等),输入 URL 或查询,并直接从仪表盘运行请求。

  • 参数自定义 – 调整 JavaScript 渲染、地理位置、区域设置、解析、用户代理类型等选项。

  • 结果预览 – 以原始 HTML 或解析后的 JSON 查看响应,以确认请求输出。

  • 导出选项 – 复制生成的代码片段(cURL、Python 等)或请求负载,以便进一步使用。

  • OxyCopilot 集成 – 使用内置助手,通过自然语言自动创建爬虫请求负载、解析逻辑、可复用的解析器预设或浏览器指令。

在抓取时,网页爬虫API Playground 适用于 测试和探索。对于高并发或自动化工作流,请使用标准的网页爬虫API 集成方法(Realtime, Push-Pull,或 Proxy Endpoint).

如何使用

使用网页爬虫API Playground 非常简单。请按以下步骤操作:

1

访问网页爬虫API Playground

登录到 Oxylabs 控制台 并打开网页爬虫API Playground。

2

选择来源

选择一个专用来源 – 具体网站(例如 Google、Amazon、YouTube 等)以及爬虫来源(例如 URL, amazon_product, google_search)或“--Any other website--”,用于下拉菜单中未提及的网站。

3

输入查询或 URL

提供你要抓取的搜索查询或页面 URL。

4

添加额外参数(可选)

根据你的使用场景,调整渲染、解析、本地化或其他选项。

5

运行请求

提交请求并立即预览返回的数据。

6

导出

如果你对结果满意,可以复制生成的代码片段或你偏好的编程语言中的请求负载,并在脚本或应用中使用。你也可以通过右上角的下拉菜单导出 JSON 或 HTML 结果。

访问与试用

网页爬虫API Playground 对所有 Oxylabs 仪表盘用户开放,可用于测试 Oxylabs 网页爬虫API 的功能。

最后更新于

这有帮助吗?