ScrapingBee 评测
ScrapingBee 出色的用户体验和完整的功能集使其成为中小型网络抓取工作的绝佳选择——只要你注意你的积分使用。
使用代码 x 获得折扣。
如果你在谷歌上搜索过任何关于网络爬虫的主题,那么 ScrapingBee 这个名字对你来说可能并不陌生。 现在您决定进一步了解这项服务以及它是否能够…… 蜜蜂-选择(抱歉)您首选的爬虫基础设施供应商。
没错,这篇评测正是要讲这些!我们将介绍 ScrapingBee 这家公司,深入研究其网页抓取 API 的内部机制,将 ScrapingBee 的性能与竞争对手进行比较,并看看这款工具是否易于使用。让我们开始吧!
基本信息
- 国家 / 州属 / 邦: 法国
- 成立时间: 2019
- 员工(领英): 10-25
- 服务: 网页抓取API
- 价格段: 根据网站类型,价格从低到高不等。
- 付款方式: 信用卡、电汇
- 试用: 1积分,有效期14天
ScrapingBee 是一家法国公司,由 Pierre de Wulf 和 Kevin Sahin 这两位个性鲜明的创始人创立。 其目前的主要也是唯一的产品是网络爬虫API。.
ScrapingBee 可以被认为是一家创始人主导型的公司。 起初,他们经常在推特上分享产品相关的新闻和增长数据。虽然这种情况已经持续了好几年,但皮埃尔仍然活跃在他的账号上发布(有时甚至是一些无厘头的)与公司相关的话题。
到 2025 年底, ScrapingBee 的员工人数已增长至两位数,年收入超过 5 万美元。并发展成为规模较大的网络爬虫API开发商之一。其增长主要得益于对开发者友好的用户体验、便捷的自助服务以及非常成功的SEO策略。
除了 TinySeed 的一小笔种子轮投资外,ScrapingBee 完全依靠自身力量发展壮大——其创始人对此引以为豪。这种独立创业的模式在 2025 年 6 月结束。 该公司 被收购 by Oxylabs该公司是该领域的主要参与者。据皮埃尔和凯文说,他们已无法独自扩大产品规模,需要更多资源。
此后,ScrapingBee 推出了一系列新功能,其中一些功能模仿了…… Oxylabs产品发布方面,除此之外,外观上并没有太大变化。 该公司仍然坚持以开发者为先的API。 旨在帮助完成中小型网络爬虫项目。
ScrapingBee 网络爬虫 API
- 通用解锁: ✅
- 结构化数据: DIY解析器、AI解析、网站特定接口
- 发现: 网站特定的搜索端点
- 人工智能相关功能: Markdown、文本输出、MCP 服务器
ScrapingBee 是最重要的 一款通用的网站解除屏蔽工具。 话虽如此,它确实提供了多种数据结构化方法:一些是自动化的,一些是针对特定领域的。除了这些少数领域之外,它并没有内置太多爬虫功能,所以你需要自己处理这部分工作。
集成方法
| 实时API | curl “https://app.scrapingbee.com/api/v1/?api_key=APIKEY&url=https://example.com” |
| 批量API | ❌ |
| 代理 | curl -k -x “https://APIKEY:render_js=False&premium_proxy=True @proxy.scrapingbee.com:8887″ 'https://example.com' |
| 软件开发套件(SDK) | from scrapingbee import ScrapingBeeClient |
| MCP 服务器 | 获取页面、获取屏幕截图、获取文件、网站特定工具 |
ScrapingBee 主要以实时 API 的形式集成。它通过开放的连接传输数据。您可以通过发送带有附加参数的 GET 请求与它交互。如果您的爬虫是用 Python 或 Node.js 构建的,则提供商会提供 SDK 作为替代方案。
另一种形式是代理服务器。 如果你使用的是编写时就考虑到了代理的爬虫脚本,那这当然很好。但是,ScrapingBee 警告说,这个选项与无头浏览器库不兼容:浏览器发出的每个请求都会消耗一个积分。
2025年底,该提供商 启动了 MCP 服务器 为了更方便地与人工智能软件进行通信,服务器包含用于以LLM兼容格式抓取数据、截取屏幕截图以及访问特定网站(例如亚马逊或谷歌)的工具。
主要缺少的是基于webhook的抓取功能。无论是发送单个请求还是批量请求,都无法实现。因此,您无法提前将大型抓取任务排队。
API参数
| 地理定位 |
|
| 请求 定制 |
|
| 浏览器 |
|
| 代理 |
|
| 其他 |
|
ScrapingBee 的 API 支持所有标准请求参数:传递自定义标头、建立会话和选择设备类型。地理位置选项也很丰富,但前提是您使用高级代理;因此,无论选择哪个国家,您至少需要支付 10 个积分。.
正如预期的那样,这款爬虫程序支持 JavaScript 渲染。您可以选择阻止不必要的资源加载,甚至 执行浏览器操作例如等待选择器加载、滚动或点击元素。提供者 它公开了一个名为“强大的参数”的信息。 评估它允许运行自定义 JavaScript 代码。也就是说,所有浏览器操作总共耗时不应超过 40 秒,因此在复杂场景下,解除浏览器阻塞是更好的选择。
与 ScrapingAPI 或 Zenrows 类似,ScrapingBee 也提供 额外两层反机器人绕过 它们被称为高级代理和隐身代理。它们能更有效地打开难以攻破的目标;但代价是,高级代理请求的费用是普通代理的 10 倍,而隐身代理请求的费用则是普通代理的 75 倍!ScrapingBee 告诉我们,提供这种选择会催生出一些有趣的工作流程:一些客户乐于尝试更多次,只要费用更低。
最后一个有趣的参数是 能够导入您保存的网络爬虫配置例如,您可以设置一个包含 CSS 选择器和多个浏览器操作的复杂 API 调用。与其每次都粘贴完整的代码片段,不如将其作为参数调用,例如命名为“this-saves-me-ten-lines-of-code”。 瞧!
网站特定端点
上市时间(2025年12月)
- 亚马逊: 搜索、产品
- 聊天GPT: 提示输出
- 谷歌: 搜索、垂直搜索、镜头、AI模式
- 沃尔玛: 搜索、产品
- YouTube的: 搜索、可训练性、元数据、成绩单
截至2025年底,ScraperAPI拥有十几个专用于五个网站的端点。与通用API相比, 它们提供结构化数据并接受特殊参数例如,亚马逊搜索允许您直接输入搜索查询而不是完整的 URL,而产品搜索则根据 ASIN 检索数据。
输出与交付
- 方法: 开放连接
- 并发: 10-200 个并发请求
- 数据解析: 手动 CSS/XPath 选择器、AI 提示或提取规则、网站特定端点
- 输出格式: HTML、Markdown、文本、JSON、XHR
- 截图: PNG(整页或选择器)
API 返回数据 仅通过开放连接大多数情况下这样就足够了,但有时更简单的方法是批量提供 URL,然后就不用管它了,等收到通知后再去获取结果。唉。
最初限制10个并发请求是远远不够的。尤其是在目标平台需要 JavaScript 的情况下。但它在大规模部署方案中也能很好地扩展,支持 200 个或更多实例。
ScrapingBee 支持 多种解析策略最直接的方法是发送 JSON 格式的 CSS 或 XPath 选择器。这样可以进一步指定预期输出,例如文本、精简后的 Markdown 或表格。最简便的方法是使用我们刚才介绍的专用端点。
中间有 人工智能提取同样,您有多种选择。最简单但最不准确的方法是…… 写个提示,然后祈祷好运吧。 (ai_query=”产品价格”为了提高可靠性,ScrapingBee 允许您通过指定要解析的特定选择器来缩小范围(ai_selector=”#product-details”).
第二个选择是 至 将 JSON 解析规则发送到语言模型这个数据点被称为 姓名它的格式是 绳子第二个数据点是 车资 格式为 数诸如此类。这种方法正逐渐成为涉及基于人工智能的数据解析领域的行业标准。
除了 HTML 和 JSON 之外,该 API 还支持其他格式。 支持 LLM 兼容的 Markdown 和文本输出格式如果启用 JavaScript 渲染,它还可以返回屏幕截图。最后, json_响应 参数 允许捕获网络请求 用于拦截对内部网站 API 的调用。
定价计划
- 型号: 车辆订阅
- 格式: 积分(每次成功申请最多可获得 75 积分)
- 起始价: 49 美元可获得 250 万积分和 10 个并发账号
- 加售: 并发、优先支持、团队管理功能
- 试用: 1,000学分
ScrapingBee的定价模式是订阅制, 每月续订的计划续订时,未使用的积分将失效。取消订阅后,积分将在订阅期内(31天)继续可用。
这里有 仅有四种公开定价方案 价格从 49 美元到 599 美元不等。登录后,您会看到更多选项,最高可达每月 2,400 美元。所有套餐的功能都类似——区别仅在于数据抓取速度、团队管理功能和客户支持质量。
你将要使用的单元是 API 积分一个积分可以对应一次请求或页面加载,但通常并非如此。ScrapingBee 会对某些功能收取额外积分,例如 JavaScript 渲染或使用其网站特定的接口。以下是详细的收费明细:
| 一般费率 | 特殊网站 |
|
|
只有 ScrapingBee 认为请求成功的用户才会被收取积分。 任何返回 HTML 代码为 200 或 404 的响应其他所有回复均视为失败,不收取任何费用。
这种模式使得 ScrapingBee 的价格非常实惠。 但肯定并非适用于所有情况。启用高级代理后,其费用与其他中端市场提供商(如 ScraperAPI 等)的费用相近。 Decodo.
一旦您启用 JavaScript 渲染,我们就会发现我们的价格甚至超过了像我们这样的付费竞争对手。 Bright Data. 这就是基于积分的网络爬虫 API 的吸引力所在,也是其主要缺陷所在。
以下是 ScrapingBee 与同市场细分领域中预算为 500 美元的竞争对手的比较情况:
| 蜜蜂 | 火爬 | Decodo | 爬虫API | 赞罗 | |
| 最低 CPM* | $0.08 | $0.80 | $0.77 | $0.10 | $0.08 |
| 最昂贵的CPM | $6.23 | $3.99 | $0.77 | $7.13 | $2.08 |
* 每千次请求的价格
如果积分提前用完,您将无法充值。但是,ScrapingBee 确实提供了以下选项: 自动续订计划 使用率达到 98% 时,剩余的 2% 将结转。
在承诺之前,您可以声明 14天免费试用,赠送1,000积分.
性能基准
我们上一次对 ScrapingBee 进行测试是在 2025 年 10 月至 11 月,当时是为了进行年度评估。 关于网络爬虫API的报告我们从 15 个受保护的网站中分别抓取了 6,000 个 URL,每秒发送 2 个请求,然后每秒发送 10 个请求。
平均成功率
与其他提供商的比较
ScrapingBee 对大多数受保护的目标都表现得非常好——事实上, 它在11个API中跻身前四名。然而,虽然像亚马逊、谷歌或沃尔玛这样的网站只需简单的配置就足够了, 我们不得不大量依赖隐蔽代理。 达到可观的成功率。
因此,虽然 ScrapingBee 对于大多数网站来说都是一个非常强大的选择, 它最适合刮擦轻度或半防护目标。.
最快运行的平均响应时间
与其他供应商的比较(成功请求)
就响应时间而言, ScrapingBee 对亚马逊、谷歌或 YouTube 等网站的处理速度相当快。然而,一旦涉及到隐蔽代理,响应速度就会大幅下降,使得 ScrapingBee 成为速度最慢的 API 之一。
我们注意到 隐蔽代理功能总是会渲染 JavaScript一个更简单的版本正在开发中,应该可以提高响应速度。
用户体验
ScrapingBee之所以广受欢迎,很大程度上归功于其对开发者友好的用户体验。在本节中,我们将介绍ScrapingBee的控制面板、API测试平台和文档。
账号注册
立即开始
ScrapingBee 拥有功能强大的控制面板。 您可以在这里管理订阅、测试 API 调用、跟踪使用情况并获取帮助。目前仅提供英文版本。
ScrapingBee的大部分订阅管理功能在你购买付费套餐之前都是隐藏的。所以,别像我们一样被骗了。
试用版只会显示一个页面,其中列出了可用的定价方案。您可以在那里根据需要升级或降级订阅。设置中的另一个页面允许您在积分用完时启用自动续订(但是 充值不是办法).
订阅后,仪表盘会显示一个 账单详情 页面。 它允许您输入用于接收发票的电子邮件地址、更新您的账单和银行卡信息、取消订阅以及获取发票。但获取发票的功能不太方便,因为您需要先打开一个新窗口才能看到发票。
主设置页面中的帐户信息与账单详情没有任何关系,这就引出了一个问题:为什么需要这些信息? 该平台也缺少集成钱包。 这可以简化充值流程并减少交易次数。总而言之,还有改进的空间。
ScrapingBee 的控制面板包括 多个 API 演示平台:有一个用于通用爬虫的测试环境,每个专用 API 都有自己独立的测试环境。
与我们见过的其他一些实现方式相比(我们已经见过……) 很多), 这个看起来像飞机的驾驶舱。 也就是说,它包含了丰富的设置选项。你甚至可以在提供的字段中编写自己的 JSON 规则。为了降低复杂性,ScrapingBee 提供一系列预配置场景,如 使用提示提取简单数据 截屏 或 从网页中提取链接.
所有测试场地都会生成交互式代码片段。 ScrapingBee 支持八种编程语言,提供两种 SDK,并支持代理模式。他们还会根据您的配置显示积分费用。 允许您实时测试带有目标的请求输出结果包含浏览器预览,以便更轻松地进行可视化解析。
一个相当独特的特点是 能够保存 API 配置以供将来重复使用您可以为这些预配置的请求命名,并将其作为 API 参数调用。
所以,尽管很复杂, ScrapingBee 的 API 测试平台(多个)功能非常强大。.
ScrapingBee 会显示使用统计数据 三个地方.
仪表盘的主页面主要关注货币指标。:其中包括两张图表,分别显示了累计信用额度消耗与信用额度的关系以及每日信用支出。
此 日志与分析 页面上有一个图表,显示了您的请求历史记录,并按 2XX、4XX 和 5XX 响应代码进行分隔。图表下方是…… 包含域级统计信息的表格 其中还显示了请求总数和总成本。另一个表格包含 各个请求的日志包括其确切时间、状态、网址、持续时间和信用成本。
您可以按特定领域和时间段筛选数据。系统预设了从实时到本月的各种时间范围,您也可以指定自定义范围。有趣的是…… 没有截止日期我们可以追溯到 2019 年。这可能会引发有关数据保留的问题,但我们并没有提出过这么长时间的请求。
第三部分展示的是基础设施统计数据: 通用 API 和专用端点的正常运行时间、平均响应时间和过往事件。
文件记录
ScrapingBee 拥有 大量文档 解答您可能遇到的任何问题。第一个资源是醒目展示的资源。 常见问题页面它解答了八个常见问题,其中大部分与计费有关。
更多详细解答请参见…… ScrapingBee 的知识库它分为两部分—— API 和 账单详情 ——其中包含约 50 篇文章。有些问题非常具体,例如“为什么我并非总能获得 ChatGPT 引用?”
然而,你很可能会把大部分时间花在…… 文档页面这是一个庞大的中心平台,列出了所有 API 参数并对其进行了解释,并且 七种编程语言的使用示例和代码示例我们很喜欢这些示例会自动导入您的 API 密钥(如果您已登录),这样您就可以直接将它们粘贴到代码编辑器中。
最后,有 使用教程它们有助于解决特定问题,例如在 Python 中创建重试逻辑、从 Shadow DOM 中提取内容或从表中获取数据。
加起来, ScrapingBee 的文档资源可能是我们目前为止见过的最好的。实践支持
ScrapingBee 提供超过 电子邮件或在线聊天工作时间为周一至周五,上午 10 点至晚上 10 点(UTC+2)。周末无人值守虽然不太理想,但即使是目前的配置也胜过 ScrapingBee 所在细分市场中的许多竞争对手。
我们尝试在欧洲白天使用在线聊天功能。聊天窗口显示有 14 个人在线——超过了 ScrapingBee 团队的一半!——但是 预计回复时间约为45分钟我们只需要留下电子邮件地址,没有聊天机器人或LLM引导我们回答一系列复杂的问题。
在等待期间,我们注意到仪表盘上没有聊天按钮——这是一个令人费解的选择。 救援人员大约10分钟后到达。这非常不错。
结语
使用 ScrapingBee 之后, 我们可以理解为什么这家供应商发展如此迅速。它为热门或安全防护较弱的网站提供卓越的用户体验和极具吸引力的价格。The Bee 也能应对高难度目标——但就像大多数采用积分制的 API 一样,这也会花费不少钱。
但如果你是一名开发人员,想要简化运维工作,而且这项工作并不涉及对 G2 进行工业级爬取或其他类似的棘手问题,那么你会发现自己走上了 ScrapingBee 的快乐之路——而这的确是一条快乐之路。推荐用于:
针对防护较弱的网站进行中小型网络爬虫工作。


