威胁防护是一项企业版功能,按组织开通。如需为您的账户启用此功能,请联系您的 Firecrawl 账户团队。
模式
- 关闭 (默认值) — 不进行任何检查。
- 正常 — URL 会与 Google Web Risk 进行比对;该服务会标记与恶意软件、社会工程攻击 (网络钓鱼) 和有害软件相关的页面和网站。每扫描一个 URL 需消耗 +2 额度。
策略控制
- 自定义黑名单 —— 始终封禁的精确域名或 glob (例如
*.example.com) ,无需调用分类器。 - 自定义白名单 —— 始终允许的精确域名或 glob。白名单优先于所有其他规则,因此你信任的域名绝不会被封禁。
- 封禁的 TLD —— 直接封禁的顶级域名 (例如
zip) ,按标签边界匹配。 - 风险评分阈值 —— 归一化分数 (0–100) ;达到或高于该分数时,分类器的判定会被视为封禁。数值越低,策略越严格。默认值为
75。 - 失败策略 —— 当无法访问分类器时的处理方式:封禁 (
closed,默认值,也是安全控制场景下的推荐设置) 或 允许 (open) 。
配置策略
- 打开 Enterprise Controls → Threat Protection。
- 选择一种模式,设置风险评分阈值,并添加黑名单、白名单或封禁的 TLD 条目。
- 选择是否允许单次请求覆盖,并设置失败策略。
- 保存。更改会立即生效——下一个请求将按新策略进行评估。
单次请求覆盖
threatProtection 对象,因此你可以针对单次请求收紧该次调用的策略 (或者,如果你的组织允许,也可以进行调整) :
threatProtection 对象的请求都会被拒绝,并返回 403——这样管理员就能确保组织策略是每个请求都必须遵守的最低基线。
如果你的团队已强制执行威胁防护,覆盖项仍然可以收紧策略,但不能包含 "mode": "off"——任何试图这样做的请求都会被拒绝,并返回 403。
当 URL 被封禁时
403 失败,并返回一个固定的错误代码:
- Scrape, batch scrape, extract, 代理 — 被封禁的目标会针对该 URL 返回
unsafe_domain_blocked错误。 - Crawl — 被封禁的种子 URL 会导致请求失败;在爬取过程中发现的被封禁链接会被跳过,爬取会继续。
- Search, map — 被封禁的 URL 会从返回结果中移除,而不是返回后再拒绝。
计费
- 如果判定完全基于你自己的策略 (黑名单、白名单或 blocked-TLD 匹配) ,则不会调用分类器,因此不会收取扫描费用。
- 即使请求被封禁,生成该判定结果的扫描仍会照常收费。
- 在单次抓取中,扫描会去重:如果重定向复检最终解析到同一个 URL,则会复用原始扫描;而落到不同 URL 的重定向则算作第二次扫描。
- 抓取和批量抓取会独立检查每个页面。判定结果绝不会在页面之间复用——不会存储任何与你的流量有关的信息 (见上文) ——因此在 正常 模式下,预计会按每个抓取页面额外 +2 额度收费。在抓取过程中发现并被封禁的链接,无论有多少页面链接到它,每次抓取都只会对其扫描收费一次。
- 搜索和 map会在每次请求中对结果集里的每个唯一 URL 扫描一次,因此它们的扫描费用会随扫描结果数量增加——当结果因你的
limit被截断时,这个数量可能会略高于最终返回的结果数。
错误参考
说明
- 该策略在整个组织范围内生效:会自动应用于每个 API 密钥和每个端点。
- 白名单始终优先生效,因此位于被明确设为受信任域名上的 URL 绝不会被分类器或 TLD 规则封禁。
- 错误代码
unsafe_domain_blocked会保持稳定以确保兼容性,尽管检查是在 URL 级别进行的。 - 当失败策略设为
closed(默认值) 时,如果分类器发生故障,受影响的请求会被封禁,而不会被默认放行。

