Crawl。 加入免费测试版
爬取整站,并从每一页获取干净数据
发送一个 URL
爬取整站或某个分区
固定月付或按请求计费
免费每月 1,500 次请求
每页干净数据
- HTML
- Markdown
不限量或按请求付费
不限量方案
并发线程
每月请求数
价格 / 月
并发线程价格 / 月每月请求数操作
2
$47
不限量10
$199热门
不限量25
$399
不限量50
$699
不限量100
$1,799
不限量企业版
按你的节奏扩展。可定制合同。
按请求计费方案
这就是我们如何在世界级质量上提供低价格
多数抓取 API 依赖租用供应并采用积分计费,因此账单常常不可预测。我们选择了相反路径,规模效应会不断放大优势。


代码快速开始
将 Geonode Crawl API 接入你的应用,一次任务拉取整站
import requests
r = requests.post(
"https://scraper.geonode.io/v1/extract",
headers={"X-Api-Key": "YOUR_API_KEY", "Content-Type": "application/json"},
json={"url": "https://example.com", "formats": ["markdown"], "processing_mode": "sync"},
)
print(r.json())几秒内开始抓取
创建账号
注册即可获得 500 免费页面起步。无需信用卡

发送请求
通过简单 API 调用把任意 URL 发送到抓取端点

获取干净数据
返回解析后的 HTML 或 Markdown

规模化后升级至不限量
按并发切换到固定月付套餐,或继续按请求计费。无积分,无计量陷阱。

FAQ
使用你的 Geonode API 密钥和要爬取的 URL,向 /v1/crawl 发送 POST 请求。URL 是唯一必填字段;深度、页面上限、输出格式和 JavaScript 渲染等爬取设置均为可选。
每次爬取都会返回唯一的 job_id。用它获取爬取状态,并监控总页数、已完成页数和失败页数,直到任务结束。
可以。你可配置爬取以受支持的输出格式返回提取的页面内容,包括 Markdown。所选格式会应用于该爬取处理的页面。
可以。爬取请求支持代理配置(含国家定向),从而在支持的情况下按所选位置所见内容进行获取。
可以。对于动态网站,可将 JavaScript 渲染与 wait_config 一起使用,控制页面何时可提取,例如等待网络活动结束或特定元素出现。
可以。使用 GET /v1/crawl/jobs 可列出之前的爬取任务。响应包含任务状态、爬取统计、配置详情和分页信息。
