crawlbase文档
登录

API 用法

Crawling API 请求中添加 &scraper=reddit-serp。在 url 参数中对目标 URL 进行 URL 编码。

curl 'https://api.crawlbase.com/?token=YOUR_TOKEN' \
  --data-urlencode 'url=https://www.reddit.com/search/?q=web+scraping' \
  --data-urlencode 'scraper=reddit-serp' -G
from crawlbase import CrawlingAPI

api = CrawlingAPI({'token': 'YOUR_TOKEN'})
res = api.get(
    'https://www.reddit.com/search/?q=web+scraping',
    {'scraper': 'reddit-serp'}
)

import json
data = json.loads(res['body'])
const { CrawlingAPI } = require('crawlbase');
const api = new CrawlingAPI({ token: 'YOUR_TOKEN' });

const res = await api.get(
  'https://www.reddit.com/search/?q=web+scraping',
  { scraper: 'reddit-serp' }
);
const data = JSON.parse(res.body);
require 'crawlbase'
api = Crawlbase::API.new(token: 'YOUR_TOKEN')

res = api.get('https://www.reddit.com/search/?q=web+scraping', scraper: 'reddit-serp')
data = JSON.parse(res.body)

示例输入 URL

传入 url 参数的 URL(为便于阅读已 URL 解码):

https://www.reddit.com/search/?q=web+scraping

响应结构

JSON 响应体。当源页面省略对应值时,字段类型可能为 null

query
string
产生这些结果的搜索查询。
sort
string
应用于搜索的排序方式(例如 relevancenewtop)。
time
string
应用于搜索的时间范围(例如 alldayweek)。
restrictSubreddit
boolean
当搜索限定在单个子版块内时为 true。
resultCount
integer
results 中返回的结果数量。
pagination
object
用于下一页和上一页的分页游标。
pagination.next_page_url
string | null
下一页结果的 URL,如果是最后一页则为 null。
pagination.previous_page_url
string | null
上一页结果的 URL,如果是第一页则为 null。
pagination.has_next
boolean
当有下一页可用时为 true。
results
array
搜索结果,按排名顺序排列。
results[].position
integer
结果在返回列表中的位置(从 1 开始)。
results[].id
string
帖子的 Reddit 全名(例如 t3_...)。
results[].title
string
帖子标题。
results[].url
string
结果在 Reddit 上的 URL。
results[].author
string
帖子作者的用户名。
results[].subreddit
string
帖子所属的子版块(不含 r/ 前缀)。
results[].score
integer
帖子得分(顶数减去踩数)。
results[].commentsCount
integer
帖子的评论数量。
results[].createdAt
string
帖子创建时间(ISO 8601)。
results[].linkUrl
string
帖子指向的外部链接。
results[].domain
string
外部链接的域名。
subreddits
array
与结果一同呈现的相关子版块。
subreddits[].name
string
子版块名称(不含 r/ 前缀)。
subreddits[].url
string
规范的子版块 URL。
subreddits[].subscribers
integer | null
子版块的订阅者数量。
subreddits[].description
string | null
子版块的简短描述。

示例响应

{
  "query": "web scraping",
  "sort": "relevance",
  "time": "all",
  "restrictSubreddit": false,
  "resultCount": 2,
  "pagination": {
    "next_page_url": "https://old.reddit.com/search?q=web+scraping&count=25&after=t3_1c7aaaa",
    "previous_page_url": null,
    "has_next": true
  },
  "results": [
    {
      "position": 1,
      "id": "t3_1c7aaaa",
      "title": "What is the most reliable way to do web scraping at scale in 2026?",
      "url": "https://old.reddit.com/r/webdev/comments/1c7aaaa/what_is_the_most_reliable_way_to_do_web_scraping/",
      "author": "datawrangler",
      "subreddit": "webdev",
      "score": 486,
      "commentsCount": 133,
      "createdAt": "2026-06-30T14:22:10+00:00",
      "linkUrl": "https://old.reddit.com/r/webdev/comments/1c7aaaa/what_is_the_most_reliable_way_to_do_web_scraping/",
      "domain": "old.reddit.com"
    }
  ],
  "subreddits": [
    {
      "name": "webscraping",
      "url": "https://old.reddit.com/r/webscraping/",
      "subscribers": 84210,
      "description": "A community for web scraping, crawling and data extraction."
    }
  ]
}