Crawlbase 是独立服务,与 Tripadvisor, Inc. 无关联,亦未获其赞助或认可。此处使用 TripAdvisor 名称仅为说明与公开页面的兼容性。
输入任意 URL,输出 HTML 或 JSON。
Crawling API 实时演示。获取渲染后的 HTML,或切换到 generic extractor 获取 JSON。悬停即可暂停阅读。
一个 API,应对点评网站抛给你的一切。
旅行点评网站高度依赖 JavaScript 且极易封锁。Crawling API 在真实浏览器中渲染页面,通过住宅 IP 访问,并向你交付干净的 HTML 或 JSON。
完整 JavaScript 渲染
真实浏览器执行页面,因此动态加载的评论、评分、照片和价格组件都会被捕获,而不仅仅是初始 HTML。
1.4 亿住宅 IP
每个请求都会在 30 个地区间轮换住宅 IP,让你像真实的本地访客一样访问该网站。
封锁问题为你处理
CAPTCHA、机器人拦截墙和速率限制都会被自动清除。无需破解,无需维护。
HTML 或 JSON
获取完整渲染的 HTML,或添加 scraper=generic-extractor,即可将标题、内容、图片和链接以结构化 JSON 返回。
截图与异步
同一个调用可以捕获整页截图,或通过 webhook 和云存储异步运行。
渲染后的 HTML,或干净的 JSON。
默认情况下你会获得渲染后的 HTML。添加 generic-extractor,同一个页面即以类型化 JSON 返回。
页面
title · string canonical · string favicon · string
元数据
meta.description · string meta.keywords · string
内容
content · string
媒体
images · array og_images · array
链接
links · array
从 URL 到数据,只需一次调用。
每个请求都走同一条路径。你发送一个 URL,其间的一切由我们运行。
发送 URL
带上你的令牌传入任意公开的点评页面 URL:酒店、餐厅、景点或城市列表页。
轮换代理
从横跨 30 个地区的 1.4 亿 IP 中选取一个能顺畅访问该网站的住宅 IP 和地区。
渲染页面
真实浏览器加载页面,让评分、评论文本、照片和价格组件在捕获前完成渲染。
清除反爬
该网站的机器人检测和速率限制会被自动处理,地理定向返回本地结果。无需破解,无需维护。
返回 HTML 或 JSON
返回完整渲染的 HTML,或在你添加 generic extractor 时返回类型化 JSON。
团队用旅行点评数据构建什么。
评论与声誉监测
跟踪酒店、餐厅和景点的评分、评论文本和回复,长期观察声誉变化。
旅游与酒店业数据聚合
将列表、照片、设施和价格聚合到你自己的旅游和预订产品中。
竞争对手基准对比
将评分、评论量和定价与同一市场中的竞争物业进行比较。
情感分析
挖掘评论语言以评估情感、发现常见投诉并识别反复出现的主题。
房价与价格跟踪
跨城市和日期监测房价与可用性,为营收和定价决策提供依据。
AI 与旅行智能体
通过一个 API 将干净的点评文本输入模型、RAG 流程和旅行智能体。
抓取 TripAdvisor 时值得了解的事项。
像真实浏览器一样渲染
TripAdvisor 高度依赖 JavaScript;Crawling API 运行真实浏览器,让评论、评分、照片和价格组件在捕获前加载完成。
默认 HTML,按需 JSON
你会获得完整渲染的 HTML。添加 scraper=generic-extractor 即可获得解析后的标题、内容、图片和链接,或自行解析 HTML。
横跨 30 个地区的本地结果
地理定向返回本地访客所见的列表、评分和价格,因此酒店和餐厅数据与所选市场相匹配。
仅限公开页面
Crawling API 读取公开可见的页面,无需登录,因此你获得的是未登录访客所见的内容。
为大规模爬取点评网站而生。
Crawling API 运行在同一张网络之上,该网络服务着 46,000+ 付费客户和 70,000+ 开发者。无需购买代理,无需运行浏览器,网站变更时也无需修补任何东西。
一个令牌,面向 Python、Node 和 Ruby 的官方 SDK,以及底层 99.99% 正常运行时间的网络。