新OpenCode
开源的AI编程助手,助力开发者高效编码。
https://api.xcrawl.com/v1/crawlAuthorization: Bearer <你的API Key>{
"url": "https://example.com/product-page",
"output_format": "json",
"fields": ["title", "price", "description"]
}
url:必填,目标网页完整 URLoutput_format:可选,json / markdown / serp,默认 jsonfields:可选,指定要提取的字段名称(仅 JSON 模式有效){
"status": "success",
"data": {
"title": "产品名称",
"price": "¥99.00",
"description": "产品描述文本"
},
"metadata": {
"url": "https://example.com/product-page",
"crawled_at": "2025-04-01T10:30:00Z"
}
}
markdown,data 字段返回纯文本 Markdown 内容serp,data 字段返回搜索引擎结果页的结构化数据url 改为数组,如 ["url1", "url2"]errors 数组中列出| 问题 | 原因 | 解决方案 |
|---|---|---|
| 返回数据为空 | 字段名与页面实际元素不匹配 | 使用浏览器开发者工具检查页面 DOM,确认字段名正确 |
| 返回 HTML 片段 | 页面结构复杂,自动提取失败 | 切换为 markdown 模式,或手动指定更精确的 CSS 选择器 |
| 请求超时 | 目标页面加载慢或资源阻塞 | 添加 timeout 参数(单位秒,默认 30),或使用异步模式 |
| 数据不一致 | 页面内容动态变化 | 使用 cache 参数控制缓存策略,或指定抓取时间窗口 |
robots.txt 规则,避免法律风险本站此刻AI提供的XCrawl都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由此刻AI实际控制,在4 8 月, 2026 8:13 上午收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,此刻AI不承担任何责任。
