01
渲染内容
当页面需要 JavaScript 渲染且简单获取不足时,可使用浏览器级采集。
Fetch 通过 XSARPI 共享采集栈将公开 URL 转换为渲染内容和干净 Markdown。任务状态保持可见,当返回内容无法验证时可以明确失败。
可用性和限制取决于账户、环境、目标来源以及当前产品文档中的配置。
POST /api/v1/fetch
{
"url": "https://example.com"
}{
"status": "queued",
"job_id": "...",
"artifacts": { "markdown": "..." }
}能力
Fetch 获取内容并暴露任务状态,而不是假设所有公开页面都同样容易访问。
当页面需要 JavaScript 渲染且简单获取不足时,可使用浏览器级采集。
生成干净 Markdown 与内容产物,用于分析、检索、提取或存储工作流。
被阻断、空内容、低内容或其他无效结果可以保持失败状态,而不是伪装成功。
工作流程
将采集与验收分开,页面响应不会自动变成可信业务数据。
发送目标 URL 与支持的选项。
在任务边界内使用配置的 HTTP、浏览器和代理感知路径。
接受产物前检查响应状态和内容质量。
把通过验收的内容送入提取、分析、存储或 AI 工作流。
使用场景
在分块和索引之前获取最新来源内容。
采集已批准公开数据源作为结构化研究的输入。
创建可重复快照,为变化检测逻辑提供输入。
常见问题
用 Fetch 完成采集,再根据消费该数据的工作流验证并结构化结果。