现已可用FETCH API

获取页面。返回真正可用的内容。

Fetch 通过 XSARPI 共享采集栈将公开 URL 转换为渲染内容和干净 Markdown。任务状态保持可见,当返回内容无法验证时可以明确失败。

渲染页面采集
干净 Markdown + 来源元数据
有边界重试与采集回退

Fetch 具有当前生产证据

可用性和限制取决于账户、环境、目标来源以及当前产品文档中的配置。

接口
/api/v1/fetch
输入
一个或多个公开 URL
输出
任务状态 + 内容产物
请求示例
POST /api/v1/fetch
{
  "url": "https://example.com"
}
预期响应结构
{
  "status": "queued",
  "job_id": "...",
  "artifacts": { "markdown": "..." }
}

能力

实用的数据采集基础能力

Fetch 获取内容并暴露任务状态,而不是假设所有公开页面都同样容易访问。

01

渲染内容

当页面需要 JavaScript 渲染且简单获取不足时,可使用浏览器级采集。

02

标准化输出

生成干净 Markdown 与内容产物,用于分析、检索、提取或存储工作流。

03

失败关闭

被阻断、空内容、低内容或其他无效结果可以保持失败状态,而不是伪装成功。

工作流程

Fetch 如何进入数据工作流

将采集与验收分开,页面响应不会自动变成可信业务数据。

01

提交

发送目标 URL 与支持的选项。

02

采集

在任务边界内使用配置的 HTTP、浏览器和代理感知路径。

03

验证

接受产物前检查响应状态和内容质量。

04

使用

把通过验收的内容送入提取、分析、存储或 AI 工作流。

使用场景

常见 Fetch 工作流

RAG 摄取

在分块和索引之前获取最新来源内容。

自动化研究

采集已批准公开数据源作为结构化研究的输入。

监测基础

创建可重复快照,为变化检测逻辑提供输入。

常见问题

从数据源开始,保留证据。

用 Fetch 完成采集,再根据消费该数据的工作流验证并结构化结果。