核心能力
多格式解析
PDF、Office、网页等常见格式统一解析
结构保留
标题层级、列表、表格结构完整还原
干净输出
输出 Markdown 或 JSON,模型可直接消费
批量处理
支持大批量文档异步处理与进度回调
适用场景
- 企业文档入库前的清洗与结构化
- 网页内容的合规抓取与正文提取
- 合同、报告等长文档的要点抽取
接入方式
上传文件或提交 URL,同步小任务即时返回,大任务异步回调。
PDF、Office、网页等常见格式统一解析
标题层级、列表、表格结构完整还原
输出 Markdown 或 JSON,模型可直接消费
支持大批量文档异步处理与进度回调
上传文件或提交 URL,同步小任务即时返回,大任务异步回调。