产品简介
智谱文件解析 API 是一款面向开发者和企业的统一文件解析解决方案,实现了多格式文件解析、智能内容抽取、灵活结果输出的一站式服务。 该 API 支持主流办公文档(PDF、Word、Excel、PPT)、结构化/非结构化数据文件(CSV、MD、TXT)以及多种图片格式(JPG、PNG等),能够快速提取文件中的文本、表格、图片和版面结构,生成标准化输出,便于直接接入下游业务系统或大模型处理链路。
应用场景
- 大模型前置解析
- 知识库构建管理
- OCR识别及扫描件处理
- 行业垂直解决方案
将PDF、Word、PPT等复杂文档解析为结构化文本或Markdown,减少手工清洗,直接作为大模型输入,提升问答与推理效果。典型应用: 智能问答系统、文档对话、内容生成等。
能力支持
多样化解析能力整合
一套API选择三种解析服务
多格式文件支持
涵盖主流文档及图片格式
多输出方式
• 下载链接:图片 + Markdown 文件 + 包含布局信息的json文件
• 纯文本:适配大模型输入
• 纯文本:适配大模型输入
文件大小灵活支持
不同服务最大可支持至 100M 文件
下载时效
解析结果下载有效期 24 小时
解析服务对比
| 服务类型 | 支持格式 | 最大文件大小 | 解析结果 | 计费方式 | 核心优势 |
|---|---|---|---|---|---|
| Prime | pdf,docx,doc,xls xlsx,ppt,pptx,png jpg,jpeg,csv,txt md,html,bmp gif,webp,heic,eps icns,im,pcx,ppm tiff,xbm,heif,jp2 | PDF/DOC/DOCX/PPT ≤100MB XLS/XLSX/CSV ≤10MB PNG/JPG/JPEG ≤20MB | 图片 + Markdown 文件 + 包含布局信息的 json文件 | 按解析页数消耗后付费 优惠后0.12 元/页 | - 适配双栏、混排、三栏等复杂版式 - 高精度解析图文、公式、表格等元素 - 多模态能力强,适合高要求解析场景 |
| Expert | ≤100M | 图片 + Markdown 文件 | 按页数计费,限时 6 折优惠 优惠后0.012 元/页 | - PDF、图片解析能力突出 - 表格与公式识别精度高 - 多领域表现稳定,兼顾精度与成本 | |
| Lite | pdf,docx,doc,xls xlsx,ppt,pptx,png jpg,jpeg,csv,txt,md | ≤50M | 纯文本(无图片) | 按调用次数计费 当前免费 | - 支持常见办公文档解析 - 基础结构化能力完备,解析速度快 - 成本低,适合批量处理与轻量任务 |
解析耗时
解析时长与文档结构复杂度等因素密切相关,最终耗时以实际解析结果为准。使用资源
接口文档:API 调用方式 接口使用方法- 调用接口创建解析任务,获取
task_id; - 保存并记录下
task_id; - 使用该
task_id轮询查询接口,获取解析结果。
| 字段名称 | 字段描述 |
|---|---|
| file | 本地待解析文件 |
| tool_type | 使用的解析工具类型: lite, expert, prime |
| file_type | 文件类型: PDF, DOCX, DOC, XLS, XLSX, PPT, PPTX, PNG, JPG, JPEG, CSV, TXT, MD, HTML, EPUB, BMP, GIF, WEBP, HEIC, EPS, ICNS, IM, PCX, PPM, TIFF, XBM, HEIF, JP2 |
| taskId | 文件解析任务 ID |
| format_type | 结果返回格式类型: text, download_link |
调用示例
调用示例里面的参数属性参考上方字段属性和对应的 API 文档。
创建文件解析任务
- cURL
- Python
- Python(旧)
- Java
- 响应示例
创建文件解析任务异步获取解析结果
注意事项
- 文件大小限制: 避免超出最大支持文件导致解析失败
- 优先选择适合场景的服务: 复杂文档选择对应服务
- 下载结果后及时保存: 下载链接 24 小时后失效
- 如需大模型处理: 建议直接获取纯文本输出