Skip to main content

产品简介

智谱文件解析 API 是一款面向开发者和企业的统一文件解析解决方案,实现了多格式文件解析、智能内容抽取、灵活结果输出的一站式服务。 该 API 支持主流办公文档(PDF、Word、Excel、PPT)、结构化/非结构化数据文件(CSV、MD、TXT)以及多种图片格式(JPG、PNG等),能够快速提取文件中的文本、表格、图片和版面结构,生成标准化输出,便于直接接入下游业务系统或大模型处理链路。

应用场景

将PDF、Word、PPT等复杂文档解析为结构化文本或Markdown,减少手工清洗,直接作为大模型输入,提升问答与推理效果。典型应用: 智能问答系统、文档对话、内容生成等。

能力支持

多样化解析能力整合

一套API选择三种解析服务

多格式文件支持

涵盖主流文档及图片格式

多输出方式

• 下载链接:图片 + Markdown 文件 + 包含布局信息的json文件
• 纯文本:适配大模型输入

文件大小灵活支持

不同服务最大可支持至 100M 文件

下载时效

解析结果下载有效期 24 小时

解析服务对比

服务类型支持格式最大文件大小解析结果计费方式核心优势
Primepdf,docx,doc,xls
xlsx,ppt,pptx,png
jpg,jpeg,csv,txt
md,html,bmp
gif,webp,heic,eps
icns,im,pcx,ppm
tiff,xbm,heif,jp2
PDF/DOC/DOCX/PPT ≤100MB
XLS/XLSX/CSV ≤10MB
PNG/JPG/JPEG ≤20MB
图片 + Markdown 文件
+ 包含布局信息的
json文件
按解析页数消耗后付费
优惠后0.12 元/页
- 适配双栏、混排、三栏等复杂版式
- 高精度解析图文、公式、表格等元素
- 多模态能力强,适合高要求解析场景
Expertpdf≤100M图片 + Markdown 文件按页数计费,限时 6 折优惠
优惠后0.012 元/页
- PDF、图片解析能力突出
- 表格与公式识别精度高
- 多领域表现稳定,兼顾精度与成本
Litepdf,docx,doc,xls
xlsx,ppt,pptx,png
jpg,jpeg,csv,txt,md
≤50M纯文本(无图片)按调用次数计费
当前免费
- 支持常见办公文档解析
- 基础结构化能力完备,解析速度快
- 成本低,适合批量处理与轻量任务

解析耗时

解析时长与文档结构复杂度等因素密切相关,最终耗时以实际解析结果为准。

使用资源

接口文档:API 调用方式 接口使用方法
  1. 调用接口创建解析任务,获取 task_id
  2. 保存并记录下 task_id
  3. 使用该 task_id 轮询查询接口,获取解析结果。
字段属性
字段名称字段描述
file本地待解析文件
tool_type使用的解析工具类型: lite, expert, prime
file_type文件类型: PDF, DOCX, DOC, XLS, XLSX, PPT, PPTX, PNG, JPG, JPEG, CSV, TXT, MD, HTML, EPUB, BMP, GIF, WEBP, HEIC, EPS, ICNS, IM, PCX, PPM, TIFF, XBM, HEIF, JP2
taskId文件解析任务 ID
format_type结果返回格式类型: text, download_link

调用示例

调用示例里面的参数属性参考上方字段属性和对应的 API 文档。

创建文件解析任务

创建文件解析任务
curl --location --request POST 'https://open.bigmodel.cn/api/paas/v4/files/parser/create' \
--header  'Authorization: Bearer YOUR_API_KEY' \
--form 'file=@example-file' \
--form 'tool_type="prime"' \
--form 'file_type="PDF"'
异步获取解析结果
curl --request GET \
--url https://open.bigmodel.cn/api/paas/v4/files/parser/result/{taskIid}/{format_type} \
--header 'Authorization: Bearer YOUR_API_KEY'

注意事项

  • 文件大小限制: 避免超出最大支持文件导致解析失败
  • 优先选择适合场景的服务: 复杂文档选择对应服务
  • 下载结果后及时保存: 下载链接 24 小时后失效
  • 如需大模型处理: 建议直接获取纯文本输出

常见问题

Q:解析结果能保留原始图片吗? A:Prime 与 Expert 支持图片保留(打包下载),Lite 服务不保留图片。 Q:下载链接失效怎么办? A:需重新调用解析API生成新链接。 Q:为什么我的复杂 PDF 解析效果不好? A:Lite 服务不适合复杂排版和 OCR 场景,请使用 Prime 服务或 Expert 服务。