Skip to main content
工作流

图片解析节点

图片解析节点用于提取输入图片的结构化参数。配置解析器后,根据图片内容生成结构化的输出变量,适用于图片内容提取、图片信息统计、图片文本识别等场景。

使用示例

以解析图片并生成内容总结为例,该工作流接收一张图片的 URL,通过图片解析节点提取图片的结构化内容,再由大模型节点生成图片内容总结。

接入节点

方法1:使用+按钮添加

  • 将鼠标悬停在画布上任意节点上(如开始节点),节点右侧自动显示 + 按钮。
  • 点击 + 按钮,在弹出的节点列表中选择数据图片解析,节点将自动添加到画布并与上游节点建立连线。

方法2:从节点库拖拽添加

  • 在左侧节点库中选择数据图片解析。
  • 拖拽节点到画布合适位置,从上游节点边缘拖拽连线到图片解析节点。

核心配置

输入

指定待解析的图片,支持直接输入 URL 或引用上游节点变量。通过引用方式下拉框选择输入方式:
方式说明使用场景
引用引用上游节点变量图片来自上游节点的 String 类型的 URL 或开始节点的 File 类型文件。
输入直接输入图片 URL图片 URL 固定或从外部获取。
限制说明:
  • 单文件大小不超过 20 MB
  • 支持单文件解析和列表文件解析
  • 支持格式:.png、.jpg、.jpeg、.bmp、.gif

解析器选择

指定用于解析图片的解析器,不同解析器适用于不同类型的图片,在解析效果和计费方式上有所差异。
解析器类型适用场景计费说明
大模型文档解析文档类图片(含文字、表格等)暂不计费通过内置大模型实现解析,支持提取文档中的层级树和版面信息,支持输出 Markdown 格式。不支持修改提示词。
Qwen VL解析通用图片(照片、截图、插图等)产生 Qwen-VL 系列模型的调用费用调用 Qwen-VL 系列视觉语言模型解析图片,需要自定义提示词来指导解析方向。
选择 Qwen VL 解析后,需要配置以下子项:
  • 选择模型
选项说明
qwen-vl-max属于 Qwen2.5-VL 系列模型,是系列中效果最佳的模型。
qwen-vl-plus属于 Qwen2.5-VL 系列模型,速度更快,在效果与成本之间实现良好平衡。
  • 提示词:用于指导模型解析图片。支持输入/插入变量。

节点输出

图片解析节点根据图片内容输出结构化的解析结果,包含图片数量和按图片组织的解析内容数组。
变量名类型说明
totalNumber图片数量
imagesArray<Object>输出结果数组,每个元素代表一张图片的解析结果。
images 数组元素结构:
字段名类型说明
uniqueIdString唯一 ID,用于标识每次解析结果。
markdownContentStringMarkdown 格式的内容。大模型文档解析时为提取的文档结构;Qwen VL解析时为 Markdown 格式的图片链接。
textString文本内容。大模型文档解析时为提取的纯文本;Qwen VL解析时通常为空。
llmResultStringLLM 结果。Qwen VL解析时为模型生成的图片内容描述;大模型文档解析时可能为空。
下游节点可以根据不同的解析器输出选择合适的字段引用:使用大模型文档解析时主要引用markdownContent和text获取文档内容;使用 Qwen VL 解析时主要引用llmResult获取图片描述。

常见用法

配合节点常见用法
开始节点 → 图片解析节点开始节点提供图片文件 URL(String 类型)或图片文件(File 类型),图片解析节点解析图片内容
图片解析节点 → 大模型节点图片解析节点输出结构化内容(如 images 中的llmResult和markdownContent),大模型节点基于解析结果生成内容总结、回答问题或提取信息
图片解析节点 → 条件判断节点根据图片解析结果(如图片数量 total、解析内容等)进行条件分支处理
图片解析节点 → 变量赋值节点提取图片解析结果中的特定字段进行格式转换或数据处理

常见问题

为什么大模型文档解析返回空的 images 数组?

大模型文档解析专为文档类图片设计。如果输入的是照片、插图等非文档类图片,解析器无法从中提取文档结构化信息,因此会返回total=1(表示检测到 1 张图片)但images为空数组。此时应改用 Qwen VL 解析。