图片解析节点用于提取输入图片的结构化参数。配置解析器后,根据图片内容生成结构化的输出变量,适用于图片内容提取、图片信息统计、图片文本识别等场景。
使用示例
以解析图片并生成内容总结为例,该工作流接收一张图片的 URL,通过图片解析节点提取图片的结构化内容,再由大模型节点生成图片内容总结。
接入节点
方法1:使用+按钮添加
- 将鼠标悬停在画布上任意节点上(如开始节点),节点右侧自动显示 + 按钮。
- 点击 + 按钮,在弹出的节点列表中选择数据图片解析,节点将自动添加到画布并与上游节点建立连线。
方法2:从节点库拖拽添加
- 在左侧节点库中选择数据图片解析。
- 拖拽节点到画布合适位置,从上游节点边缘拖拽连线到图片解析节点。
核心配置
输入
指定待解析的图片,支持直接输入 URL 或引用上游节点变量。通过引用方式下拉框选择输入方式:
| 方式 | 说明 | 使用场景 |
|---|---|---|
| 引用 | 引用上游节点变量 | 图片来自上游节点的 String 类型的 URL 或开始节点的 File 类型文件。 |
| 输入 | 直接输入图片 URL | 图片 URL 固定或从外部获取。 |
- 单文件大小不超过 20 MB
- 支持单文件解析和列表文件解析
- 支持格式:.png、.jpg、.jpeg、.bmp、.gif
解析器选择
指定用于解析图片的解析器,不同解析器适用于不同类型的图片,在解析效果和计费方式上有所差异。
| 解析器类型 | 适用场景 | 计费 | 说明 |
|---|---|---|---|
| 大模型文档解析 | 文档类图片(含文字、表格等) | 暂不计费 | 通过内置大模型实现解析,支持提取文档中的层级树和版面信息,支持输出 Markdown 格式。不支持修改提示词。 |
| Qwen VL解析 | 通用图片(照片、截图、插图等) | 产生 Qwen-VL 系列模型的调用费用 | 调用 Qwen-VL 系列视觉语言模型解析图片,需要自定义提示词来指导解析方向。 |
- 选择模型:
| 选项 | 说明 |
|---|---|
| qwen-vl-max | 属于 Qwen2.5-VL 系列模型,是系列中效果最佳的模型。 |
| qwen-vl-plus | 属于 Qwen2.5-VL 系列模型,速度更快,在效果与成本之间实现良好平衡。 |
- 提示词:用于指导模型解析图片。支持输入/插入变量。
节点输出
图片解析节点根据图片内容输出结构化的解析结果,包含图片数量和按图片组织的解析内容数组。
| 变量名 | 类型 | 说明 |
|---|---|---|
| total | Number | 图片数量 |
| images | Array<Object> | 输出结果数组,每个元素代表一张图片的解析结果。 |
| 字段名 | 类型 | 说明 |
|---|---|---|
| uniqueId | String | 唯一 ID,用于标识每次解析结果。 |
| markdownContent | String | Markdown 格式的内容。大模型文档解析时为提取的文档结构;Qwen VL解析时为 Markdown 格式的图片链接。 |
| text | String | 文本内容。大模型文档解析时为提取的纯文本;Qwen VL解析时通常为空。 |
| llmResult | String | LLM 结果。Qwen VL解析时为模型生成的图片内容描述;大模型文档解析时可能为空。 |
常见用法
| 配合节点 | 常见用法 |
|---|---|
| 开始节点 → 图片解析节点 | 开始节点提供图片文件 URL(String 类型)或图片文件(File 类型),图片解析节点解析图片内容 |
| 图片解析节点 → 大模型节点 | 图片解析节点输出结构化内容(如 images 中的llmResult和markdownContent),大模型节点基于解析结果生成内容总结、回答问题或提取信息 |
| 图片解析节点 → 条件判断节点 | 根据图片解析结果(如图片数量 total、解析内容等)进行条件分支处理 |
| 图片解析节点 → 变量赋值节点 | 提取图片解析结果中的特定字段进行格式转换或数据处理 |