AI 识图
AI 识图 用于将图片内容自动识别为结构化信息。它可以根据你的识别要求,描述图片中的物体、动作、场景或提取文字,结果以文本形式返回,供后续节点使用。
指令标识:ImageRecognizeTask
指令类型:数据处理指令
指令描述:将图片内容智能识别为结构化信息
先选使用方式
Section titled “先选使用方式”工作流支持「可视化编排」和「代码编排」两种创建方式。AI 识图 是 AI 处理节点,核心是「图片」与「识别要求」,主要通过可视化编排配置。
| 方式 | 怎么用 | 适合人群 |
|---|---|---|
| 可视化编排(推荐) | 拖入「AI 识图」节点,上传图片或填写图片地址,并填写识别要求 | 大多数用户,零代码,适合快速搭建 |
| 代码编排(执行指令 XML) | 通过 执行指令 节点动态传入参数调用 | 需要动态生成或批量复用流程的用户 |
什么时候用?
Section titled “什么时候用?”- 内容审核与合规检测:识别图片中的违规内容、敏感信息。
- 智能检索与标签生成:识别图片中的物体、场景、文字,用于打标签、聚合。
- 辅助分析与业务流程:为数据分析、报表生成等提供图片识别能力。
- 在智能体工作流中自动识别图片内容,实现流程自动化。
- 图片来源已准备好:可用本地文件、图片内容或公开可访问的图片 URL。
- 图片清晰、无损坏,建议使用 JPG、PNG 等常见格式。
- 根据需求填写具体的识别要求(指令内容),描述越具体效果越好。
可视化编排:从 0 到跑通
Section titled “可视化编排:从 0 到跑通”下面用一个常见场景演示:识别一张图片中的动物种类、动作和场景。按 4 步即可跑起来:
- 在工作流画布中添加 AI 识图 指令。
- 上传图片,或在 图片URL 中填写图片地址,例如:
https://example.com/images/dog-ball.jpg- 在 指令内容 中填写识别要求,例如「识别图片中的动物种类、动作和场景」。
- 在 将结果保存至 填写输出变量名(如
img_answer),运行后即可引用识别结果。
运行后输出结果示例:
这张图片展示了一只比格犬正在户外草地上跳跃,试图用嘴接住一个黄色网球,背景是模糊的公园场景,整体氛围活泼。| 界面名称 | 代码属性名 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|---|
| 图片 | - | String | 是 | - | 需要识别的图片内容,支持本地文件路径、图片内容或图片 URL。 |
| 指令内容 | content | String | 否 | - | 填写需要识别的内容,例如识别图片中的物体、文字、场景等。 |
| 图片URL | imageUrl | String | 否 | - | 图片的网络访问地址(可选)。 |
| 是否发送消息 | sendMsgFlag | Boolean | 否 | false | 识别完成后是否发送通知消息。 |
| 界面名称 | 代码属性名 | 类型 | 必填 | 说明 |
|---|---|---|---|---|
| 将结果保存至 | outKey | String | 是 | 保存识别结果内容(示例变量名 img_answer)。 |
- 节点运行状态为成功。
- 输出变量中包含对图片内容的识别描述或提取文本。
- 识别结果与「指令内容」中提出的要求一致。
| 现象 / 报错原文 | 可能原因 | 处理建议 |
|---|---|---|
| 报图片无法读取 | 图片来源无效或 URL 不可访问 | 确认图片真实有效、URL 公开可访问 |
| 识别结果偏差大 | 指令内容笼统、图片不清晰 | 明确识别要求,更换清晰图片 |
| 输出为空 | 图片内容过于复杂或无可识别内容 | 调整识别要求,或更换更合适的图片 |
Python 代码编排
Section titled “Python 代码编排”该节点主要通过可视化编排使用。如需在流程中动态编排,可使用 执行指令(XML)节点传入参数调用,无需手写 Python 方法。
AI 识图是 AI 处理节点,推荐在可视化画布中直接配置图片来源与识别要求。若需要在流程中动态传入图片地址、批量复用,可以通过 执行指令 节点,按「图片URL(imageUrl)/ 指令内容(content)/ 是否发送消息(sendMsgFlag)/ 输出变量(outKey)」的对应关系传参调用。
Q1:支持哪些图片类型和来源?
Section titled “Q1:支持哪些图片类型和来源?”A: 支持 JPG、PNG 等常见格式,可通过本地文件、图片内容或图片 URL 提供,建议使用清晰、无损坏的图片。
Q2:指令内容如何填写效果更好?
Section titled “Q2:指令内容如何填写效果更好?”A: 建议填写具体识别目标,如「识别图片中的动物种类、动作和场景」或「提取图片中的文字内容」,描述越具体识别效果越好。
Q3:识别结果如何获取和使用?
Section titled “Q3:识别结果如何获取和使用?”A: 识别结果保存在指定的输出变量(如 img_answer)中,可用于后续流程判断、内容展示、自动化处理等。