Appearance
知识库写入节点
知识库写入节点把一个文件写入指定知识库,并按节点中配置的解析与分段策略处理文档。适合用户上传资料、业务文档归档、动态扩充问答资料等场景。
当前实现一次只能选择一个目标知识库,输入参数固定为 File 类型的 knowledge。如果要连续写入多个文件,应在批处理或循环中逐个执行节点。
当前功能与旧文档差异
旧文档同时介绍了直接写入 String、Array<Object>、指定知识库文档、标签及固定第三方接口 QPS 等能力。当前工作流编辑器没有提供这些配置:
knowledge的名称和 File 类型均被锁定,不能改成 String 或 Array<Object>。- 当前节点按“选择一个知识库 + 写入一个文件”配置,不提供“写入指定文档”模式。
- 当前面板没有标签编辑区域,也不展示旧文档中的固定接口限流值。
- 知识库选择器提供“资源库知识库”和“企业知识库”入口;企业知识库只应选择具备上传能力的目标。
因此,本文只描述当前界面和当前提交数据实际支持的配置。
配置示例
本示例使用开始节点的 File 输入 uploadFile,把运行时传入的文件写入 java知识库。

示例采用当前默认的数据写入设置:精准解析、自定义分段、换行切分、最大长度 1000、重叠度 0.1。

输入
| 参数 | 类型 | 当前要求 |
|---|---|---|
knowledge | File | 必填。可以在节点中上传固定文件,也可以引用开始节点或上游节点产生的 File 变量。参数名称和类型不可修改。 |
只在当前工作流中处理文本内容时,不要直接把 String 变量映射给本节点。应先生成或上传 File 类型数据,再进行知识库写入。
选择目标知识库
打开“选择知识库”后,可以从以下来源选择目标:
- 资源库知识库:当前工作空间的 AIOS 知识库。
- 企业知识库:企业知识库树中具备上传能力的知识库。
一个节点最多选择一个目标。当前选择器可按文档、表格、图片分类筛选,但节点的数据写入设置以文档解析与分段为核心;选择非文档类型前,应确认目标知识库和运行服务确实支持对应文件格式。
目标知识库为空时,工作流校验会提示选择知识库。
文档解析策略
快速解析
不提取图片、扫描件或表格等元素,适合内容结构简单、主要由纯文本构成并且希望尽快完成解析的文件。
精准解析
从文档中提取更多结构化元素,解析耗时通常更长。当前可配置:
| 选项 | 作用 |
|---|---|
| 图片元素 | 提取文档中的图片元素。 |
| 扫描件(OCR) | 对扫描图片中的文字进行识别。选择自定义分段时当前界面会禁用该选项。 |
| 表格元素 | 提取文档中的表格元素。 |
新建节点默认选择精准解析,并默认开启图片元素和表格元素。OCR 默认关闭。
分段策略
自动分段
由系统按内容段落自动切分。选择后不再显示自定义分隔符、最大长度和重叠度配置。
自定义分段
当前默认策略。可以控制切分边界和片段上下文:
| 配置 | 当前范围与默认值 |
|---|---|
| 分段标识符 | 支持换行、空行、句号和自定义;默认换行。 |
| 自定义标识符 | 选择“自定义”时必填,空值无法通过工作流校验。 |
| 分段最大长度 | 100~5000,默认 1000。 |
| 分段重叠度 | 0~0.9,步长 0.01,默认 0.1。 |
片段过大会混入无关内容,片段过小则可能丢失上下文。结构清晰的说明文档可先使用换行或空行切分,再根据实际召回结果调整最大长度和重叠度。
输出
节点固定输出以下只读参数:
| 输出 | 类型 | 说明 |
|---|---|---|
documentId | String | 写入后生成的知识库文档标识。更新、删除或建立业务映射时应保存该值。 |
fileName | String | 写入文件的名称。 |
fileUrl | String | 写入文件对应的访问地址。 |
不要只依赖文件名定位文档:不同用户或不同批次可能上传同名文件,后续删除操作应优先使用 documentId。
精准解析和索引可能需要时间。节点已经返回文档信息,不代表下一个知识库检索节点一定能立即召回新内容;需要“写入后立刻检索”的流程应设计状态确认、延迟或有上限的重试。
工作流校验
保存或发布前,编辑器会检查:
knowledge已绑定固定文件或 File 类型变量。- 已选择目标知识库。
- 使用自定义分段标识符时,标识符内容不为空。
常见问题
能否直接写入一段 String 文本?
当前节点不支持。knowledge 被固定为 File 类型;旧文档中 String 和 Array<Object> 的写入方式不适用于当前编辑器。
为什么精准解析中的 OCR 不可选?
当前实现会在“精准解析 + 自定义分段”组合下禁用 OCR。切换为自动分段后,OCR 才可以按需开启。
一次能写入多个文件吗?
不能。输入是单个 File。需要批量写入时,使用批处理或循环节点逐个调用知识库写入节点,并为失败项设计独立记录与重试。
为什么写入成功后立即检索不到?
文件上传后仍可能经历解析、分段和索引过程,精准解析尤其可能耗时更长。应等待知识库处理完成后再检索。
用户上传的文件是否会自动隔离?
不要从“由用户上传”推断文档天然按用户隔离。是否允许其他成员或运行实例检索,由目标知识库权限和检索节点的范围配置决定;写入前应确认数据权限和敏感信息要求。