Skip to content

知识库写入节点

知识库写入节点把一个文件写入指定知识库,并按节点中配置的解析与分段策略处理文档。适合用户上传资料、业务文档归档、动态扩充问答资料等场景。

当前实现一次只能选择一个目标知识库,输入参数固定为 File 类型的 knowledge。如果要连续写入多个文件,应在批处理或循环中逐个执行节点。

当前功能与旧文档差异

旧文档同时介绍了直接写入 String、Array<Object>、指定知识库文档、标签及固定第三方接口 QPS 等能力。当前工作流编辑器没有提供这些配置:

  • knowledge 的名称和 File 类型均被锁定,不能改成 String 或 Array<Object>。
  • 当前节点按“选择一个知识库 + 写入一个文件”配置,不提供“写入指定文档”模式。
  • 当前面板没有标签编辑区域,也不展示旧文档中的固定接口限流值。
  • 知识库选择器提供“资源库知识库”和“企业知识库”入口;企业知识库只应选择具备上传能力的目标。

因此,本文只描述当前界面和当前提交数据实际支持的配置。

配置示例

本示例使用开始节点的 File 输入 uploadFile,把运行时传入的文件写入 java知识库

知识库写入节点输入与目标知识库

示例采用当前默认的数据写入设置:精准解析、自定义分段、换行切分、最大长度 1000、重叠度 0.1。

知识库写入节点解析、分段与输出配置

输入

参数类型当前要求
knowledgeFile必填。可以在节点中上传固定文件,也可以引用开始节点或上游节点产生的 File 变量。参数名称和类型不可修改。

只在当前工作流中处理文本内容时,不要直接把 String 变量映射给本节点。应先生成或上传 File 类型数据,再进行知识库写入。

选择目标知识库

打开“选择知识库”后,可以从以下来源选择目标:

  • 资源库知识库:当前工作空间的 AIOS 知识库。
  • 企业知识库:企业知识库树中具备上传能力的知识库。

一个节点最多选择一个目标。当前选择器可按文档、表格、图片分类筛选,但节点的数据写入设置以文档解析与分段为核心;选择非文档类型前,应确认目标知识库和运行服务确实支持对应文件格式。

目标知识库为空时,工作流校验会提示选择知识库。

文档解析策略

快速解析

不提取图片、扫描件或表格等元素,适合内容结构简单、主要由纯文本构成并且希望尽快完成解析的文件。

精准解析

从文档中提取更多结构化元素,解析耗时通常更长。当前可配置:

选项作用
图片元素提取文档中的图片元素。
扫描件(OCR)对扫描图片中的文字进行识别。选择自定义分段时当前界面会禁用该选项。
表格元素提取文档中的表格元素。

新建节点默认选择精准解析,并默认开启图片元素和表格元素。OCR 默认关闭。

分段策略

自动分段

由系统按内容段落自动切分。选择后不再显示自定义分隔符、最大长度和重叠度配置。

自定义分段

当前默认策略。可以控制切分边界和片段上下文:

配置当前范围与默认值
分段标识符支持换行、空行、句号和自定义;默认换行。
自定义标识符选择“自定义”时必填,空值无法通过工作流校验。
分段最大长度100~5000,默认 1000。
分段重叠度0~0.9,步长 0.01,默认 0.1。

片段过大会混入无关内容,片段过小则可能丢失上下文。结构清晰的说明文档可先使用换行或空行切分,再根据实际召回结果调整最大长度和重叠度。

输出

节点固定输出以下只读参数:

输出类型说明
documentIdString写入后生成的知识库文档标识。更新、删除或建立业务映射时应保存该值。
fileNameString写入文件的名称。
fileUrlString写入文件对应的访问地址。

不要只依赖文件名定位文档:不同用户或不同批次可能上传同名文件,后续删除操作应优先使用 documentId

精准解析和索引可能需要时间。节点已经返回文档信息,不代表下一个知识库检索节点一定能立即召回新内容;需要“写入后立刻检索”的流程应设计状态确认、延迟或有上限的重试。

工作流校验

保存或发布前,编辑器会检查:

  1. knowledge 已绑定固定文件或 File 类型变量。
  2. 已选择目标知识库。
  3. 使用自定义分段标识符时,标识符内容不为空。

常见问题

能否直接写入一段 String 文本?

当前节点不支持。knowledge 被固定为 File 类型;旧文档中 String 和 Array<Object> 的写入方式不适用于当前编辑器。

为什么精准解析中的 OCR 不可选?

当前实现会在“精准解析 + 自定义分段”组合下禁用 OCR。切换为自动分段后,OCR 才可以按需开启。

一次能写入多个文件吗?

不能。输入是单个 File。需要批量写入时,使用批处理或循环节点逐个调用知识库写入节点,并为失败项设计独立记录与重试。

为什么写入成功后立即检索不到?

文件上传后仍可能经历解析、分段和索引过程,精准解析尤其可能耗时更长。应等待知识库处理完成后再检索。

用户上传的文件是否会自动隔离?

不要从“由用户上传”推断文档天然按用户隔离。是否允许其他成员或运行实例检索,由目标知识库权限和检索节点的范围配置决定;写入前应确认数据权限和敏感信息要求。