Skip to content

预览与调试

预览用于体验智能体的最终对话效果;调试用于查看模型、知识、插件、工作流和记忆在一次运行中的实际调用过程。完成配置后,应同时检查用户看到的回答和后台运行详情。

预览区

右侧预览与调试区域会展示开场白、预置问题、真实对话以及技能运行结果。建议每次调整模型、提示词或能力配置后都重新执行一次真实测试。

预览与调试区域

在智能体编辑页的预览区域输入测试问题,可以验证:

  • 人设、语气和回复格式。
  • 模型对问题和上下文的理解。
  • 知识检索与引用结果。
  • 插件、工作流和对话流调用。
  • 变量、数据库和长期记忆读写。
  • 问题建议、卡片及其他对话体验配置。

修改配置后建议新建或清空测试会话,避免旧上下文影响判断。

发布

完成预览和调试后,可将当前低代码智能体草稿发布为可分发版本。在编辑器右上角选择 发布,填写版本信息并选择已授权的发布渠道。

发布低代码智能体

发布步骤

  1. 填写发布版本发布描述。版本号用于区分本次内容;发布描述应说明新增、调整、修复及已知限制。
  2. 可按需上传最多三张展示截图,清晰展示智能体的主要使用场景和对话效果。
  3. 选择已授权的发布渠道并完成相应配置。当前页面可选择的渠道会随工作空间授权、智能体类型和平台配置变化。
  4. 发布前确认智能体引用的模型、知识库、插件、工作流、数据库和记忆资源均可用,且目标渠道具备访问权限。
  5. 确认无误后点击 发布;发布完成后,应在目标渠道进行一次真实对话或接口调用验证。

发布渠道与验证

  • 企业项目:向项目成员提供智能体,并选择适用分类。
  • 模板商店:在获得授权时作为可复用模板发布,并选择适用分类。
  • API:为系统集成提供调用入口;发布前完成接口配置和调用验证。
  • Chat SDK:为嵌入式对话场景提供接入能力。

发布结果

发布完成后,查看成功提示和每个发布渠道的结果。对于 API 和 Chat SDK 等渠道,可继续进入使用说明、安装指引或 Playground,完成一次真实调用验证。

低代码智能体发布结果

未显示或未授权的渠道不能作为发布目标。发布版本应与当前已验证的草稿一致;如处于多人协作中,先拉取并合入工作空间最新版本,再执行发布。

打开调试详情

发起一次测试对话后,从运行结果或详情入口打开调试信息。不同版本的入口名称可能是详情运行详情调试台,请以当前页面为准。

打开调试详情

调试信息

基础信息

基础信息通常包括运行状态、开始时间、耗时、使用模型、Token 消耗、输入输出和错误信息。首先确认本次查看的是正确会话和正确运行记录。

查看调试节点基础信息

调用树

调用树按执行顺序展示本次对话经过的模型、知识、插件、工作流或 Agent 节点。它适合定位:

查看调试调用树

  • 智能体是否选择了正确能力。
  • 多 Agent 是否转交到正确节点。
  • 哪个节点首先出现错误。
  • 输入和输出在节点间是否正确传递。
  • 失败后是否进入预期兜底路径。

耗时视图

如果调试台提供火焰图或分阶段耗时,可以用来识别模型、知识检索、插件或工作流中的主要延迟。优化前应先确认瓶颈位置,不要仅凭整体响应慢就随意更换模型或删除步骤。

查看调试耗时视图

推荐测试集

类型示例目标
主流程用户信息完整时能够正确回答或完成操作
缺少参数智能体会追问必填信息,而不是猜测参数
边界问题超出服务范围时能够清楚拒绝并给出替代建议
无知识命中不编造内容,说明未找到依据
工具失败插件或工作流失败时返回可理解的提示
连续追问正确使用上下文,不重复收集已提供信息
用户隔离变量、数据库和长期记忆不会跨用户串用
模式路由多 Agent 或对话流进入正确节点和分支
渠道体验真实发布入口的卡片、语音和文件能力可用

按能力排查

回答偏离人设或格式

  1. 查看实际发送给模型的提示词和上下文。
  2. 检查规则是否冲突,或关键要求是否被放在过长内容的末尾。
  3. 将模糊要求改成可判断的条件和明确格式。
  4. 使用同一问题重新测试,不要同时改动多个配置。

没有调用插件或工作流

  1. 检查技能是否已添加、版本是否正确、授权是否有效。
  2. 检查提示词是否明确说明调用条件和必填参数。
  3. 查看模型是否生成了工具调用,以及调用参数是否完整。
  4. 单独试运行插件或工作流,区分智能体选择问题和技能自身问题。

知识召回不正确

  1. 查看实际查询文本、召回范围和返回片段。
  2. 检查标签、匹配要求和召回数量。
  3. 检查知识内容是否重复、过期或分段不合理。
  4. 区分“没有正确召回”和“召回正确但模型回答错误”。

多 Agent 路由错误

  1. 检查节点名称和适用场景是否清晰、互斥。
  2. 检查全局跳转条件是否覆盖了普通分发逻辑。
  3. 查看上一节点传递的上下文是否足以判断。
  4. 直接调试目标节点,确认节点自身能够完成任务。

记忆没有生效

  1. 检查写入条件是否真正触发。
  2. 确认变量、用户和会话标识一致。
  3. 查看记忆是否写入正确范围,是否已过期或被覆盖。
  4. 使用不同用户测试,确认不存在串用。

响应时间过长

  1. 根据耗时视图找到最慢步骤。
  2. 检查是否存在重复检索、重复工具调用或不必要的串行执行。
  3. 减少无关上下文和过多召回内容。
  4. 对确实耗时较长的任务评估异步工作流,而不是让对话一直等待。

调试记录

建议为每个重要问题保留以下信息:

  • 测试问题和必要前置数据。
  • 预期结果与实际结果。
  • 运行时间、环境、智能体版本和资源版本。
  • 出错节点、输入输出和可见错误信息。
  • 修复内容和回归结果。

这有助于团队复现问题,也能避免通过无证据重试或临时修改提示词掩盖真正原因。

发布前检查

  • 主流程、失败路径和权限边界均已测试。
  • 使用的是正确模型、技能、知识和工作流版本。
  • 预览环境和目标发布环境的资源权限一致。
  • 调试日志中没有密钥、凭据或不应暴露的个人信息。
  • 已从真实发布渠道完成一次端到端测试。
  • 关键问题已有固定回归测试,发布说明记录了变更与限制。

相关文档