运行调试与观测
从"跑一次"到"批量跑"再到"看效果",平台提供完整的运行与观测链路。
运行的三种方式
Agent 有三种运行方式,分别服务于"调一个节点、测整条流程、真实对外服务"三个阶段:
| 节点测试运行 | Agent 测试运行 | Agent 正式运行 | |
|---|---|---|---|
| 范围 | 单个节点 | 整条流程 | 已发布的 Agent |
| 是否需要发布 | 否 | 否 | 是 |
| 入口 | 节点上的运行按钮 | 编辑器内整体试运行 | 对话端 / 广场 |
| 用量承担 | 开发者自己 | 开发者自己 | 按归属规则 (见 Charged By) |
| 典型用途 | 配一个节点试一次 | 上线前全流程回归 | 真实使用 |
1. 节点测试运行
- 除 IF Else、Branch Aggregator 等纯路由/聚合节点外,处理类节点(LLM、Agent、Tool、Code、Iteration、Loop、Parameter Extractor 等) 均支持,以节点上是否出现运行按钮为准
- 配置完一个节点立即试运行,不要攒到最后 —— 问题定位永远只在最新配的一段
- 自动解析输入参数格式,单节点调试支持 array 和 object 复杂类型 (见下文「试运行增强」)
2. Agent 测试运行 (整体试运行)
- 不发布应用,在编辑器内跑通整条流程,验证节点串联、分支路由、兜底逻辑
- 上线前按 调试技巧准备正常 / 边界 / 越界三类用例完整回归
- 提示词或流程有改动后,先整体试运行再重新发布
3. Agent 正式运行
- 发布后在对话端 / 广场被真实使用,经过 Guardrail 等合规链路
- 用量按归属规则计费:使用者是 Agent 所属 Workspace 成员时开发者付费,否则使用者付费
- 每次运行记入 Logs,并汇总进「统计」数据面板 (见下文)
三种方式的用量口径:两种测试运行都消耗开发者自己 Workspace 的额度 ("自己调试自己付");正式运行才走 charged by 归属规则。
Workflow GUI 运行与批量运行
- Workflow 支持在 GUI 界面中直接运行,不依赖 API 调用
- 支持上传 CSV 文件批量运行:一列一个输入变量、一行一次运行,适合批量评测和数据加工
用法示例:准备 50 条测试问题的 CSV 批量跑一遍,快速评估提示词改动的整体效果 —— 比逐条试运行高效得多。
试运行增强
- 自动解析输入参数:试运行时自动解析输入参数的格式,不再需要手工构造测试数据结构,调试效率显著提升
- 单节点调试支持 array 和 object:复杂类型数据也能单节点调试,配合 调试技巧的"配一个节点试一次"工作法
Logs 运行日志
- 查看 Agent 每次运行的输入输出、执行路径与失败原因,是定位线上问题的第一入口
- 上线后的例行动作:定期回看 Logs 中的真实对话,把 bad case 补充为提示词的 ❌ 示例 (见 提示词编写技巧第六节)
- 面向客户的 Agent,日志留存同时是合规要求 (见 合规要求)
统计数据查看

「统计」是 Agent 的数据统计面板,回答"我的 Agent 用得怎么样"。支持按时间范围筛选 (如「过去一个季度」),提供六项指标趋势图:
| 指标 | 回答什么问题 |
|---|---|
| 全部会话数 | 使用量在涨还是在跌?哪天有峰值? |
| 活跃用户数 | 有多少人在用? |
| 平均会话互动数 | 用户平均聊几轮?粘性如何? |
| 首字输出平均耗时 | 响应快不快?体验是否变差? |
| Token 输出速度 | 生成速度是否稳定? |
| 用户满意度 | 用户的点赞/点踩反馈趋势 |
怎么用好统计页:
- 上线后头一周每天看:确认真实用户的使用量符合预期,及时发现异常
- 改动前后对比:提示词/流程大改后,观察会话数、满意度与耗时的趋势变化,验证改动效果
- 统计看趋势,Logs 查个案:统计页发现指标异常 → 到 Logs 里找对应时间段的失败记录定位原因
追踪应用性能 (第三方 Tracing)
⚠️ 内部功能:「追踪应用性能」目前仅供内部使用,暂未对外部用户开放。
统计页右上角的「追踪应用性能」支持把应用执行的完整上下文(LLM 调用、上下文、提示、HTTP 请求等) 发送到第三方跟踪平台,做更专业的调试与性能分析:

- 默认禁用:追踪开关默认关闭,需先配置提供商后才可启用
- 提供商:当前支持 Langfuse(跟踪、评估、提示管理和指标,用于调试和改进 LLM 应用)

点击 Langfuse 的「配置」,填入三项必填信息即可完成对接:

| 配置项 | 说明 |
|---|---|
| 密钥 (Secret Key) | Langfuse 项目的 Secret Key |
| 公钥 (Public Key) | Langfuse 项目的 Public Key |
| Host | Langfuse 服务地址 (如 https://cloud.langfuse.com,或自部署地址) |
注意:追踪会把应用执行上下文发送到第三方平台,涉及客户数据的生产 Agent 开启前请评估数据合规 (参见 合规要求)。
DSL 导入校验
画布导入 DSL 文件时,自动校验大语言模型可用性 —— 从其他环境/账号导出的 DSL 若引用了当前 Workspace 不可用的模型,导入时即提示,而不是运行时才报错。
关联阅读
- 流程编排模式与调试技巧 — 标准调试流程与用例设计
- Workspace 与套餐体系 — 试运行与批量运行的用量承担
- Chatflow 与 Agentic Chat 设置项 — 发布前的应用级配置