配置与管理
日志与用户反馈
查看执行记录和用户评价,排查问题并改进回答。
审计日志记录每次提问的执行过程,用户反馈记录对回答的评价。结合两者,可以排查问题并改进智能体的回答。
审计日志
顶部标签「审计日志」,页面说明是「查看所有用户在当前智能体中的提问与执行记录。」列表每 15 秒自动刷新一次。
列表与筛选
| 列 | 内容 |
|---|---|
| 提问 | 用户问的原话;没有记录时显示「问题文本未记录」 |
| 用户 | 提问的人 |
| 来源 | 从哪个入口来的,例如网页对话、飞书、Slack、API 密钥 |
| 时间 | 提问时间 |
| 执行状态 | 本次执行的结果状态 |
| 用户评价 | 好评 / 差评 / 未评价 |
筛选条件:搜索问题(配合「搜索」按钮)、用户(默认「全部用户」)、执行状态、开始日期、结束日期。分页的每页条数可选 10 / 20 / 50。
执行详情
点开一条记录,右侧打开「执行详情」。页面自己有一句提醒:仅查看已保存的记录;回复已记录不代表执行完整成功。
详情里能看到:
- 本次提问和它的执行状态;
- 逐条消息:角色、时间、内容;
- 每条消息下的工具调用(可折叠展开),例如检索语义、执行 SQL、生成图表、执行 Python;
- 报错信息(含原始 JSON);
- 用户对这条回答的评价。
详情内部还有「搜索本轮执行内容」,可以按关键词在整轮执行记录里定位,「清空搜索」复位,没命中时提示「没有匹配的记录」,命中时给出「匹配记录:N 条」。
用它来查什么
- 口径不对:用户说数不对时,展开工具调用看它实际执行了哪条 SQL、用了哪些表,再决定是补字段备注还是补业务文档。
- 答不出来:看是不是检索阶段就没找到表——常见原因是表没挂到该智能体的数据源,或被策略挡掉。
- 慢:看哪一步耗时长,判断是数据源侧慢还是模型侧慢。
用户反馈
顶部标签「用户反馈」,说明是「用户提交反馈后,会在这里集中处理。」用户在一次回答上点赞或点踩时,可以附一句评论。
列表与筛选
| 筛选 | 选项 |
|---|---|
| 状态 | 待处理 / 已解决 / 全部 |
| 反馈类型 | 全部反馈 / 赞 / 踩 |
列表项显示赞或踩的标记、用户写的评论(没写评论时显示被评价的那条消息摘要)、用户头像和昵称、所属对话名(没有名字时显示「未命名对话」)和相对时间。
处理
- 点「标记解决」把一条反馈归档;归档后按钮变成「重新打开」,可以退回待处理。
- 点整行会跳到该反馈对应的对话,直接看当时的上下文。
用它来调优
反馈是「用户视角的错误报告」。把踩的评论按原因归一下类,通常落在三处:
| 反馈长什么样 | 大概率缺什么 | 去哪里补 |
|---|---|---|
| 「这个数不对」「口径不是这样」 | 字段备注或业务口径没写清 | 表与字段备注 · 业务文档 |
| 「它答得太啰嗦 / 太简略」 | 分析偏好没定义 | 基础设置与知识偏好 |
| 「它没按我们的方法分析」 | 缺一份技能 | 分析技能 |
关键约束
| 项目 | 值或行为 |
|---|---|
| 日志范围 | 当前智能体的全部用户提问,含各入口来源 |
| 日志刷新 | 列表每 15 秒自动刷新 |
| 日志详情 | 只展示已保存的记录;回复已记录不代表执行完整成功 |
| 日志能否重跑或导出 | 界面不提供重跑和导出,只能查看 |
| 反馈状态 | 待处理 / 已解决两态,可来回切换 |
| 反馈可见性 | 面向该智能体的管理员,可跳到原对话看上下文 |
出问题怎么判断
| 现象 | 判定条件 | 处理 |
|---|---|---|
| 列表是空的 | 显示「暂无审计日志」 | 确认这个智能体真的被用过;换别的智能体或放宽日期范围 |
| 提问列显示「问题文本未记录」 | 该条记录没有保存提问原文 | 改看「执行详情」里的消息内容 |
| 搜不到某次提问 | 搜索无结果 | 缩短关键词,或清空用户和状态筛选、放宽日期范围 |
| 详情里看不到完整过程 | 提示仅查看已保存的记录 | 这是正常的,详情只反映落库的部分 |
| 反馈列表是空的 | 显示「暂无用户反馈」 | 用户还没点赞或点踩;也可以主动引导他们反馈 |
| 点反馈跳不过去 | 对话已被删除或无权访问 | 直接从反馈内容判断,必要时找用户确认当时的问题 |