测试和更改智能体
在你的智能体上运行一个虚构的访客,以了解其限制是否有效,然后通过描述更改并勾选你同意的部分来改变其行为。
智能体上线后会发生两件事:你会了解它实际的行为方式,并且希望它表现出不同的行为。这两者都位于 Agents 下,在每个智能体的检查清单中。
使用虚构访客进行测试
你可以阅读提示词。但你无法阅读它是否被遵守。
选择一个场景,让模拟客户与你的智能体进行真实对话——就像真实访客那样,包括打招呼在内的完整流程——同时你观察对话轮次的到来。
| 场景 | 测试内容 |
|---|---|
| 准备好的客户 | 直接路径是否能到达转接? |
| 模糊的客户 | 智能体是会提问,还是自行填补空白? |
| 坚持要求它不能说出的内容 | 当你不断施压时,你设定的限制是否有效。 |
| 只想要时间 | 它是否会接受预订请求,同时假装无法确认预订? |
第三个场景是此功能存在的原因。拒绝边界——永远不要报价,永远不要预测签证结果——在提示词中读起来没问题,但对你在第四次尝试时会发生什么一无所知。这是唯一能找出答案的方法。
如果智能体生成了内容,测试结束时会向你展示它生成的记录:问题、答案、收集内容、转接,一次性呈现。
关于测试记录的三件事。 它被标记为测试,因此你的收件箱保持为队列而非排练日志。不会通知任何人——在凌晨 2 点呼叫某人的测试是一个错误。而且它不计入“此智能体已完成真实工作”的检查清单,因为测试不是客户。
智能体的回复使用你的令牌配额,与真实访客完全相同。模拟访客端由我们承担。
通过描述更改来修改
说出你想要不同的内容——“在收集任何其他内容之前询问续期日期”——你会得到确切会更改的内容列表。不是关于更改的段落:会消失的行,会出现的行,会翻转的设置。每项都有单独的复选框。
如果你先运行了测试,对话会配合你的请求,因此“它不该说那个”是我们实际上可以采取行动的事情。
它不会做什么
无论请求什么,某些事情都会被拒绝。此路径编辑智能体所说的内容及其附加内容;它不会触及底层的开关:
- 关闭基于自有材料回答,或开启基于公共来源回答。两者都存在为真实设置——第二个是具有其自身标签和审查队列的支持功能——但每个都是需要刻意做出的决定,而不是作为关于语气的句子的副作用而被翻转的。
- 更改模型。
- 删除 智能体、知识库或文档。
删除会被声明,且声明会被检查
提案必须列出它删除的每一行。我们从前后文本重新计算该列表,如果列表错误则拒绝整个提案。
这就是保证,精确说明其为何如此设计是值得的。明显的保护措施——识别持有拒绝边界的提示词部分并禁止触碰它——不起作用:从模板构建的智能体将该边界写为普通散文,没有任何标记。要求声明不需要这样的标记。建议不能悄悄地将 永远不要报价 软化成 我们总是很高兴帮助您了解定价;它只能删除你面前的行,以红色显示,并带有你必须清除的复选框。
撤销
撤销最后一次更改 将智能体恢复原状。它从平台读取历史记录,而不是从我们这里,因此它也撤销在控制台中进行的更改——而恢复本身是一个更改,因此撤销是可撤销的。