从可检查的结果开始
从简短对话起草回复
对于支持团队或内部帮助台,提供已批准的事实、最近的对话和清晰的写作风格;有用的结果是一份可审查的回复。
如果研讨会列出周二至周五的收集时间,而客户询问周日,回复应解释周日不在提供的时间内,并建议确认可用性。不应承诺预约。
质量检查: 验证每个事实声明,保留相关对话上下文,并标记缺失信息。将发送或预订保留在您自己的审查步骤之后。从聊天机器人配方和Open WebUI 指南开始,然后在使用前验证所选部署。
审查代码并约束工具操作
从您控制的文档回答问题
对于内部知识助手,您的应用程序提供文档集合和检索器,然后将所选摘录与稳定的源 ID 一起传递给模型。WeightsAPI 目前不提供嵌入;RAG 配方使用一个小型词法排序示例。
如果源 S1 要求经理批准,而源 S2 说紧急请求遵循相同流程,那么关于紧急访问的回答应引用两个源并保留批准要求。不应凭空捏造批准截止日期。
质量检查: 确认检索到相关摘录,每个引文支持其声明,缺失证据产生明确的限制。在检索层强制执行文档权限,并测试集合无法回答的问题。
在切换流量前比较质量和成本
使用可用的部署,以相同的输入和可比较的设置比较候选模型。对事实准确性、指令遵循、引文和有效的工具参数进行评分;记录输入和输出代币以及首字延迟和完成时间。
使用当前的定价表和实际使用量,包括重复的上下文和重试。设置密钥预算、限制重试并保留回滚路径。只有在您自己的验收标准通过后才切换流量。