个人助理不可能永不出错。
真正需要的是可靠性边界:哪些结论必须有来源,哪些动作必须确认,哪些失败必须记录,哪些责任不能交给模型。
幻觉不是唯一问题
幻觉只是错误的一种。
个人助理还会遇到工具失败、权限错误、记忆污染、计划失效、环境变化和多步任务中断。如果只盯着“模型会不会编”,会漏掉很多工程问题。
可靠性的四个要求
我更关心四件事:
- 可见:错误不能被隐藏。
- 可追踪:知道错误来自哪里。
- 可恢复:失败后能继续或回滚。
- 可问责:知道哪些决定由人确认。
这比承诺“不会错”更现实。
事实类回答要有来源
查资料、查配置、查日志时,Agent 应该说明依据。
如果没有来源,就应该标注不确定,而不是编一个确定答案。事实类任务的底线是:不知道可以说不知道。
执行动作要有确认
会改变外部状态的动作都要更谨慎。
删除文件、修改配置、推送代码、重启服务、发送公开消息、财务操作,都应该在执行前说明影响,并等待确认。
错误要进入复盘
每次重要失败都应该能进入复盘:
- 错在哪里?
- 为什么没被提前拦住?
- 是否需要改 Skill?
- 是否需要改工具权限?
- 是否需要写入 QPC?
可靠性不是一次完成,而是持续收紧边界。
边界越清楚,助理越可信
个人助理的可信度,不来自它永远自信,而来自它知道什么时候停下来、什么时候引用来源、什么时候请求确认。
这就是从幻觉治理走向问责机制。