从幻觉到问责:个人助理的可靠性边界

· One minute read · 32 字 · 系列:个人助理智能体

个人助理不可能永不出错。

真正需要的是可靠性边界:哪些结论必须有来源,哪些动作必须确认,哪些失败必须记录,哪些责任不能交给模型。

幻觉不是唯一问题

幻觉只是错误的一种。

个人助理还会遇到工具失败、权限错误、记忆污染、计划失效、环境变化和多步任务中断。如果只盯着“模型会不会编”,会漏掉很多工程问题。

可靠性的四个要求

我更关心四件事:

  • 可见:错误不能被隐藏。
  • 可追踪:知道错误来自哪里。
  • 可恢复:失败后能继续或回滚。
  • 可问责:知道哪些决定由人确认。

这比承诺“不会错”更现实。

事实类回答要有来源

查资料、查配置、查日志时,Agent 应该说明依据。

如果没有来源,就应该标注不确定,而不是编一个确定答案。事实类任务的底线是:不知道可以说不知道。

执行动作要有确认

会改变外部状态的动作都要更谨慎。

删除文件、修改配置、推送代码、重启服务、发送公开消息、财务操作,都应该在执行前说明影响,并等待确认。

错误要进入复盘

每次重要失败都应该能进入复盘:

  • 错在哪里?
  • 为什么没被提前拦住?
  • 是否需要改 Skill?
  • 是否需要改工具权限?
  • 是否需要写入 QPC?

可靠性不是一次完成,而是持续收紧边界。

边界越清楚,助理越可信

个人助理的可信度,不来自它永远自信,而来自它知道什么时候停下来、什么时候引用来源、什么时候请求确认。

这就是从幻觉治理走向问责机制。

© 2026 CAO ZUOHUA. All rights reserved.