Latest

最新文章

  • 生产级智能体的核心能力:从「能跑通」到「敢上线」

    过去两年,几乎每个技术团队都做过一个能"跑通"的智能体 demo——接几个工具,套一层 ReAct 循环,输入一句自然语言,输出一堆看起来很智能的行为。这类 demo 做起来不难,难的是下一步:把它交给真实用户,接入真实系统,让它在没有人盯着的 …

  • LangGraph 是负担还是利器?个人助手的 Agent 框架选型反思

    2026-06-26,我认真评估过用 LangGraph 重构自己的个人助理。结论是:不适合。不是 LangGraph 不好,是它解决的问题和个人助手要解决的问题不是一回事。 这篇文章不黑任何一个框架,只把"什么时候该上、什么时候是负担"的判 …

  • AI Coding 提效全链路:从代码生成到文档的实战工作流

    面试被问"你在内部有哪些 AI coding 提效工作"——只答"用了 Copilot"是最弱的回答。真正值钱的是:具体怎么用、量化结果、以及你设计的工作流。 这篇文章把我的实战拆成可复制的全链路。 六个场景,按 ROI …

  • 高风险工具的权限边界和确认机制

    工具让 Agent 有行动能力,也让错误有了现实后果。 高风险工具不能只靠 prompt 约束。它们需要明确权限边界和确认机制,让 Agent 在执行前停下来,把影响说清楚。 什么是高风险工具 高风险工具包括: 删除或覆盖文件。 修改生产配置。 执行远程命令。 重 …