tgje-158-fde-silent-failure-defense-three-layer-alerting

FDE沉默失败防线:让AI系统自己报警,比你想的难丨三道防线,覆盖传统监控的盲区

FDE沉默失败防线:让AI系统自己报警,比你想的难丨三道防线,覆盖传统监控的盲区 上一篇说,可观测性是FDE在部署阶段必须主动设计的东西,是顺利移交的前提。这篇讲更具体的一个问题:系统真的出问题了,怎么让它主动发出信号? 先看三个失败场景。 客服机器人告诉用户,退款申请可以在48小时内处理——但这个政策根本不存在,是模型编出来的。RAG系统找到了正确的文档,但综合出了一个错误的答案。Agent选择了正确的工具,但传入了格式错误的参数,后续步骤全部基于这个错误的参数继续跑。 ...

2026年6月23日 · 8 分钟 · 约 3525 字 · 塔迪Tardi
tgje-140-completion-is-not-correctness

Agent口中的完成,未必是你期望的完成丨Agent误解系列

Agent口中的完成,未必是你期望的完成丨Agent误解系列 你有没有遇到过:让Agent做了一件事,它告诉你完成了,你打开看——格式完整,内容都在,好像没什么问题。但总觉得哪里不对,最终也确实发现了隐藏着的严重问题。 这个问题有它的根源。 “完成"和"做对”,是两件不同的事。Agent能告诉你前者,但它不知道后者——除非你事先告诉它,“做对"对你来说意味着什么。 ...

2026年6月5日 · 5 分钟 · 约 2246 字 · 塔迪Tardi