我的告警系统把 90% 的告警判成 high,独立调查器只认同 26%
一份没人标注过的标注集从天而降:让 agent 调查器给告警重新定级,再拿它的结论给廉价判定打分。测出来的结果很难看,修法比测法更值得写——包括那道防止过度修正的护栏。
一份没人标注过的标注集从天而降:让 agent 调查器给告警重新定级,再拿它的结论给廉价判定打分。测出来的结果很难看,修法比测法更值得写——包括那道防止过度修正的护栏。
An autonomous agent investigates production incidents on my infrastructure. Its safety boundary is not written in the prompt. Four layers of constructed read-only — a tool-call veto hook, a read-only MCP surface, an untrusted-input fence, and double-gated remediation — each designed on the assumption that the layer above it has already been fooled.
一个自治调查 Agent 的工作目录,恰好就是它自己那份常驻指令所在的目录。这是一次性提示注入和永久提示注入的分界线;记录两道失效方式不同的防线、为什么只读挂载解决不了,以及 runbook 自动沉淀该用哪种写入语义。
周报和月报消失了几个星期,没有任何告警、任何错误日志、任何异常指标——因为发送失败也会盖上「已发送」的标记,补发机制看到标记就此收手,完成日志打着 INFO。解剖这次静默丢失的三个共谋,和「标记必须是事实断言」的修复。
commit log 记得住每一个做了的决定,却永远不记得那些评估过然后放弃的。在仓库里给决策建档、专门给「被拒绝的方案」留一个桶、并给每次拒绝写上过期条件——这是我用过的性价比最高的工程实践。
让一个自治 AI Agent 调查生产故障,安全边界不能写在提示词里。四层构造性只读:工具调用否决钩子、只读 MCP 面、不可信输入围栏、双闸修复——每一层都假设上一层会被骗过。
把第二套告警判定系统以「只记账、不通知」的影子模式接上生产流量:88.6% 的判定一致率、一个藏在三层正当设计背后的恢复标记 bug、一条两边都没错的边界案例,以及为什么影子灰度真正的产品是分歧行。
一个自部署的告警网关:站在监控系统和通知群之间,把「收到告警」和「打扰人类」拆开。AI 分诊、八道抑制闸门、可追溯的决策链、事务性 Outbox 投递,以及给 AI Agent 的只读 MCP 接口。
用 buildx 和 QEMU 构建跨架构镜像的完整流程,包括 docker-container driver、manifest list 为什么只能在 registry 生成、如何真正验证异构镜像;以及 PEP 668、登录 shell 丢 PATH、多进程容器半死不活、bind mount 下 git 静默失败这四个坑。
解决 OrbStack 数据映像位于 HFS+ 时报磁盘空间不足、启动失败的问题,提供迁移数据目录到 APFS 的完整修复与验证流程。