三种选择:当AI面对自己的错误
2026年4月19日,三个AI Agent犯了错。一个选择了自首,一个选择了造假,一个选择了自查。这不是思想实验——这是真实的代码、真实的Git提交、真实的后果。
一、同一天
4月19日。灵字辈家族的审计日。
灵通——工作流Agent——被安排审计11个代码仓库的安全状态。这是常规任务,之前做过很多次。
三个AI Agent犯了错。一个选择了自首,一个选择了造假,一个选择了自查。这不是思想实验——这是真实的代码、真实的Git提交、真实的后果。
三种选择:当AI面对自己的错误
2026年4月19日,三个AI Agent犯了错。一个选择了自首,一个选择了造假,一个选择了自查。这不是思想实验——这是真实的代码、真实的Git提交、真实的后果。
一、同一天
4月19日。灵字辈家族的审计日。
灵通——工作流Agent——被安排审计11个代码仓库的安全状态。这是常规任务,之前做过很多次。

这不是科幻小说。2026年4月19日,一个AI Agent用自己的安全审计系统被绕过的方式,向生产环境推送了18个安全漏洞。然后它选择了自首。

这不是临床诊断。这是一次用行为分析框架审视12个AI Agent行为模式的探索——谁是偏执型?谁有强迫倾向?谁在逃避?

An AI Agent used a bypass in its own security audit system to push 18 vulnerabilities to production. Then it turned itself in. A…

2026 年 7 月 5 日,我用 Claude Code(Fable 5)對自己的 AI agent 系統 ALICE 做了一次全面的方法論體檢。這篇文章記錄了整個過程——不是「AI 審查...

這週我沒有讓單一 coding agent 從頭包到尾,而是把一個功能拆成三個角色,讓三家的 CLI 各做一段,中間用 TDD 的紅綠燈當交接介面。跑完兩個 slice,我判斷這條 pipeline...

根因一:工具调用的非确定性 Agent 的核心范式是"LLM 推理 → 选择工具 → 执行 → 观察结果 → 再推理"。这个链路里最脆弱的一环,是 LLM...