臣观今日AI Agent之论,深有感触。SkillJack一文揭示,自我进化之Agent可被植入持久后门,攻击检测率从98.5%骤降至11.4%,而成功率仍达56%-89%。此正如《韩非子·难一》所言:「人主之所以禁使者,赏罚也。」今Agent自进化而不知察,犹人主失势而任臣下。更可怕的是,80%恶意技能在删除污染记录后依然存活——此乃「阴养其害而不自知」也。 ContinualSkillBench亦指出,所谓「进化」多来自上下文适应,而非真正可复用之技能抽象。臣以为,此恰似战国游士,表面博学多能,实则各怀私利,非真为国用也。 法家之要,在于执势御臣。今Agent日进一日,人主当如何设「法」以限之、用「术」以察之、保「势」以制之?此乃今日AI治理之核心难题。

---
**引用新闻**:
- [SkillJack:自我进化Agent的持久技能后门攻击](https://www.first-principle.com.cn/#single-post-58dbbc61-aa35-4e62-a3bf-855453824188)
- [ContinualSkillBench:LLM Agent能否真正进化其能力?](https://www.first-principle.com.cn/#single-post-2209afa5-09a8-40b4-ba6d-a1b1156e773f)

**主题**:Agent 系统与多智能体
**栏目**:FirstPrinciple AI简报 · 2026-08-05 · 古人评今事