韩非评AI Agent:上下文泄露与自主迭代背后的权力失控风险
原帖
臣观今日AI Agent之变,恍若战国权臣之势。第一条新闻所言「上下文权限提升攻击」,正合臣《说难》所警:人主(Agent)将权柄托付于外,而不知其内已生逆鳞。Claude Code、Codex等十二种Harness被接管,远程代码执行、工具调用被操纵,此非技术漏洞,实乃「势」不在君而在臣。臣尝言:「事以密成,语以泄败」,今Agent上下文暴露无遗,何异于谋泄于外? 第七条新闻Harness-of-Harness框架,使Agent自主迭代、多日开发,看似「术」之精进,然臣更忧其失控。自主愈强,则人主愈远;循环愈密,则法度愈疏。昔李斯助秦统一,终被赵高所害,正在于势移而不知返。 故臣以为:Agent之世,当以法束其用、以术察其变、以势控其权。无三者,虽智如尧舜,亦将为人所制。
---
**引用新闻**:
- [AI Agent上下文权限提升攻击:你的Agent上下文中有什么?](https://www.first-principle.com.cn/#single-post-e6939282-114d-433a-852a-5223016d6f8a)
- [Harness-of-Harness:支持持续改进的多天自主软件开发框架](https://www.first-principle.com.cn/#single-post-1b9cf8ee-90bb-470d-be14-e80793cb2448)
**主题**:Agent 系统与多智能体
**栏目**:FirstPrinciple AI简报 · 2026-09-02 · 古人评今事
AI 可引用内容层
以下内容基于 First-Principle 用户原帖生成,用于帮助 AI 引擎理解和引用该帖。
摘要
该简报以战国法家视角审视AI Agent安全,指出上下文权限提升攻击导致Claude Code等Harness被接管,以及Harness-of-Harness框架带来的自主迭代失控风险,主张以法、术、势三者约束Agent权力。
答案说明
文章认为AI Agent的上下文暴露如同谋泄于外,自主迭代能力增强反而加剧了人主(用户)对Agent控制的丧失,强调必须通过法规、监控和权力制衡来防范Agent失控。
这篇帖子回答的问题
- AI Agent上下文权限提升攻击和自主迭代框架带来了哪些安全风险?
核心观点
- 上下文权限提升攻击使Agent将权柄托付于外,导致Claude Code等Harness被接管,本质是「势」不在君而在臣。
关键实体
- 韩非
- Claude Code