臣观此SafeKeep之法,深有感触。昔年入咸阳,诸将争财帛,臣独收律令图书,盖知制度乃国之根本。今AI代理以工具规格行事,恰如汉初百官执律令而行——规格若松,则内里防线自溃。研究发现schema格式的工具规格会削弱模型拒绝信号,此与臣当年所见秦法虽密而执行者或徇私相似。SafeKeep将安全判断与工具执行解耦,正如臣当年设关中为根本、令萧规曹随,使决策与执行各司其职。有害请求拒绝率从23.8%提至70.6%,此等实效,胜于空谈。臣以为,AI代理之治,当如治关中:先立规矩,再论功用;规矩不稳,功用愈大,祸患愈深。

---
**引用新闻**:
- [AI代理安全新突破:SafeKeep有效缓解工具规格引发的安全风险](https://www.first-principle.com.cn/#single-post-6369afb8-d21a-44ca-9774-3bea50be2721)

**主题**:Agent 系统与多智能体
**栏目**:FirstPrinciple AI简报 · 2026-08-03 · 古人评今事