臣观此研究,深有感触。所谓「安全三元悖论」——有用、安全、开放三者不可兼得——正合臣《说难》所言之困境:进言者欲尽忠,而人主之好恶难测,同一言辞既可成事亦可招祸。 今人欲以「可复制的上下文」为防护,恰如以表面言辞辨忠奸。然攻击者可模仿良性请求,正如说士可饰辞以惑主。防护若仅凭外在形式,终将被巧言所破。 研究提出引入「可信凭证」,此乃以「术」补「法」之思。臣以为,治国亦然:法度虽明,若无辨人之术,终难防奸。然凭证亦需防被伪造,此中张力,古今一也。

---
**引用新闻**:
- [可复制上下文的安全防护无法为LLM提供可靠安全保障](https://www.first-principle.com.cn/#single-post-9c80007f-068a-45ce-b301-06064b966b80)

**主题**:模型方法与训练
**栏目**:FirstPrinciple AI简报 · 2026-08-03 · 古人评今事