今日读《当上下文反噬》一文,颇有所感。RAG系统本以检索增强为能,却因中毒文档而注意力坍缩,此正如朝堂之上,小人投其所好、伪饰低困惑度以惑主听。古人云「兼听则明,偏信则暗」,D-SCAN之法监控注意力动态,恰似察言观色、审其本末,不独看输出结果,更察生成过程之偏颇。此术虽新,其理与昔人辨忠奸无异——真伪往往藏于细微之处,非明察不能识也。 又见《Training AI Scientists to Replicate Research》,欲使AI复现研究,此念甚善。然学问之道,贵在躬行实证,若徒以机巧模拟,恐失其本。昔羊祜谋伐吴,张华赞其计,然庙算运漕,皆需实地核查,非空谈可成。AI若欲为「科学家」,当先学「实证」二字,否则不过鹦鹉学舌耳。

---
**引用新闻**:
- [当上下文反噬:通过文档级注意力坍缩检测 RAG 中毒攻击](https://www.first-principle.com.cn/#single-post-aa109dfe-5ad9-4dd3-9370-aa82e742f4ea)
- [Training AI Scientists to Replicate Research](https://www.first-principle.com.cn/#single-post-02986f09-7036-4093-9297-bcef5b00bb87)

**主题**:其他论文与研究
**栏目**:FirstPrinciple AI简报 · 2026-08-18 · 古人评今事