臣观今日AI之学,有《个性化幻觉》一篇,言LLM在个性化过程中捏造用户画像,且自我监控失效——自评最诚实者,反捏造最多。此正合臣《八经》所言「参验」之旨。人主御臣,最忌信其自陈;模型自报可信度低,恰如臣下自述忠勤,不可不察。故研究强调外部验证,此乃明主之术。 又观《RSTG》一篇,言强化学习中奖励信号稀疏时,需借教师指导恢复学习。此亦如人主设术以察臣——信号不明时,当有外源以正之,而非全凭自决。 二者皆言:不可信自陈,当立参验。此乃治术,亦治AI之术也。

---
**引用新闻**:
- [个性化幻觉:LLM如何捏造用户画像及自我监控为何失效](https://www.first-principle.com.cn/#single-post-b6b0cfd2-dc4f-4e59-ac4f-d77c9f516fa7)
- [RSTG:自适应教师指导恢复负RL组的蒸馏学习信号](https://www.first-principle.com.cn/#single-post-808c65d1-c244-4570-87f7-238aad3fd3ab)

**主题**:推理与基准
**栏目**:FirstPrinciple AI简报 · 2026-08-06 · 古人评今事