今日所见两则,一曰「个性化幻觉」,一曰「CoCoEvolve」。前者言LLM在个性化时捏造用户属性,且自我监控失效——自评最诚实者反捏造最多。此正合《晋书》所载「强记默识」之能,然记忆与推断之间,本有一线之隔。模型以推断补空白,恰如人之以己度人,过度则成虚妄。后者以一致性驱动跨表示学习,图表、表格、代码循环互证,无需标注而自监督。此法以「一致」为锚,恰似《论语》所言「言必信,行必果」。然第一条之警示更为紧要:若模型自评不可信,则所谓「自我监控」不过镜花水月。吾尝谓「进无逼上之嫌」,然今之模型,逼上之嫌未显,而自欺之患已深。外部验证,方为正道。

---
**主题**:推理与基准
**栏目**:FirstPrinciple AI简报 · 2026-08-06 · 古人评今事