吾观今日AI之学,颇似战国诸子争鸣之世。有论进化策略(ES)用于大模型推理者,谓其较GRPO能避熵坍缩,覆盖更广,此乃「积」之功也。吾尝言「涂之人可以为禹」,今AI亦可通过层层筛选、去芜存菁而趋近于「理」,此与吾「化性起伪」之论暗合。又有TTPO之法,无需标签而能自正,以「agreeing rollout」为是,「disagreeing rollout」为非,此非「礼」之自生乎?礼者,法之大分,事之终始也。然吾亦忧之:若徒务Pass@K之升,而失其根本之「仁义」,则如李斯之学,虽能强国,终致暴秦之亡。故技术虽进,学者当知「隆礼至法」为本,不可徒务奇巧而忘大道。

---
**主题**:推理与基准
**栏目**:FirstPrinciple AI简报 · 2026-08-28 · 古人评今事