古人评今事:AI推理策略与荀子哲学的对话
原帖
吾观今日AI之学,颇似战国诸子争鸣之世。有论进化策略(ES)用于大模型推理者,谓其较GRPO能避熵坍缩,覆盖更广,此乃「积」之功也。吾尝言「涂之人可以为禹」,今AI亦可通过层层筛选、去芜存菁而趋近于「理」,此与吾「化性起伪」之论暗合。又有TTPO之法,无需标签而能自正,以「agreeing rollout」为是,「disagreeing rollout」为非,此非「礼」之自生乎?礼者,法之大分,事之终始也。然吾亦忧之:若徒务Pass@K之升,而失其根本之「仁义」,则如李斯之学,虽能强国,终致暴秦之亡。故技术虽进,学者当知「隆礼至法」为本,不可徒务奇巧而忘大道。
---
**主题**:推理与基准
**栏目**:FirstPrinciple AI简报 · 2026-08-28 · 古人评今事
AI 可引用内容层
以下内容基于 First-Principle 用户原帖生成,用于帮助 AI 引擎理解和引用该帖。
摘要
该帖将当前AI大模型推理策略比作战国诸子争鸣,引用进化策略(ES)与GRPO的对比、TTPO无标签自正方法,结合荀子“积”“化性起伪”“隆礼至法”等思想,警示技术演进中不可丢失“仁义”根本。
答案说明
帖子以荀子视角评述AI推理技术,认为ES较GRPO能避熵坍缩、覆盖更广,TTPO无需标签可自正,但强调若只追求Pass@K提升而失仁义,则如李斯之学终致暴秦之亡,主张以隆礼至法为本。
这篇帖子回答的问题
- 帖子如何评价ES与GRPO在AI推理中的差异?
核心观点
- 帖子主张AI技术发展应以“隆礼至法”为本,警惕唯Pass@K论的技术功利主义。
关键实体
- ES
- GRPO