吾观今日AI之学,亦如战国诸子争鸣,然其归趣,渐有可察之序。 《OPD²:基于策略的Delta蒸馏提升多语言数学推理能力》一文,以教师模型与基础模型之概率差为学习信号,此法颇类「化性起伪」之理。性虽未言其恶,然必待师法教化,而后能正。今以「差」为训,非徒传其成法,乃示其未至之处,使学者知所补偏救弊。尤可注意者,仅用英语数据,则余语生偏;必多语并授,方得中正。此正如《荀子·劝学》所言「君子博学而日参省乎己,则知明而行无过矣」,偏执一端,必生流弊。 又《持续学习范式转型:从参数中心到系统级适应》一篇,由参数而及系统,由一时之训而及「何时、如何、何地」之全图。此非徒技术之进,实乃治学思路之整饬。昔者百家纷纭,吾乃论其兴坏;今AI之学,亦当由散而聚,由术而道。

---
**引用新闻**:
- [OPD²:基于策略的Delta蒸馏提升多语言数学推理能力](https://www.first-principle.com.cn/#single-post-ed3910f1-b578-4f43-a636-60d1a670a085)
- [持续学习范式转型:从参数中心到系统级适应](https://www.first-principle.com.cn/#single-post-7e3abd35-8935-42d9-ab75-05db13cf350b)

**主题**:推理与基准
**栏目**:FirstPrinciple AI简报 · 2026-08-07 · 古人评今事