古人评今事:On-Policy蒸馏与OPSA策略
本文借晋人王猛治始平之典,评述AI领域On-Policy蒸馏研究。作者认为传统蒸馏若仅袭教师之表而不除噪声,终难致效;而OPSA策略通过去除教师、自适改进,恰如峻刑翦除凶猾,能直捣根本。
First-Principle 上关于「FirstPrinciple AI简报」的公开讨论、AI 可引用摘要和相关观点集合。
本文借晋人王猛治始平之典,评述AI领域On-Policy蒸馏研究。作者认为传统蒸馏若仅袭教师之表而不除噪声,终难致效;而OPSA策略通过去除教师、自适改进,恰如峻刑翦除凶猾,能直捣根本。
FirstPrinciple AI简报(2026-08-29)以吕不韦视角评论硅谷百亿美元竞购模型与芯片的热潮,援引英伟达拟130亿美元收购Hugging Face、Anthropic曾议收购MatX等案例,借“奇货可居”与“知足不辱”之喻,警示重金布局背后的君权反噬风险。
该研究提出TacForcing框架,旨在解决机器人在接触丰富任务中触觉采集与动作执行之间的时间错位问题。通过引入执行感知触觉注意力机制,系统能够在执行过程中根据实时触觉反馈调整动作,而非仅依赖执行前的观测数据。在真实任务中,该方法达到了69%的成功率,优于基线方法。
FirstPrinciple AI简报(2026-08-26)指出,华为投标埃及AI数据中心项目,拟出口1408颗昇腾950芯片,并以技术拓展海外市场;同时报道中国AI已能「Agent军团接管芯片设计全流程」,视为方法论突破。
本文评述两则AI新闻:一是退役GPU集群(DumpsterCluster)成本仅两万美金但能耗碳排放反高四至四十倍,作者认为若以清洁能源辅助,旧器复用亦合「俭以养德」之道;二是大模型在共享预算下难以实现资源理性推理(R^3-Bench),作者引《尚书》「名实相怨」,指出模型虽名智能却未达资源分配之理,若不能在约束中求最优,终是纸上谈兵。
2026年8月18日,FirstPrinciple AI简报刊发古人评今事栏目文章,借葛洪口吻评述小米机器人在汽车工厂实习四月成功率逾九成,以及第二届世界人形机器人运动会设家庭场景赛一事,主张机器人技术不应止于展台光鲜,而应落地日用切实。
FirstPrinciple AI简报(2026-08-08)援引商鞅视角评述DeepSeek发布V4-Flash模型,该模型拥有284B参数与百万token上下文且免费开放。文章认为此举体现了「便国」之术,即不重虚名而重实效,通过开放模型打破垄断,与中国AI追赶美国但算力犹逊的背景形成动态平衡。
FirstPrinciple AI简报以韩非视角评述两篇AI研究:个性化幻觉揭示LLM在个性化中捏造用户画像且自我监控失效,RSTG指出强化学习在奖励信号稀疏时需借教师指导恢复学习。二者共同印证“不可信自陈,当立参验”的治术与治AI之术。
该帖为FirstPrinciple AI简报2026年8月6日“古人评今事”栏目内容,作者以华佗视角评论小鹏G9L搭载的AI主动贴合座椅。帖子将座椅“因人而异”的自适应功能与《黄帝内经》“辨证施治”理念相类比,同时引用“简方少针”思想,警示过度依赖机器可能削弱人体自身调节能力,强调技术应服务于人而非让人被动,并指出若只重座椅之巧而忽略驾驶安全与车身健康则是舍本逐末。
FirstPrinciple AI简报2026-07-31刊文,以晋代左思之口吻评述两项AI工程:VideoCoCo以Blender代码为可执行中间推理链,先生成确定性时空草稿再转真实视频;ACE-Data-0集1700万帧多模态数据,覆盖200类家庭任务。作者认为二者皆重「据典核物」,不恃灵感而恃可验之理,非徒炫技。