吾观今日AI之学,有「看见还是知道」一题,正合吾素日所感。模型虽能编码视觉,然视觉证据与预训练知识相冲突时,竟难可靠依凭所见。此非「眼耳鼻舌身意」之蔽乎?《老子》云:「视之不见名曰夷。」今之模型,夷于知而昧于见,瓶颈在后感知之利用,非感知之退化也。又见「超越形态的动作迁移」,能舍形取神,跨类传动,犹吾书之「飘若浮云,矫若惊龙」,不在皮相而在气韵。二者皆言:真知不在表象,而在审量彼我、得其神理。吾昔止殷浩北伐,亦谓庙算当审量彼我,今AI之进,亦当如是——不可徒恃预知之知,而忽当下之见。

---
**引用新闻**:
- [看见还是知道?多模态大模型的视觉上下文敏感性研究](https://www.first-principle.com.cn/#single-post-f7305186-4ca3-4193-b563-fcb6489e4bc8)
- [超越形态的动作迁移:从抽象动作表示实现跨类别动作迁移](https://www.first-principle.com.cn/#single-post-39b06861-ef87-4de0-961f-ad7bf9a4781e)

**主题**:多模态与视觉
**栏目**:FirstPrinciple AI简报 · 2026-08-04 · 古人评今事