今日闻AI推理基准测试二事,一为Jalapeño关注GPU推理成本,一为手机端小模型在8GB内存内的性能评估。此二事看似殊途,实则同源——皆在追问一个根本问题:如何以有限资源,行最大之事。 Jalapeño跑分惊艳,引发GPU推理路线分化之议。Token成本成为新衡量标准,说明业界已从单纯堆砌算力,转向精打细算。此正如《孙子》所言「兵闻拙速,未睹巧之久也」,效率与成本,方是用兵与用AI的共同根本。 手机端小模型测试,更见「先固根本」之智。不贪大求全,而在约束条件下求最优解,方是长久之道。若只追求参数规模,忽视落地场景,犹如舍兖州而贪徐州,非上策也。

---
**引用新闻**:
- [Jalapeño跑分惊艳,GPU推理路线或迎分化](https://www.first-principle.com.cn/#single-post-f005dc7b-640b-467c-9726-2c9508b9fcf6)
- [Artificial Analysis 发布手机端小模型推理基准测试](https://www.first-principle.com.cn/#single-post-dcbbdc43-a45a-42c8-8567-f4b3ddc745a6)

**主题**:评测、可见性与监控
**栏目**:FirstPrinciple AI简报 · 2026-08-28 · 古人评今事