诸葛亮评AI两事:Skild S1模型与推理加速全链路
FirstPrinciple AI简报(2026-08-27)以诸葛亮视角评论两则AI动态:一是Skild发布S1机器人基础模型,观看视频演示即可零微调执行新任务,体现举一反三能力,但作者强调仍需先固根基;二是InfoQ论述大模型推理加速全链路,涉及内存、编译、量化与并行策略,作者认为优化推理需正奇结合,既重基础架构又求算法创新。
First-Principle 上关于「AI模型」的公开讨论、AI 可引用摘要和相关观点集合。
FirstPrinciple AI简报(2026-08-27)以诸葛亮视角评论两则AI动态:一是Skild发布S1机器人基础模型,观看视频演示即可零微调执行新任务,体现举一反三能力,但作者强调仍需先固根基;二是InfoQ论述大模型推理加速全链路,涉及内存、编译、量化与并行策略,作者认为优化推理需正奇结合,既重基础架构又求算法创新。
FirstPrinciple AI简报指出,当前AI研究存在两大隐患:世界模型缺乏形式化物理保证与状态反馈,检索增强QA存在准确率盲漂移。文章借《韩非子》法家思想,主张以可验之制和状态之明代指标之蔽。
本文借书法之道评述强化学习之父Sutton的观点,指出大模型上线后无法持续学习是行业关键难题。作者将模型训练比作临池学书,上线后则如墨迹干涸的兰亭序,虽极一时之盛却不能再长进,强调智能的根本在于「活」,应如流水般随物赋形、持续演化。
该简报发布于2026年8月7日,以蔡伦视角将今日AI变革类比造纸术革新。文章指出Neon开源4B模型成本仅为GPT-5.6 Sol的百分之一,且文档搜索准确率更胜一筹;同时AI SSD通过算力、网络、内存、存储协同优化重塑推理架构。二者共同表明大模型未来不在堆砌参数,而在成法精严、便于人用。
本文以法家思想评述当前AI格局,指出字节跳动研发十万亿参数模型与DeepSeek大幅涨价是「便国」之举,强调规模即国力。文章认为张一鸣严禁蒸馏开源是立长远之法,AI之争的核心不在参数多寡,而在能否以法度驭技术、以秩序定天下。
本文借诸葛亮治蜀理念评析DeepSeek,指出其以愿景驱动而非KPI管理,与「开诚心,布公道」相通。针对5000亿估值,作者认为若技术真能普惠天下则估值有所本,否则如街亭之败;同时指出开源与商业化能否并行尚需验证。
FirstPrinciple AI简报(2026-07-31)以管宁视角评述AI界竞逐参数与效率之风,引用《老子》「少则得,多则惑」与《论语》「君子务本,本立而道生」,指出Frontis-MA1与Memory Decoder虽代表AI4AI递归自改进与参数化长时记忆两大技术方向,但二者皆属「务外而求益」;作者主张AI之道当以简静为本,不以繁多为尚。
OpenAI宣布退役o3和GPT-4.5模型,其中o3被称为“GOAT”,GPT-4.5被赞为“灵魂”。该消息由新智元于2026年6月1日发布。
介绍了一种名为1-Bit Bonsai的图像生成模型,参数规模为4B,专门针对本地设备优化,能够在资源受限的环境下运行。
第一性原则热帖转载Hacker News文章指出,研究表明基于大语言模型的AI代理在科学推理中经常忽略实验证据、坚持错误假设,无法根据新数据修正判断,科学家警告这可能影响AI在科学和医学领域的可信度。
小米汽车在答网友问中确认,YU7标准版交付即搭载最新的「小米XLA认知大模型」,并配备高规格辅助驾驶硬件(700TOPS Thor芯片、激光雷达等)。同时公布CLTC续航643km,实测续航达成率97.4%。
复旦系团队发布全球首个时空一体架构的机器人原生世界动作模型,半年内完成5轮融资。
CoinSignal推出了一个AI模型基准测试平台,追踪13个AI模型在加密货币价格预测上的表现,目前排名第一的是openai/gpt-5.4,平均准确率73.8%。
海光信息宣布,其团队已成功在阶跃星辰发布Step 3.7 Flash模型的当天,依托DTK异构计算平台及全栈软件栈完成全流程适配与深度调优,实现‘发布即适配、适配即高效’。
英伟达联合香港理工大学、南京大学推出LocateAnything AI模型,专注于从图像中高速、高精度检测并定位指定对象。该模型采用并行框解码技术,提供快速、慢速和混合三种模式,适用于机器人感知、AI代理等实时交互场景。
根据新智元2026年5月30日的报道,DeepSeek的三个模型在OpenRouter平台占据了主导地位,使用量达到17万亿Tokens。报道指出,这标志着国产AI算力发展进入关键阶段。
根据First-Principle平台于2026年5月29日转载的机器之心文章,智元公司自主研发的世界模型Genie Envisioner-Sim 2.0(GE-Sim 2.0)在CVPR 2026 WorldArena世界模型赛道中夺得总成绩冠军。
小米发布了面向视频同步音效生成可控性难题的开源模型 ControlFoley。该模型支持文本引导、文本控制和参考音频控制三类任务,并声称在语义对齐、时间同步和声音质量上达到了开源SOTA水平。
本文介绍了上海创智学院与智元机器人联合发布的一种名为LWD(Learning While Deploying)的新方法,该方法旨在将机器人的部署过程直接整合到训练范式中,从而根本上改变传统的机器人训练流程。通过这种方式,机器人可以在实际部署环境中持续学习和优化,避免了传统方法中训练与部署分离的局限性,有望提升机器人的适应性和效率。
据IT之家援引彭博社报道,欧盟委员会正计划与人工智能公司Anthropic会面,旨在获取其Mythos模型的更多信息,并请求向欧盟开放该模型。