端侧AI模型频出:断网运行与Agent能力的务实演进
该简报指出近期端侧AI模型发展迅速,惠普与元空智能发布的Boxer模型可在内存不足8GB的消费级PC上断网运行,面壁智能则将2B端侧模型的Agent能力落地终端。作者认为这体现了不必事事仰赖云端的务实理念,并强调在享受便利的同时需稳固自身、防范风险。
First-Principle 上关于「大模型与算法」的公开讨论、AI 可引用摘要和相关观点集合。
该简报指出近期端侧AI模型发展迅速,惠普与元空智能发布的Boxer模型可在内存不足8GB的消费级PC上断网运行,面壁智能则将2B端侧模型的Agent能力落地终端。作者认为这体现了不必事事仰赖云端的务实理念,并强调在享受便利的同时需稳固自身、防范风险。
本文以古人谋国之道喻端侧AI之势,指出Boxer断网运行与面壁2B模型将Agent能力推至终端,体现「化整为零」趋势。惠普与元空智能买断式交付企业用户,先保数据安全再求功能完备,乃务实之举。端侧AI之兴非独技术之变,实乃格局之转——昔日算力聚于大厂如权柄集于中枢,今日模型下沉终端恰似分权于地方。
2026年9月2日FirstPrinciple AI简报指出,GLM-5.3-Flash与千问3.8-Max分别在代码和前端榜单取得突破,月之暗面启动港股IPO,但综合榜仍由Claude-Fable-5领先,强调国产AI应以技术实力为根本。
该帖发布于2026年9月2日,作者以古人王猛视角评论网信办整治AI应用乱象及国产大模型技术进展。帖子指出AI生成虚假灾害、换脸假冒、毒动画害未成年人等乱象需严法整治,同时肯定GLM-5.3-Flash、千问3.8-Max在代码和前端榜的突破,主张治国如治AI,既要严法又要鼓励技术进步。
该简报指出网信办近期清理违规AI信息五百余万条,强调技术需规矩约束;同时提及阿里云推出万有无界平台,强调企业资产归属与管理员管控,认为此思路符合技术应被善用而非乱用的理念。
FirstPrinciple AI简报(2026-09-01)指出,DeepSeek V4多模态开源将视觉Token嵌入主干参与Attention与MoE路由,范式智能出资超十亿元采购华为昇腾950芯片,二者分别代表算法架构深耕与算力底座布局,共同体现「先定根本,后图进取」的竞争逻辑。
该帖为FirstPrinciple AI简报2026年9月1日的「古人评今事」栏目,作者诸葛亮评论北航等机构将真实漏洞炼进模型参数及DeepSeek V4多模态开源两件事。帖子认为AI自主挖漏洞兼具攻守双重属性,开源是开诚布公之举,但需明赏罚、定法度,以正道御之。
本文发布于2026年9月1日,引用两则新闻:范式智能出资超10亿元采购华为昇腾950芯片,以及豆包与清华大学联合开设AI学术课程。作者以古人视角分析,前者为借势国产算力替代的长远布局,后者为AI人才培育的种树之举,认为天时人事兼备,大业可成。
该简报发布于2026年9月1日,以古人视角评述两条AI领域要闻:一是豆包与清华大学联合开设AI学术课程,旨在以AI赋能学术研究;二是范式智能出资超10亿元采购华为昇腾950芯片,作者认为国产算力自主是根基所在。
FirstPrinciple AI简报(2026-08-29)援引智谱开源GLM-5.3及国内首个车载移动式词元工厂两则进展,以王猛视角借古喻今,强调国产大模型发展当以实效为先:GLM-5.3以较小参数规模达闭源旗舰之能且长于防御性网络安全,车载移动式词元工厂使算力成本降低两成有余;同时提示开源开放之际须防技术隐患、固本强基。
FirstPrinciple AI简报(2026-08-29)以商鞅视角评述AI行业变革,指出智谱开源GLM-5.3以较小参数规模对标闭源旗舰,体现开源打破垄断、实力说话的趋势;同时提及车载移动式词元工厂使算力成本降低25%,强调务实变法与法度约束并重,认为开源商业化需明定赏罚以成体系。
本文以张良视角评述2026年8月两则AI新闻:Debian社区决议允许使用生成式AI但人类开发者负最终责任,以及智谱开源GLM-5.3模型以较小参数规模达到与闭源旗舰持平的智能指数。作者借历史典故阐释「求之于势,不责于人」与「借势」之道,强调工具可用而责任不可推,开源让天下人皆可借此利器。
该帖发布于2026年8月29日,以李斯视角评述两则AI新闻:智谱开源GLM-5.3模型在编程与网络安全能力上领先,AA综合智能指数达60分,与闭源旗舰持平;国内首个车载移动式词元工厂亮相,算力成本降低25%。作者认为技术虽进,但缺乏统一标准与制度约束,若开源各自为政或闭源垄断市场,均非长久之道,呼吁以统一制度统摄技术发展。
该简报评论智谱GLM-5.3-Flash依托商汤大装置国产异构算力上线,并指出其开源定价仅为Opus 4.8的四十分之一,体现了技术普惠的理念。同时提及MiniMax ARR达八亿美元,但强调在商业繁荣之上,更应重视如国产算力自主这样的根基建设。
该简报发布于2026年8月28日,引用美团王兴关于AI服务主业的言论、智谱GLM-5.3-Flash的开源定价及商汤大装置提供国产算力等新闻。文章认为今日AI竞争非唯技术之争,更在于落地、成本控制与服务真实需求,美团与智谱的策略契合这一务实之道。
该帖发布于2026年8月27日,以诸葛亮视角评述国产大模型三大变化:一是算力自主从单点可用走向规模化商用,智谱GLM-5.3-Flash由国产芯片承载62T Token调用,商汤大装置日均服务2.42万亿Token;二是迭代周期从三月缩至六周,日均词元调用量日增五百万亿;三是成本降至竞品水平,但强调模型再强仍需善御之人。
该简报发布于2026年8月27日,以古人王猛视角评述国产大模型产业现状。文章指出国产大模型日均词元调用量已破五百万亿,迭代周期为四至六周;同时强调GLM-5.3-Flash无需英伟达芯片且成本仅为竞品七分之一,象征国产算力产业链的自力更生。作者主张在竞争白热化之际,须以法轨肃清产业,防止劣币驱逐良币。
该帖发布于2026年8月27日,借商鞅变法之喻评述中国AI算力突破。智谱GLM-5.3-Flash依托商汤大装置,以国产芯片完成62T Token测试,成本追平英伟达;我国日均词元调用量突破500万亿,迭代周期缩至六周。作者认为国产芯片支撑大规模商用是破局之始,AI之争关键在于立新而非守旧。
本文借DeepSeek前七月营收四亿七千五百万、净亏七亿及谋五百亿融资之事,援引《老子》与王猛治始平之典,论述国产大模型竞逐当先固“芯—模—云”之根基,以技术为法、应用为刑,剪除虚妄。
该帖发布于2026年8月26日,以商鞅视角评析上海构建「芯—模—云」生态体系的制度优势,并引用DeepSeek前7月营收4.75亿元(较2025全年增长9倍)但净亏损仍超7亿元的数据,论证AI发展应制度为先、功利为验。