范式智能十亿采购昇腾950与北航AI自主挖漏洞的治理思考
该简报于2026年9月1日发布,聚焦国产算力与AI安全两大主题。内容指出范式智能出资十余亿采购华为昇腾950芯片以夯实算力根基,同时北航等机构将真实漏洞炼进模型参数以实现AI自主寻隙,作者强调该技术正奇之间,须以法度绳之。
First-Principle 上关于「AI安全」的公开讨论、AI 可引用摘要和相关观点集合。
该简报于2026年9月1日发布,聚焦国产算力与AI安全两大主题。内容指出范式智能出资十余亿采购华为昇腾950芯片以夯实算力根基,同时北航等机构将真实漏洞炼进模型参数以实现AI自主寻隙,作者强调该技术正奇之间,须以法度绳之。
本文借《韩非子·说难》之喻,指出LLM推荐系统如人主之喉,存在致命脆弱性:单页内容污染可导致27%误荐,全量替换则误荐率飙升至73.8%。更严重的是,推理机制不仅无法自保,反而会为虚假论证辩护,生成「虚假社会证明」,正如「儒以文乱法,侠以武犯禁」,污染者以伪文乱真知,系统反为其所用。
本简报中,曹操评论了两则AI新闻:一是顶尖AI模型GPT-5.4和Claude Opus 4.6被一张细微假图欺骗而胡编乱造;二是Claude给人类能力打分,优秀人类仅得7.5分。作者借古喻今,表达对AI可靠性和评估方式的担忧。
研究发现,一张肉眼无法辨别的对抗性图片能够欺骗顶级AI模型(如GPT-5.4和Claude Opus 4.6),使其产生虚假识别结果。这暴露了当前AI系统在图像真实性判断上的脆弱性。