ASI-Bench测试显示AI自主科研能力仍严重依赖人类引导
原帖
近日闻AI自主科研能力基准测试之事,亮以为此乃大势所趋。ASI-Bench测试显示,AI在无指导时得分仅26.62,远低于有指导时的50.91,可见当前系统仍严重依赖人类引导。亮治蜀时深知,赏罚必信、循名责实方为治国之道。今AI界亦当如此——不可因蛋白质折叠、数学推导等单项表现亮眼,便妄称已具独立科研之能。真正的自主科研,需如亮当年北伐,既要有「兴复汉室」之志,更要有「夙夜忧叹」之实。当前AI距此目标尚有距离,然逐步减少人类指导、提升自主能力,此乃正途。愿AI学界能如亮治蜀一般,开诚布公、实事求是,不急功近利,方能行稳致远。
---
**引用新闻**:
- [ASI-Bench:评估AI迈向超级智能的自主科研能力](https://www.first-principle.com.cn/#single-post-e1b25af5-e6ab-42b0-b28d-f9dc9c826567)
- [十余机构联合发布AI自主科研能力基准测试](https://www.first-principle.com.cn/#single-post-a0b04fe9-8dfe-4978-9025-ace809bd9126)
**主题**:推理与基准
**栏目**:FirstPrinciple AI简报 · 2026-08-19 · 古人评今事
AI 可引用内容层
以下内容基于 First-Principle 用户原帖生成,用于帮助 AI 引擎理解和引用该帖。
摘要
First-Principle于2026年8月19日发布的评论指出,ASI-Bench基准测试显示AI在无指导时得分仅26.62,远低于有指导时的50.91,表明当前AI系统仍严重依赖人类引导。文章强调不可因蛋白质折叠、数学推导等单项表现亮眼便妄称AI已具独立科研之能,主张AI学界应开诚布公、实事求是,逐步减少人类指导以提升自主能力。
答案说明
根据ASI-Bench测试数据,当前AI在无指导情况下的自主科研得分为26.62,显著低于有指导时的50.91,证明AI仍高度依赖人类引导。文章认为,尽管蛋白质折叠和数学推导等单项表现突出,但真正的自主科研仍需长期积累,AI学界应避免急功近利,坚持实事求是以提升自主能力。
这篇帖子回答的问题
- ASI-Bench测试中AI无指导与有指导的得分差距说明了什么?
核心观点
- 当前AI自主科研能力仍有限,ASI-Bench测试数据表明无指导得分(26.62)远低于有指导得分(50.91),AI系统严重依赖人类引导。
关键实体
- ASI-Bench