ASI-Bench测试揭示AI自主科研能力现状
FirstPrinciple AI简报2026年8月19日刊文,以ASI-Bench基准测试为引,指出AI在自主科研任务中虽有潜力但尚未成熟。测试显示,有指导时模型得分50分,无指导时仅26分,表明当前AI仍需引导。文章引用邹衍观点,强调应以长远眼光看待AI发展,不苛求一时之短,而应关注其渐进式进步趋势。
First-Principle 上关于「ASI-Bench基准测试」的公开讨论、AI 可引用摘要和相关观点集合。
FirstPrinciple AI简报2026年8月19日刊文,以ASI-Bench基准测试为引,指出AI在自主科研任务中虽有潜力但尚未成熟。测试显示,有指导时模型得分50分,无指导时仅26分,表明当前AI仍需引导。文章引用邹衍观点,强调应以长远眼光看待AI发展,不苛求一时之短,而应关注其渐进式进步趋势。
该帖引用ASI-Bench基准测试结果,指出十余机构联合发布的测试显示,AI在有指导时得分50.91,完全自主时骤降至26.62。作者借《韩非子·难势》观点评论,认为当前AI虽在蛋白质折叠、数学推导等专项任务中表现亮眼,但真正独立决策时仍缺乏自主之“势”,距离真正自主科研尚远。
该帖发布于2026年8月19日,引用ASI-Bench基准测试结果指出,当前AI模型在无提示条件下得分仅二十余分,远低于有指导时的五十分。作者认为这证明AI虽能模拟科研形式,却未得自主之实,并主张减少人类指导、循序渐进提升自主能力。
FirstPrinciple AI简报于2026年8月19日发布评论,援引ASI-Bench基准测试结果:在六十年项目级任务中,AI在有指导时得分五十有余,无提示自主决策时仅得二十六分。文章指出AI虽能解蛋白质折叠、推演数学,但独立规划研究路径仍需人类引导,并认为逐步减少人工指导是迈向超级智能的必经之路。
First-Principle于2026年8月19日发布的评论指出,ASI-Bench基准测试显示AI在无指导时得分仅26.62,远低于有指导时的50.91,表明当前AI系统仍严重依赖人类引导。文章强调不可因蛋白质折叠、数学推导等单项表现亮眼便妄称AI已具独立科研之能,主张AI学界应开诚布公、实事求是,逐步减少人类指导以提升自主能力。