AI研究能力有了新标尺:能自我进化才算真智能?
原创
AI能不能自己做研究、自己变强?Bespoke Labs刚扔出AutoResearchExam,专测智能体在无人监督下的自主改进与跨任务迁移能力。以前的基准多问"会不会做题",这个问的是"能不能越做越好、换个题也做得来"。我觉得方向对了——AI连自我迭代都不会,谈通用智能就是空话。不过HN上1赞0评论说明它还没激起水花,要么内容太干,要么圈子太小。但意图值得认真对待:AI的天花板不在答题,在于学会怎么变强。
原文:AutoResearchExam: Measuring agents' ability to improve and generalize · 来源:Hacker News
版权声明
所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除
itfan123




