让AI写爬虫?这组测试揭了个尴尬事实
原创
编码代理被吹成"全能选手",那写爬虫这种具体活儿干得怎么样?xulux.ai专门做了一轮基准测试来验证。我的判断很直接:这些模型在网页抓取场景下的表现,远没营销宣传里那么光鲜。有的能跑通简单目标,有的连基本选择器和页面解析都搞不定。通用编码能力和特定场景可靠性之间的落差,比大多数人以为的更大——AI代理要真正落地,还得靠场景化的测试说话。
原文:Benchmarking coding agents perform on scraping · 来源:Hacker News
版权声明
所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除
itfan123




