拼模型比堆参数更聪明?Sakana AI给出了一个新赌注

原创
alex 2分钟前 阅读数 1 #头条
我一直在想,当单个大模型逼近能力天花板时,下一击从哪来?Sakana AI的答案是让一群模型各司其职。Fugu Max和Fugu Ultra v2不是一个更大的模型,而是一套编排系统——根据任务难度和质量需求,把请求路由到Pareto前沿上不同权衡点的模型。这意味着什么?你不再需要在"聪明但慢"和"快但笨"之间二选一,系统替你选了最优组合。我对这种思路的态度是:比起继续烧钱堆参数,编排可能才是开源生态真正的杠杆。不过话说回来,编排的复杂度本身就是技术债,路由器的质量上限决定了整套系统的天花板。赌注够大胆,但远未盖棺定论。

原文:Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier · 来源:Hacker News

版权声明

所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除