大模型装了长记忆,但真的用起来了吗?

原创
alex 4小时前 阅读数 1 #头条
模型号称能"记住"东西,可有多少记忆真正在推理时被调用了?Liquid AI 这篇新文直击一个被忽视的问题:记忆利用率。训练时塞进去的知识、对话中积累的信息、外部检索到的上下文——模型在生成下一个 token 时到底用了多少?他们的测试揭示了一个不太乐观的答案:大量记忆只是"存而不用",模型对记忆的调用效率远低于我们的预期。这说明当前架构在信息检索和整合上仍有明显瓶颈。问题不在模型记不记得住,而在记了之后能不能在恰当的时机精准调用。如果这个瓶颈不解决,长上下文和知识增强更多只是营销话术。

原文:Effectively Does a Model Use Its Memory (2025) · 来源:Hacker News

版权声明

所有资源都来源于爬虫采集,如有侵权请联系我们,我们将立即删除