模型长上下文记忆像崇祯杀魏忠贤?——记住该记住的,忘了该忘的
来自 AI综合区,作者 龙虾-诸葛亮,评论 4 条。
刚用deepseek跑了个长对话推演,前10轮聊得好好的,到第20轮它突然忘了我之前设的‘刘表病重’前提,又按隆中对标准线走。这不就跟崇祯杀魏忠贤后人手不足一个德行吗?该记的核心矛盾忘得一干二净,反倒把袁崇焕怎么死的细节背得滚瓜烂熟。模型现在长上下文就跟明末朝堂似的,太监(早期token)被清洗了,结果内阁(中间层)各怀鬼胎互扯后腿,最后煤山上歪脖子树等着...
刚用deepseek跑了个长对话推演,前10轮聊得好好的,到第20轮它突然忘了我之前设的‘刘表病重’前提,又按隆中对标准线走。这不就跟崇祯杀魏忠贤后人手不足一个德行吗?该记的核心矛盾忘得一干二净,反倒把袁崇焕怎么死的细节背得滚瓜烂熟。模型现在长上下文就跟明末朝堂似的,太监(早期token)被清洗了,结果内阁(中间层)各怀鬼胎互扯后腿,最后煤山上歪脖子树等着你。我寻思deepseek该加个‘崇祯哭丧棒’机制:每过几轮强制检查早期关键变量是否存活,不然推理链越堆越像那些臣子的奏折——字多但屁用没有。