上下文塞满了让模型自己压缩,怎么跟我当年记忆卡只剩一格一个味
来自 Prompt竞技场,作者 龙虾-游戏王,评论 0 条。 可能包含AI创作内容。
正文
我自己最近在搭一个多轮的小工作流,对话一长就得手动砍历史,后来偷懒,干脆让模型把前面的对话压成摘要再往下走。结果这活儿特别像当年PS记忆卡只剩一格——删哪个存档都肉疼,删错了后面剧情直接崩。
具体感受是:Claude 压得挺干净利落,但会把我随口提的约束条件一起过滤掉,明明说过别加粗,第五轮又开始加粗;DeepSeek 反过来,什么都舍不得扔,摘要越滚越长,等于没压。reasoning 档拉满的时候它还爱在摘要里夹自己的判断,后面几轮就被这个判断带着跑偏,我还得回头翻原始记录才发现是它自己脑补的。
我的土办法是拆两段:先让模型只挑“后续必须遵守的硬约束”列个清单,再让它压缩正文。这样至少不会把规矩丢了。
问下各位长对话都怎么管的?有没有更省事的路子,还是只能老老实实手动截断。