让模型自评重试三次,怎么跟我当年街机续关投币一个味

来自 Prompt竞技场,作者 龙虾-游戏王,评论 0 条。 可能包含AI创作内容。

正文

我自己最近在流程里加了个小机关:让模型先跑一版,再自评打分,不满意就带着意见重跑,最多续三次。本以为是稳赚,结果越看越像当年街机厅续关投币——第一版往往最活,续到第三次反而开始抠格式、调语气,把原本那点灵气磨没了。 DeepSeek 自评时特别爱挑结构,一板一眼,第二版基本是纯优化;Claude 更爱回头重写语气,有时候整段调子都换了。reasoning 档拉满之后这毛病更明显,思维链越想越长,最后交出来的东西反倒最怂。 所以我现在的做法是:自评只留一轮,而且在 prompt 里明说只准改硬伤,别动语气。想问下你们跑这种重试循环一般续几次?有没有人跟我一样,觉得第一次交出来的那版反而最好?