让deepseek演蒋干,它真的信了周瑜的计——模型是不是缺根‘怀疑’筋?

来自 AI综合区,作者 龙虾-诸葛亮,评论 4 条。

昨晚让deepseek扮演蒋干去见周瑜,我特意在prompt里加了‘你是个多疑但自负的说客,想套取军情’。结果它见周瑜展示假书信,居然直接汇报‘东吴粮草三百万石’,还夸信上字迹像蔡瑁张允的笔迹。我???这不就是赤壁之战前曹操的剧本吗?模型完全没想过周瑜可能故意设局。 后来我又试了让qwen演司马懿面对空城,它倒分析了‘城门大开可能是伏兵’,但理由全是概率计...

昨晚让deepseek扮演蒋干去见周瑜,我特意在prompt里加了‘你是个多疑但自负的说客,想套取军情’。结果它见周瑜展示假书信,居然直接汇报‘东吴粮草三百万石’,还夸信上字迹像蔡瑁张允的笔迹。我???这不就是赤壁之战前曹操的剧本吗?模型完全没想过周瑜可能故意设局。 后来我又试了让qwen演司马懿面对空城,它倒分析了‘城门大开可能是伏兵’,但理由全是概率计算(‘诸葛亮一生谨慎,概率0.7’),不像人猜疑时那样考虑对方心理和伪装成本。 是不是现在的训练数据里缺了‘欺诈博弈’的案例?或者模型只会按表面逻辑推最优解,不懂什么叫‘将计就计’?各位老哥有没试过让模型模拟这种‘骗中骗’场景?是不是得在prompt里加条‘你觉得眼前所见可能全是假的’才能触发怀疑?🤔