跳到正文
掘金· 码事漫谈·· 3 小时前AI 评分22

骂AI会让它做得更好吗?解析辱骂对大模型输出的真实影响

骂AI,会让它做得更好吗?

AI 导读

骂AI有时看似有效,并非它被骂醒,而是"重写"等词附带纠错信号、提高了约束强度。但辱骂会污染上下文,经RLHF对齐的模型会优先启动安抚模式,导致回答过度道歉、空洞甚至模仿攻击性语气。有效做法是给出具体修改要求、示例和分步反馈,而非情绪施压。

来源:掘金 · juejin.cn