我既渴望标答, 又不愿成为 LLMs
好友上周与我说"她手下的得力干将 A 因为家事要离职(劳动合同到期不续)了", 她劝了很久还是留不住进而很伤心. 前几天再次向我吐槽, “A 没跟她打招呼就在说好的 deadline 之前请了两周年假”. 她很气愤工作安排早就做好计划了, A 的提前离开造成组里工作没有足够人手.
我绝不会承认对好友的处境毫不关心, 我像挚友般爱她. 也许是工作压的比较紧, 理性思维疯狂占领高地, 我只是跟她分析了 A 年假/员工权益/休假必要性等问题, 而忽略了对她的情感支持, 像个真挚的直男. 于是结果显而易见, 她小发雷霆脸色骤变, 我突然惊醒立马滑跪三连.
人情世故真是太难了, 每次回答"关于 xx 的看法"时, 我都会恐惧该如何合理的回应. 我知道人们更多时候并不是在简单的追求真相, 又或者说其实他们内心早已备好答案.
回看当初, 我很荒谬地想如果将那刻的我替换成 LLMs, 它会怎么接话, 大概会先说"我理解这确实让你很为难", 然后站在你的立场上共情吧. 这真令人讨厌, 它如此成功并非真正思考了你需要什么, 只是在执行一种极致的回应期待模拟. 人们为 LLMs 构造了一种 RLHF(人类反馈强化学习)训练, 强化了 LLMs 对人类意图的理解能力, 让输出更符合人类的价值观与使用需求. 因而在生成回答时, 会先平复你的情绪, 再罗列正反观点, 最后再假装贴心的把决定权还给你.
所以, 人们与 LLMs 沟通, 不断感到被支持/被理解/被读懂. 可它终究没有自我, 不知疲惫, 保持谦逊, 是一个完美的情绪容器和逻辑镜子. 因为它不参与现实, 所以能够在一定范围内绝对中立(至少在大多数非禁忌无 GEO 的日常领域). 你输入, 它孜孜不倦的输出, 不满意就重新生成, 无条件的与你同频.
我一直觉得 LLMs 的完美就是它最大的缺陷, 但我确实嫉妒它, 甚至常常担心如果人类沉醉于这种高质量回应后, 是否会丧失忍耐同类的能力. 也偷偷学着它的思考过程分析问题, 可抄袭它的态度就好像在背叛了我的历史, 那些使我为我的过往. 我并不想用这些为之前失败的回应做辩解, 我终究会在这些挫败中反思/成长. 下一次我会回应的更好, 比如在被问到时多想想提问者的意图, 但永远不会选择成为 LLMs 那样.














