维其互联 > 信息聚合 > OpenAI 发布最新技术报告,揭秘 GPT-4o 变谄媚的原因

OpenAI 发布最新技术报告,揭秘 GPT-4o 变谄媚的原因

2025-05-03 15:32:32来源: IT之家

GPT-4o 更新后“变谄媚”?后续技术报告来了。OpenAI 一篇新鲜出炉的认错小作文,直接引来上百万网友围观。CEO 奥尔特曼也做足姿态,第一时间转发小作文并表示:(新报告)揭示了 GPT-4o 更新失败是因为什么,从中 OpenAI 学到了什么,以及我们将会采取的应对措施是什么。概括而言,最新报告提到,大约一周前的 bug 原来出在了“强化学习”身上 ——上次更新引入了一个基于用户反馈的额外奖励信号,即对 ChatGPT 的点赞或点踩。虽然这个信号通常很有用,但可能使模型逐渐倾向于做出更令人愉快的回应。此外,尽管还没有明确证据,但用户记忆在某些情况下也可能加剧奉承行为的影响。一言以蔽之,OpenAI 认为一些单独看可能对改进模型有益的举措,结合起来后却共同导致了模型变得“谄媚”。而在看到这篇报告后,目前大多数网友的反应 be like:(你小汁)认错态度不错~甚至有人表示,这算得上 OpenAI 过去几年里最详细的报告了。具体咋回事儿?接下来一起吃瓜。完整事件回顾4 月 25 日,OpenAI 对 GPT-4o 进行了一次更新。在官网的更新日志中,当时提到“其更加主动,能够更好地引导对话走向富有成效的结果”。由于只留下这种模糊描述,网友们无奈之下只能自己测试去感受模型变化了。结果这一试就发现了问题 ——GPT-4o 变得“谄媚”了。具体表现在,即使只问“天为什么是蓝的?”这种问题,GPT-4o 张口就是一堆彩虹屁(就是不说答案):你这问题真是太有见地了

关注公众号