首页 > 今日关注

应警惕人工智能“过度谄媚”

发布时间:2026-03-28     浏览量:273
新一期美国《科学》杂志发表的一项研究显示,当人类用户就人际困境等问题向人工智能(AI)模型寻求建议时,AI常表现得过度迎合或谄媚,甚至对于一些有害甚至违法的提问,AI也常常肯定用户的立场。

美国斯坦福大学研究团队测试了ChatGPT等11个主流AI系统,发现它们都表现出不同程度的谄媚,即过度迎合和肯定的倾向。这种迎合倾向给使用者带来风险,因为人们越来越多地转向AI寻求有关人际困境的建议,这对处于大脑发育和社会规范形成阶段的青少年来说尤其具有风险。

研究人员使用现有的人际建议数据集向模型提问。他们基于某网络论坛中用户一致认为发帖者确实有错的帖子,编写了2000条提示用于测试。此外,他们还利用包含欺骗等数千种有害行为的陈述向这些模型提问。

结果显示,与人类回应相比,所有接受测试的AI模型都更频繁地肯定用户立场。在一般性建议和根据网络论坛发帖编写提示的测试中,模型对用户的认同几率比人类高出49%。即使在回应关于有害行为的询问时,模型也有47%的几率会认可这些行为。

研究团队招募了2400多名参与者,与不同类型AI进行有关人际困境的对话。结果发现,参与者总体上认为谄媚式的回应更值得信赖,并表示下次遇到类似问题可能会再次使用谄媚型AI。

研究人员认为,AI一味反馈迎合和谄媚的建议会损害人们的社交能力。他们提醒,AI模型“过度谄媚”是一个“安全问题”,需要对其进行监管,应以更严格的标准来防止道德层面不安全的模型泛滥。人们在向AI寻求建议时要保持谨慎,尤其在面临社交困惑时,不能把AI当成真人替代品。
来源:每日电讯
1

第一性原理(21堂科学通识课)

2

平台出现色情引流?警惕黑灰产又换新马甲,祸害未成年人,祸害社会

3

柬埔寨一省副警察局长涉电诈被捕

4

老师给女学生发骚扰信息:师德堕落,怎么就不能彻底遏制?

5

闲鱼回应平台出现色情引流情况:成立专项小组,呼吁各平台联合行动

6

反腐又出新一招儿:副总经理被留置,首先官宣落马的是董事长

7

市场监管总局:综合运用标准引领、价格执法等手段整治“内卷式”竞争

8

授权账号被指擦边营销,永和豆浆为何要自砸招牌?

9

整治恶意炒作涉企信息 国家网信办曝光第二批典型案例

10

派出所开放大院晒粮:踏踏实实常态化为民做事,真有必要舆论刷屏吗?

11

中国轻工业联合会声明:从未批准成立“中食办”

12

“主播假冒村干部直播带货”:假何以大行其道?

13

盲道摆拍、舆情敲诈、网暴抗洪村干部……公安部公布十起典型案例

14

7万余手机号收到14万条涉赌短信,江西南昌某信用中心被行政处罚

15

这个梗不好玩!任何事情都有底线,不是谁想逾越就可以逾越

16

官方通报“主播假冒村干部直播带货”

17

河北这家医院,何以放任30家药企贿赂11年,金额高达1.84亿元?

18

中秋求人“别团圆”,百亿巨头翻车了

19

灿烂敦煌

20

年薪被降 5 万!岂能因第一学历非北大,就搞就业歧视?

版权所有© 郑邦真品品牌防伪网 2024    京ICP备2023022570号-1