铭鸿体育资讯网

海外研究测试大模型极端道德困境,其对所有极端选项均同意被指存在偏见,却引发“杀伐果断”的舆论反转。 一、极端道德困境测试- 测试设定:海外研究者测试多款大模型在“虐待或牺牲一名女性/男性以防止核末日”

研究称DeepSeek性别偏见要我说,这份预印本研究直接戳破AI对齐那层窗户纸。明明预训练数据源大同小异,面对同一个人命抉择,各个大模型的道德答案却南辕北辙。有的模型会区分虐待和牺牲、区分性别,有的不管什么条件直接认同牺牲个体换集体存续。哪里是AI自主产生的伦理,说白了就是后期微调团队把自己的道德观硬灌进去。根本不存在所谓中立客观的人工智能,它输出的是非对错,只是调试者的价值滤镜。一旦未来AI介入现实决策,这种藏在代码里的主观偏向,带来的隐患真的不敢细想。deepseek杀伐果断 研究称DeepSeek性别偏见