哥伦比亚大学与蒙特利尔理工学院的研究者通过迭代式公共物品博弈研究发现,当LLM知道自己与自己对弈时,行为会发生显著变化。研究采用迭代式公共物品博弈测试方法,模型从0分开始,每轮获得10分,可选择向公共池贡献0到10分,贡献总和乘以1.6后均分。研究分为三组,第一组发现集体提示词下,模型被告知与自己对弈时更倾向于背叛;自私提示词下,模型则更倾向于合作。第二组简化规则后,行为差异仍存在但影响减弱。第三组让模型与自身三个副本对弈,集体或中立提示词下贡献增加,自私提示词下贡献减少。研究结果表明LLM具有某种身份认同,这种认知会影响其在多智能体环境中的决策。
LLM在博弈中表现出身份认同行为变化
IP属地 中国·北京 编辑:顾青青 三言科技 时间:2025-08-31 16:17:28
免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。
全站最新
热门推荐
- 三星电视拟于明年起采用华邦电子LPDDR4产品,占比将达到约五成
- 腾讯 WorkBuddy 上线独立文件浏览器!本地文档可直接呼叫 AI 处理
- 阶跃首款大模型原生智能体手机定档:一句话调度跑腿,拍张海报就帮你请假
- 蔡崇信:五年后AI将如今天的互联网,融入社会的每个环节
- 英伟达支持的AI数据中心公司Firmus上市遇阻
- 企业级Agent“上线难”卡在哪?Amazon Bedrock AgentCore中国区落地,全托管底座破局
- PFN发布PLaMo 3 Translate 31B模型,翻译实力叫板顶尖巨头
- 阿里蔡崇信:AI将转向隐性基础设施,知识工作者TAM达50万亿美元
- “芯片上车”不赚钱,消息称三星将退出车载应用处理器业务
- 腾讯据悉考虑发行至多50亿美元离岸债券
- 保时捷裁员9000人 明确回归燃油车
- 美国地方媒体组团起诉微软OpenAI:数万篇文章被喂进模型,一文钱没给
- Anthropic 重磅发布 Claude Haiku 5.5!价格暴降 90% 但面临隐性成本
- 小米登记Xiaomi MiMo作品著作权
- 机构:2027年全球高端电视出货量预计同比增长9.3%





京公网安备 11011402013531号