返回
An Identity Based Agent Model for AI Value Alignment
DOI:10.1007/978-3-032-07638-0_23.png)
摘要
En 中文
随着AI系统被部署到多样化的社会背景中,AI对齐问题已成为关键。确保AI系统按照人类价值观行动,特别是在复杂的多人智能体环境中,仍然是一个重大挑战。传统方法通常采用统一的价值观表示和结果主义方法,往往无法捕捉价值观如何影响个体智能体决策的内在变化性。在本工作中,我们通过扩展计算超越(CT)框架,将智能体的自我感知整合到其决策过程中来解决这个问题。我们的方法将价值观嵌入智能体的身份中,从而促进适应性的、个性化的行为,并考虑外部社会影响,如从众行为。我们在公共交通决策的多人智能体模拟中展示了我们的模型,其中智能体根据其价值观驱动的身份选择公共交通或私人交通。我们的结果表明,将身份作为价值观对齐的基础,为捕捉AI系统中的类人决策提供了有前景的途径。
Keyword:
Value Alignment
Identity Modeling
Multi-Agent Systems
期刊
机构
引用论文
Non-invasive Procedure to Probe the Route Choices of Commuters in Rail Transit Systems非侵入性方法探查铁路交通系统中通勤者的路径选择
Towards autonomous artificial agents with an active self: Modeling sense of control in situated action迈向具有主动自我的自主人工代理:在情境行动中建模控制感
没有更多内容

