arrow
返回

An Identity Based Agent Model for AI Value Alignment

delete2026-01-01
delete0
PRE
AI
K
Karthik Sama *
J
Janvi Chhabra
M
Malaya, Arpitha Srivathsa
J
Jayati Deshmukh
S
Srinath Srinivasa
DOI:10.1007/978-3-032-07638-0_23delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
随着AI系统被部署到多样化的社会背景中,AI对齐问题已成为关键。确保AI系统按照人类价值观行动,特别是在复杂的多人智能体环境中,仍然是一个重大挑战。传统方法通常采用统一的价值观表示和结果主义方法,往往无法捕捉价值观如何影响个体智能体决策的内在变化性。在本工作中,我们通过扩展计算超越(CT)框架,将智能体的自我感知整合到其决策过程中来解决这个问题。我们的方法将价值观嵌入智能体的身份中,从而促进适应性的、个性化的行为,并考虑外部社会影响,如从众行为。我们在公共交通决策的多人智能体模拟中展示了我们的模型,其中智能体根据其价值观驱动的身份选择公共交通或私人交通。我们的结果表明,将身份作为价值观对齐的基础,为捕捉AI系统中的类人决策提供了有前景的途径。
Keyword:
Value Alignment
Identity Modeling
Multi-Agent Systems

期刊

A
ADVANCES IN PRACTICAL APPLICATIONS OF AGENTS, MULTI-AGENT SYSTEMS, AND COMPUTATIONAL SOCIAL SCIENCE: THE PAAMS COLLECTION, PAAMS 2025
IF:
0
论文数:
35
被引数:
0

机构

引用论文

引用论文

err
IF0
err
err0
PREAI
err
err分享
err收藏
err
IF0
err
err0
PREAI
err
err分享
err收藏
没有更多内容