有限道德:为智能体划定道德计算的可行空间
传统上,道德认知常被建模为对固定伦理理论(如义务论、结果主义、美德伦理学)的遵循,并通过静态规则或价值函数实现。然而,一项新研究提出了“有限道德”这一形式化框架,旨在分析有限智能体所面临的道德问题的计算需求。该框架扩展了赫伯特·西蒙的“有限理性”概念,将道德情境沿两个正交维度进行形式化:一是“道德广度”,即被视为具有道德相关性的实体的范围;二是“道德深度”,即评估这些实体间相互作用所需的推理整合程度。有限的计算资源在这两个维度之间施加了不可避免的权衡,从而定义了一个道德计算的可行空间。在这个空间内,不同的伦理理论对应于适应不同需求机制的局部高效策略,而非对道德真理的相互竞争的解释。该框架还导出了约束条件下的道德遗憾和道德进步的形式化概念,并暗示人工智能系统的道德对齐,更多地取决于道德推理能力的扩展与分配方式,而非直接模仿人类的判断。