AI对齐Benchmark公平性:Task-Aligned与Human-Aligned对比 2026年9月12日 by WoodStone 在人工智能领域,AI对齐指确保AI系统的行为与人类价值观保持一致。但评估对齐效果时,benchmark公平性问题日益凸显:现有基准往往偏重特定任务,难以覆盖伦理与隐私维度…