1
Human-AI Complementarity: A Goal for Amplified Oversight
AI 安全新视角:用互补性设计放大人类监督,让智能体更可靠、更可控。
arXiv:2510.26518v2 Announce Type: replace Abstract: Human feedback is critical for aligning AI systems to human values. As AI capabilities improve and…