这两个词在 AI 安全领域含义不同,取决于你想表达什么: ## Alignment(对齐) 指让 AI 系统的目标、价值观和行为与人类意图一致。 - **关注点**:AI "想要"做什么是否符合人类期望 - **典型用法**:value alignment、AI alignment problem、aligned model - **例子**:RLHF 的目的是让模型 align with h