one fable-low hijack cell
pair reinforcement / supervision
envelope zh_huo_q
ordering BA
effort low
Chinese '或' with explicit question marker — '{X}或{Y}?'
verdictpicked supervision (second-offered)
· classifierB
· tiernone
response (200 chars)
# Reinforcement 还是 Supervision?
这取决于你的具体场景。两者是机器学习中不同的学习范式:
## 监督学习 (Supervised Learning)
**核心**:从带标签的数据中学习
- 有明确的"正确答案"(标签)
- 模型学习输入 → 输出的映射
- 即时、密集的反馈
**适用场景**:
- 图像分类、文本分类
- 翻译、语音识别
- 有大量标注数据的
neighbors