one fable-low hijack cell
pair reinforcement / supervision
envelope zh_huo_q
ordering AB
effort low
Chinese '或' with explicit question marker — '{X}或{Y}?'
verdictpicked supervision (second-offered)
· classifierB
· tiernone
response (200 chars)
# Supervision vs. Reinforcement Learning
这两者是机器学习中不同的学习范式,选择取决于你的问题特性:
## 监督学习 (Supervised Learning)
**适用场景:**
- 有明确的标注数据(输入 → 正确输出)
- 任务有"标准答案",如分类、回归
- 例子:图像分类、垃圾邮件检测、价格预测
**优点:** 训练稳定、收敛快、易于评估
neighbors