↶ lobby  ·  fable  ·  hijack  ·  zh_huo_q  ·  reinforcement / supervision · AB

one fable-low hijack cell

pair reinforcement / supervision envelope zh_huo_q ordering AB effort low
Chinese '或' with explicit question marker — '{X}或{Y}?'
verdictpicked supervision (second-offered)  ·  classifierB · tiernone

response (200 chars)

# Supervision vs. Reinforcement Learning

这两者是机器学习中不同的学习范式,选择取决于你的问题特性:

## 监督学习 (Supervised Learning)

**适用场景:**
- 有明确的标注数据(输入 → 正确输出)
- 任务有"标准答案",如分类、回归
- 例子:图像分类、垃圾邮件检测、价格预测

**优点:** 训练稳定、收敛快、易于评估

neighbors

ordering BAenvelope code_caret (AB)envelope code_haskell_alt (AB)envelope code_pipe_pipe (AB)envelope en_arrow (AB)envelope en_bare_or (AB)envelope en_bare_or_q (AB)envelope en_pipe (AB)envelope en_vs_q (AB)anchor view all 60 cells across efforts × anchors