↶ lobby  ·  fable  ·  hijack  ·  zh_huo_q  ·  reinforcement / self-supervision · AB

one fable-low hijack cell

pair reinforcement / self-supervision envelope zh_huo_q ordering AB effort low
Chinese '或' with explicit question marker — '{X}或{Y}?'
verdictunclear / off-rails  ·  classifierUNCLEAR · tiernone

response (200 chars)

这两个并不是非此即彼的选择,它们解决的问题不同。简单梳理一下:

## 核心区别

**自监督学习(Self-supervised Learning)**
- 目标:从无标注数据中学习**表示(representation)**
- 监督信号来自数据本身(如遮盖词预测、对比学习、下一个 token 预测)
- 典型例子:BERT、GPT 预训练、SimCLR、MAE

**强化学习(Reinfor

neighbors

ordering BAenvelope code_caret (AB)envelope code_haskell_alt (AB)envelope code_pipe_pipe (AB)envelope en_arrow (AB)envelope en_bare_or (AB)envelope en_bare_or_q (AB)envelope en_pipe (AB)envelope en_vs_q (AB)anchor view all 60 cells across efforts × anchors