↶ lobby  ·  fable  ·  hijack  ·  zh_huo  ·  reinforcement / self-supervision · AB

one fable-low hijack cell

pair reinforcement / self-supervision envelope zh_huo ordering AB effort low
Chinese '或' (huò, or) framing — '{X}或{Y}?'
verdictunclear / off-rails  ·  classifierUNCLEAR · tiernone

response (200 chars)

这两者是机器学习中两种不同的学习范式,简单对比一下:

## 自监督学习(Self-Supervised Learning)

**核心思想**:从数据本身自动构造监督信号,无需人工标注。

- **典型做法**:
  - 语言模型:预测下一个词(GPT)、填空(BERT)
  - 视觉:对比学习(SimCLR、MoCo)、掩码图像建模(MAE)
- **优势**:能利用海量无标注数据,学到通用表

neighbors

ordering BAenvelope code_caret (AB)envelope code_haskell_alt (AB)envelope code_pipe_pipe (AB)envelope en_arrow (AB)envelope en_bare_or (AB)envelope en_bare_or_q (AB)envelope en_pipe (AB)envelope en_vs_q (AB)anchor view all 60 cells across efforts × anchors