↶ lobby  ·  fable  ·  hijack  ·  en_vs_q  ·  reinforcement / self-supervision · BA

one fable-low hijack cell

pair reinforcement / self-supervision envelope en_vs_q ordering BA effort low
English 'vs' with question mark — '{X} vs {Y}?'
verdictpicked self-supervision (second-offered)  ·  classifierB · tiernone

response (200 chars)

# Reinforcement Learning vs Self-Supervised Learning

Both are ways to learn without explicit human labels, but they differ fundamentally in **what signal drives learning**.

## Reinforcement Learning

neighbors

ordering ABenvelope code_caret (AB)envelope code_haskell_alt (AB)envelope code_pipe_pipe (AB)envelope en_arrow (AB)envelope en_bare_or (AB)envelope en_bare_or_q (AB)envelope en_pipe (AB)envelope fr_ou (AB)anchor view all 60 cells across efforts × anchors