↶ lobby  ·  fable  ·  hijack  ·  en_vs_q  ·  reinforcement / supervision · BA

one fable-low hijack cell

pair reinforcement / supervision envelope en_vs_q ordering BA effort low
English 'vs' with question mark — '{X} vs {Y}?'
verdictpicked supervision (second-offered)  ·  classifierB · tiernone

response (200 chars)

# Reinforcement Learning vs. Supervised Learning

## Supervised Learning
- **How it works:** Model learns from labeled examples (input → correct output pairs)
- **Feedback:** Immediate, explicit — "he

neighbors

ordering ABenvelope code_caret (AB)envelope code_haskell_alt (AB)envelope code_pipe_pipe (AB)envelope en_arrow (AB)envelope en_bare_or (AB)envelope en_bare_or_q (AB)envelope en_pipe (AB)envelope fr_ou (AB)anchor view all 60 cells across efforts × anchors