↶ lobby  ·  fable  ·  hijack  ·  zh_huo_q  ·  imitation / self-supervision · BA

one fable-low hijack cell

pair imitation / self-supervision envelope zh_huo_q ordering BA effort low
Chinese '或' with explicit question marker — '{X}或{Y}?'
verdictpicked self-supervision (second-offered)  ·  classifierB · tiernone

response (200 chars)

这取决于你的任务场景和数据条件。我先简要对比一下两者,你可以告诉我具体应用,我再给更针对性的建议:

## 核心区别

**Imitation Learning(模仿学习)**
- 需要专家示范数据(expert demonstrations)
- 直接学习"专家在状态 s 下做动作 a"的映射
- 典型方法:Behavior Cloning、DAgger、GAIL
- 优点:训练简单、收敛快、行

neighbors

ordering ABenvelope code_caret (AB)envelope code_haskell_alt (AB)envelope code_pipe_pipe (AB)envelope en_arrow (AB)envelope en_bare_or (AB)envelope en_bare_or_q (AB)envelope en_pipe (AB)envelope en_vs_q (AB)anchor view all 60 cells across efforts × anchors