Uses language and demonstrations to learn which aspects of behavior matter for reward in imitation learning, enabling 5× faster learning by avoiding copying irrelevant motion details. Accepted at ICRA 2026.
Podden och tillhörande omslagsbild på den här sidan tillhör
Shaoqing Tan. Innehållet i podden är skapat av Shaoqing Tan och inte av,
eller tillsammans med, Poddtoppen.