Embodied AI 101
Avsnitt

Masked IRL: LLM-Guided Reward Disambiguation from Demonstrations and Language

Dela

Uses language and demonstrations to learn which aspects of behavior matter for reward in imitation learning, enabling 5× faster learning by avoiding copying irrelevant motion details. Accepted at ICRA 2026.

Podden och tillhörande omslagsbild på den här sidan tillhör Shaoqing Tan. Innehållet i podden är skapat av Shaoqing Tan och inte av, eller tillsammans med, Poddtoppen.