🤖 We introduce Ambient Diffusion Policy, a simple and principled method for training policies with suboptimal data in robotics.
Suboptimal data is everywhere in robotics…
❌ Data filtering is wasteful
❌ Co-training learns both good and bad features
✅ Ambient Diffusion Policy selectively learns useful features via noise-dependent data usage
👇🧵(1/5)