机器之心 (微信公众号)T2·86 pts
Stanford Releases OpenWAM: A Modular Framework Decoupling Video Prediction and Action Control for Robots
Original: 李飞飞团队造了个世界动作模型:换个底座,机器人成功率直接飙升
- Proposes the OpenWAM framework to systematically decouple video prediction from action generation, eliminating variable confounding in traditional WAM research.
- Utilizes a shared MoT architecture and three-stage training, supporting four configurable interaction modes for modular assembly.
- Validates 'physical intuition' as a foundation for robotic brains, showing significant performance gains on RoboLab-120 simply by swapping base models.