教程 OpenDuckMini强化学习框架入门教程 下的文章
核心奖励函数
理解核心奖励函数,包含跟踪奖励,能量奖励,姿态奖励,足部奖励和其他奖励等
概述
核心奖励函数定义在 playground/common/rewards.py 中,包含 18 个...
模仿奖励
理解模仿奖励,包含控制开关,reward_imitation,参考运动整合,使用模仿奖励的步骤,模仿奖励的效果等
概述
模仿奖励(Imitation Reward)是 Open D...
参考运动生成
理解参考运动及生成,包含PolyReferenceMotion 类,速度到索引的映射,多项式采样,参考运动包含的维度和索引,可视化测试,与推理系统的交互和生成自己的参考运动等
...
工具类
理解和使用相关便利工具
概述
工具类模块(playground/common/utils.py)提供了一些辅助功能,主要用于动作后处理和信号滤波。目前主要包含一个 LowPassAc...
参考运动查看器
了解和熟悉参考运动查看器
概述
参考运动查看器(ref_motion_viewer.py)是一个独立的 3D 可视化工具,用于在 MuJoCo 环境中查看参考运动数据生成的步...
动作过滤
理解动作过滤,包含过滤方式,动作过滤流程和代码中的使用等
概述
动作过滤是确保策略输出平滑、自然的关键环节。Open Duck Playground 提供了三种不同层次的动作过滤方...
- « 前一页
- 1
- 2