标签 OpenDuckMini强化学习框架 下的文章
动作过滤
理解动作过滤,包含过滤方式,动作过滤流程和代码中的使用等
概述
动作过滤是确保策略输出平滑、自然的关键环节。Open Duck Playground 提供了三种不同层次的动作过滤方...
参考运动查看器
了解和熟悉参考运动查看器
概述
参考运动查看器(ref_motion_viewer.py)是一个独立的 3D 可视化工具,用于在 MuJoCo 环境中查看参考运动数据生成的步...
工具类
理解和使用相关便利工具
概述
工具类模块(playground/common/utils.py)提供了一些辅助功能,主要用于动作后处理和信号滤波。目前主要包含一个 LowPassAc...
参考运动生成
理解参考运动及生成,包含PolyReferenceMotion 类,速度到索引的映射,多项式采样,参考运动包含的维度和索引,可视化测试,与推理系统的交互和生成自己的参考运动等
...
模仿奖励
理解模仿奖励,包含控制开关,reward_imitation,参考运动整合,使用模仿奖励的步骤,模仿奖励的效果等
概述
模仿奖励(Imitation Reward)是 Open D...
核心奖励函数
理解核心奖励函数,包含跟踪奖励,能量奖励,姿态奖励,足部奖励和其他奖励等
概述
核心奖励函数定义在 playground/common/rewards.py 中,包含 18 个...
奖励系统
理解奖励系统,包含奖励结构,奖励分类,奖励组合模式,奖励函数详解,模仿奖励和奖励配置等
概述
奖励系统是强化学习的核心引导机制。Open Duck Playground 在 pla...
地形生成
理解地形生成,包含地形配置选项,场景文件结构,平坦地形,粗糙地形,渲染配置,初始姿态和地形选择策略等
概述
Open Duck Playground 中的地形通过 MuJoCo 的...
传感器配置
理解传感器及配置,包含传感器配置文件,传感器分类,传感器使用,传感器噪声模拟,接触检测和传感器在常量中的定义等
概述
Open Duck Mini V2 在 MJCF 模型中定义...
关节系统
理解机器人关节系统,包含关节分类,关节定义,驱动类型,回差建模和关节坐标系统等
概述
Open Duck Mini V2 的关节系统包括主动关节(由舵机驱动)、浮动基座关节(自由运...
机器人模型XML结构
理解机器人模型XML结构,包含MJCF 格式,Body/Joint 层级,主要 XML 元素,场景 XML 结构和include 机制等
MJCF 格式
MuJoCo ...
机器人模型
理解机器人模型,包含模型文件,机器人层级结构,运动学配置,动力学属性,执行器配置,物理引擎配置,碰撞几何和3D 视觉模型等
概述
Open Duck Mini V2 的机器人模型...
ONNX 集成
理解ONNX集成,包含OnnxInfer类,ONNX模型格式,从JAX到ONNX的转换,ONNX推理的性能,与MuJoCo推理的集成,导出与验证,部署到真实机器人和兼容性等
...
MuJoCo 推理
理解MuJoCo推理,包含MJInferBase 基类,MjInfer 主类,用户输入处理,实时步态周期,动作平滑滤波器等
概述
MuJoCo 推理系统是 Open Du...
推理系统
理解推理系统,包含推理管线,核心组件,推理流程,与训练环境的区别,用户输入处理,实时性能,观测保存,参考运动可视化和部署选项等
概述
推理系统(Inference System)负...
检查点与导出
理解检查点和导出,包含检查点保存,ONNX 模型导出,推理使用 ONNX 模型,从检查点恢复训练等
概述
训练过程中,系统的检查点和模型导出机制确保训练成果被持久化保存,并能够...
域随机化
理解域随机化,包含核心函数,随机化参数,随机化范围分析,实现细节,域随机化的作用,与训练系统的集成等
概述
域随机化(Domain Randomization) 是强化学习中一种重...
Runner 架构
理解Runner架构,包含数据流,基类,实现类,检查点系统,训练配置
概述
Runner 是训练系统的核心调度器,负责协调环境、策略、随机化和日志记录等组件。Open D...
训练系统
理解如何实现训练模型,包含训练管线,runner架构,PPO训练参数,回调机制,数据流,训练命令和技巧等
概述
Open Duck Playground 的训练系统基于 Brax ...
站立环境
理解机械鸭是如何实现站立和控制,包含类结构和方法,配置参数,奖励系统,命令采样,观测构建,训练方法等
概述
Standing 类(定义在 standing.py 中)与 Joyst...
- 1
- 2
- 后一页 »