跳转到内容
N.W.wolf XJTUROBOCON 四足组文档
搜索
Ctrl
K
取消
GitHub
选择主题
深色
浅色
自动
文档首页
团队与招新
团队与招新介绍
关于四足机器人
关于 ROBOCON
入门学习
入门学习概览
初期培训文档索引
开发基础
任务
Linux 系统及其操作:任务安排
开发基础概览
Linux 系统及其操作
Git/GitHub
Python/C++ 概念
计算机网络及 SSH
AI 与 Agent 协作
AI 与 Agent 协作概览
AI 与 Agent 基础认识
AI 工具选择与快速上手
与 AI 和 Agent 协作
机器人软件基础
机器人软件系统概览
机器人状态、关节与坐标系
机器人程序运行与数据流
ROS 2 快速认识与实践
四足强化学习与仿真
章节概览
基础理解
四足强化学习在系统中的位置
强化学习训练的基本闭环
四足训练任务的基本组成
仿真与任务构建
仿真环境与机器人模型
Observation 与 State
Action 与关节控制
Command 与任务目标
Reward 与 Episode
策略训练
PPO 与 Actor-Critic 概览
策略训练流程
训练参数与实验管理
策略评估与实验记录
泛化与迁移
地形与课程学习
Domain Randomization
Sim-to-Sim
Sim-to-Real
强化学习理论进阶 *
进阶资料概览
贝尔曼方程
动态规划
蒙特卡洛方法
时序差分方法
多步时序差分
资格迹与 TD(λ)
Dyna-Q
值函数近似
DQN
DQN 改进方法
策略梯度
Actor-Critic
实机部署与调试
内容占位
定位、导航与感知
内容占位
机械臂基础与控制
内容占位
工程实践
内容占位
参与协作
怎样协作文档
文档模板
GitHub
选择主题
深色
浅色
自动
Sim-to-Real
本页为章节占位,具体内容将在后续文档协作中补充。