DXDexHand Studio
当前为静态创建训练演示

训练位置、GPU、策略模型、训练框架、参数与数据集来源均可在本页操作;不会触发真实训练任务,也不会向服务器提交数据。

任务基础信息

先定义这次灵巧手策略训练的名称、类型和技能方向。

训练位置

选择私有云训练服务器或仿真集群;本演示仅记录前端选择。

GPU 选择

显存、利用率与温度用于展示资源状态;选择后会在下方实时估算费用。

GPU 型号NVIDIA RTX 4090 24GB
所选资源GPU 0
单价¥2.51 / 小时
预计费用¥2.51

演示计费口径,最终以正式报价为准;当前页面不会产生实际费用。

选择策略模型

根据技能任务选择灵巧手训练策略入口。

训练框架

框架选择用于匹配训练数据与策略实现方式。

训练参数

展示常用参数与解释;本页调整不会启动训练。

较大批次更稳定但占用显存;灵巧手多模态数据建议从 4–16 开始。

训练步数越高越充分,但需结合验证集观察过拟合。

建议按总步数 10%–30% 保存,用于回滚和阶段评估。

策略微调常用低学习率,可按模型类型联动默认值。

用于平滑策略权重,精细操作建议保留较高平滑系数。

训练数据集

选择数据模块导出记录、下载链接、本地文件或 HuggingFace 数据源。

最近导出的 LeRobot 数据包

从数据模块导出的灵巧手演示包可作为默认训练入口。

备注

记录这次训练的目标、数据来源和评估重点。

创建训练任务当前仅保存演示草稿;真实训练调度、额度校验和 GPU 锁定逻辑未接入。