Critic Warmup Model for SmolVLA-SAC

这是一个为 SmolVLA-SAC 策略训练的 Critic 模型预热权重。

训练配置

  • 数据集: wzn12/teleop_ring_labeled
  • 训练轮数: 20
  • 批大小: 48
  • 学习率: 0.0003

使用方法

from lerobot.policies.smolvla_sac.modeling_smolvla_sac import SmolVLASACPolicy
import torch

# 加载模型
checkpoint = torch.load("final_critic.pth")
critic_state_dict = checkpoint['critic_state_dict']

# 在你的 SmolVLASACPolicy 中加载权重
policy.critic.load_state_dict(critic_state_dict)

训练于: 2025-08-14 17:42:03

Downloads last month
6
Video Preview
loading