首先文章需要预先统计pair-wise action chunk的相似度,这一步本身就是time-costing的 然后就是分别训练latent feauturs和policy head ==这里我没有特别清楚的细节是:每个训练的batch中应该包含哪些数据?==
← Home · All Readings