该论文记录已去重归并

旧标识 oa-w7137848502 已合并到唯一正式记录。

前往 REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning