论文记录 · 证据边界公开

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning

arXiv v1(27 页 11 表;无录用 comments) · 2026-07-26 · 分层 HRL-SAC vs 平坦 SAC(稀疏奖励长时程搜救,SAR-2 数据集)

论文元数据

作者
Zahra Abdalla Elashaal、Afef Hfaiedh、Nahla Khraief、Issmail Ellabib、Giansalvo Cirrincione
机构
机构尚未补齐
发布日期精度
研究方向
分层 HRL-SAC vs 平坦 SAC(稀疏奖励长时程搜救,SAR-2 数据集)
机器人
无物理本体(SAR-2 搜救影像数据集 + 合成数据训练/评测)
DOI
未披露
arXiv
2607.23726
引用元数据
0
记录状态
included
质量检查
无自动质量红旗