Cortex Long-Horizon Semantic Annotation Corpus
长时程双系统VLA的语义标注与技能分段语料;官方称覆盖4,000小时级多来源数据,固定修订公开非gated并声明Apache-2.0。该规模不是4,000小时新采ARX ACONE轨迹,完整System-1训练链仍未发布。
- 开放状态
- 已核验开放
- 许可证
- Apache-2.0 declared by dataset card
- 商业使用
- released files permitted subject to upstream source terms
- 人工评审结论
- verified_public_nongated_fixed_revision_partial_training_chain
- 机器人
- ARX ACONE、multiple upstream real and simulated embodiments
- 任务
- 长时程操作分解、化学流程、清洗流程及上游操作任务
- 模态
- RGB/video references、language、task graph、subtask boundaries、action/skill labels、robot episodes
- 格式
- Hugging Face dataset files plus Cortex annotation schema
- 采集/生成方式
- 多来源轨迹自动/人工语义标注+约10小时ARX分段动作数据
- 已知问题
- 4K小时不能等同新真机采集;System-1训练TODO;模型权重无许可证;全量未下载;无独立复现。
