独立行业技术评审 · 持续核验

Cortex Long-Horizon Semantic Annotation Corpus

长时程双系统VLA的语义标注与技能分段语料;官方称覆盖4,000小时级多来源数据,固定修订公开非gated并声明Apache-2.0。该规模不是4,000小时新采ARX ACONE轨迹,完整System-1训练链仍未发布。

Cortex Long-Horizon Semantic Annotation Corpus

长时程双系统VLA的语义标注与技能分段语料;官方称覆盖4,000小时级多来源数据,固定修订公开非gated并声明Apache-2.0。该规模不是4,000小时新采ARX ACONE轨迹,完整System-1训练链仍未发布。

开放状态
已核验开放
许可证
Apache-2.0 declared by dataset card
商业使用
released files permitted subject to upstream source terms
人工评审结论
verified_public_nongated_fixed_revision_partial_training_chain
机器人
ARX ACONE、multiple upstream real and simulated embodiments
任务
长时程操作分解、化学流程、清洗流程及上游操作任务
模态
RGB/video references、language、task graph、subtask boundaries、action/skill labels、robot episodes
格式
Hugging Face dataset files plus Cortex annotation schema
采集/生成方式
多来源轨迹自动/人工语义标注+约10小时ARX分段动作数据
已知问题
4K小时不能等同新真机采集;System-1训练TODO;模型权重无许可证;全量未下载;无独立复现。

论文原文 · 官方代码 · 官方数据