具身智能训练数据

一套供给,两类数据

喂饱您的具身智能模型

从世界模型预训练到机器人操作策略,我们提供通量型基础视频与第一人称操作数据,按您的训练目标选型、交付、合规闭环。

通量型 · 世界模型基础视频 定制型 · 第一人称操作数据 11 层结构化标注 合规授权随包交付

两类数据,同一种训练诉求

它们来源、形态、价格完全不同,但买单的是同一群人:训练场、大数据公司、机器人公司、大模型团队、AR 厂商。我们帮您把选型、交付与合规打包成一条链路。

通量型 · BULK

世界模型基础视频

存量网络视频清洗,量极大、单价低。适合大规模预训练与通用表征学习。

  • 数据来源:真实网络视频海量资源池
  • 含标注:否(仅清单与批次报告)
  • 计价:按有效条数,量大价低
  • 用途:世界模型 / 视频表征预训练
定制型 · CUSTOM

第一人称操作数据

真人头戴定向自采,规范、带 11 层标注。适合具身机器人特定行为训练。

  • 数据来源:居家 4 类 19 场景定向采集
  • 含标注:11 层结构化(手/物/交互)
  • 计价:按小时成品视频,按标注层级分档
  • 用途:VLA/VLM 操作策略、手部理解

通量型:世界模型训练基础视频

海量真实世界视频,经规格统一、时长合规与五类风险预筛,转化为可进入训练的标准化候选数据。

1亿+ 小时
历史视频资源池
≈14万 小时/日
每日新增视频资源
6.814%
历史端到端保留率
≈30%
客户侧评价通过率

规格统一

帧率 24–30fps、宽高比 0.5–2.0、最长边 ≥640。三项任一不满足即在前置阶段过滤。

时长合规

≤5 分钟原样保留;>5 分钟切分为单段不超过 5 分钟的视频,兼顾画面连续与内容完整。

五类风险预筛

文字面积、黑边面积、NSFW、Deepfake、非真实风格(动画/游戏/CGI/虚拟人)逐帧检测、前置过滤。

原始视频
14,676
资源池
前置处理
3,334
规格+切分+预筛,淘汰约 77%
客户评价
1,000
按您模型逐条判定,通过约 30%
有效数据
1,000
进入训练

漏斗换算:约 3.3 份候选 → 1 份有效。具体通过率以试交付确认为准。

分层质量协同:我方完成前置处理与预筛,您用自有评价模型做最终判定。规则随您的反馈持续校准,候选数据质量逐批提升。

现代城市街道交叉口,行人与车辆 城市

城市空间

街道、交通、人流的真实世界视频片段,支撑世界模型对公共空间动态的建模。

明亮的现代客厅,沙发与绿植 居家

居家室内

客厅、餐厅、厨房等真实室内画面,帮助模型理解人类居住环境的结构与常态。

开阔的公园绿地与天空 户外

户外公共

公园、广场、自然景观等开放环境视频,补充模型对室外光照与地形分布的认知。

定制型:第一人称操作数据

真人佩戴设备以第一视角拍摄日常操作全过程,每段附 11 层标注。从采集、质检到标注、验收形成可规模复用的生产体系,而非一次性交付。

4类 19 场景
居家标准场景,可定制扩展
11
结构化标注体系
2–15 分钟
单段完整任务流程
G0–G5
六道质量门禁

11 层标注体系

手部 21 关键点、手部可见帧、场景、动作候选、关键步骤、可见手臂、2D 相机运动、运动物体候选、L1 物体轨迹、语义物体(COCO-80)、手—物交互。每条标注含来源字段,可溯源。

样例实测:4.5 万+ 手部帧 · 2.1 万+ 物体轨迹 · 4,700+ 手物接触

可承诺的质量指标

手检出召回 ≥95%、左右手区分 ≥99%、手部关键点 PCK@0.05 ≥90%、轨迹 ID 切换 ≤1 次/分钟/手、人工复核覆盖自动告警段 100%。写进验收,可逐项检验。

六道门禁:认证→入库→自动QC→内容QC→返工闭环→批次放行

按需定制维度

参与者池、场景集、画质 1080p30 至 4K60 HEVC 10-bit、标注层级 L1→L2(深度/多视角/3D)→L3(触觉/力)、人工金标比例 10%–100%。

先以样例包低成本验证形态,再按任务清单规模化扩展

标准交付物

原始主数据、追踪代理视频、标注预览、手部/交互标签、质检报告、数据卡、清单与哈希、复现工具与环境。批次验收可拒、可返工,不静默覆盖。

合规:知情同意、肖像/声音授权、隐私审查随包闭环

居家日常 · 4 类 19 场景

第一人称视角在洗衣区分类与折叠衣物 洗衣类

洗衣类

衣物分类装取洗衣机衣物折叠熨烫衣物收纳
第一人称视角在水槽清洗与备餐 厨房整理

厨房整理

洗碗擦台面整理橱柜倒垃圾与回收
第一人称视角在衣柜前整理与折叠衣物 房间整理

房间整理

卧室归整客厅归整办公室归整衣橱归整货架/抽屉归整
第一人称视角照料植物与清洁浴室 其他家务

其他家务

浴室清洁植物照料宠物照料车库整理一般性收拾

样例包已覆盖主要类型(厨房/水槽、植物区、洗衣区、卫生间、工作区等);完整 19 场景与扩展场景按正式批次定制需求执行。

能力边界如实告知:样例包当前为 RGB_ONLY_L1 自动预标,非人工金标;暂无公制 3D 与真实触觉;语义物体受 COCO-80 闭集限制。正式商用前授权链逐项闭环。

适用客户

八类具身智能训练需求方,对两类数据的组合各有侧重。我们按您的训练阶段搭配通量型与定制型。

具身基础模型实验室,人形机器人与 GPU 算力集群 基础模型

具身基础模型实验室

VLM/VLA 与世界模型预训练、评测,通量型供预训练、定制型供评测基准。

通量型定制型
机器人本体厂商的工厂产线,人形机器人装配中 机器人

机器人本体厂商

人形 / 服务 / 工业机器人,操作策略、抓取与放置,定制型第一人称数据直接可用。

定制型通量型
训练场数据中台,大屏展示数据集与三维点云 训练场

训练场 / AI 数据中台

需标准化、可验收、规模化供给,通量 + 定制组合批量补充。

通量型定制型
大数据与世界模型公司的城市视频数据流 大数据

大数据 / 世界模型公司

世界模型、通用视频表征预训练,量大便宜的通量型最合算。

通量型
空间计算厂商,佩戴头显者在家居环境中手势交互 空间计算

空间计算厂商(AR/VR/MR)

手势识别与场景理解,定制型 + 通量型场景素材互补。

定制型通量型
自动驾驶与具身驾驶,城市街道的传感视角与点云 自动驾驶

自动驾驶 / 具身驾驶

视频世界模型、仿真到真机(sim-to-real),海量真实视频通量型最合算。

通量型
智能家居场景,机械臂在客厅折叠衣物 智能家居

家电 / 智能家居厂商

居家操作场景(洗衣、厨房、收纳),定制型第一人称数据高度契合。

定制型
科研院校机器人实验室,学生调试人形机器人 科研

科研院校 / 实验室

学术数据集与 benchmark、可控实验采集,通量 + 定制组合。

通量型定制型

关于我们

广州乾行创达供应链科技有限责任公司,是产业供应链数字化平台运营服务商,长期服务国企客户。作为具身智能训练数据的渠道,把上游数据供应商的产能,组织成可选型、可交付、可合规闭环的训练数据集,供应给有具身智能训练需求的企业。

选型咨询、交付管控、验收协调、合规授权兜底。通量型作为低门槛敲门砖建立合作,同时叠加定制型深度。

注:以正式商务附件与试交付验证为准;样例包可审阅,正式商用授权随包闭环。

电话020-87581681
邮箱chainsynctech@corsyn.com
官网www.chainsynctech.com