岗位描述(节选)
1、设计并开发支撑千万级机器人视频数据的自动化标注系统;
2、利用视频时空特征、场景切换检测及多模态语义理解技术,实现视频片段的精准边界划分;
3、结合 VLM 与特定领域模型,为视频自动生成符合 VLA 训练需求的自然语言描述;
4、构建自动化质量评估体系,利用模型评估、异常检测等手段筛选高质量样本。
1、精通视频处理技术,熟悉动作识别、时间动作定位或视频片段检索等领域;
2、深入理解 CLIP、VLM 等模型原理,能够熟练运用大模型进行下游数据处理任务,有 Prompt Engineering 或模型蒸馏经验者优先;
3、精通 Python,熟练使用 PyTorch / TensorFlow,具备处理 PB 级视频数据的工程经验,熟悉分布式计算框架(如 Ray、Spark)。
加分项
1、超大规模视频数据处理经验;
2、熟悉 3D 视觉 / SLAM / 点云数据处理;
3、在 N……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。