岗位描述(节选)
【岗位职责】
岗位职责
- 负责多模态原始数据(视频、传感器、轨迹等,以 rosbag、MCAP 等格式存储)的清洗、解析与预处理,建设多传感器时间同步、空间对齐与标定,以及抽帧、点云与视频解码等预处理引擎;
- 对图像、视频、语音等数据进行隐私脱敏与去标识化处理,包括人脸、车牌、语音身份等敏感信息的检测与消除,保障数据合规入库。
- 基于多模态基础模型构建具身智能数据预标注算法体系,搭建覆盖图像和动作语义、文本描述与语音交互的自动化标注流水线。
- 开发自动化质检与异常检测,建设低质数据回流的质量反馈闭环,并按数据质量评价体系制定的标准实现。
- 负责海量多模态数据的数据选择、去重(场景与轨迹相似度、音视频语义级)与多样性分析,实现长尾场景的自动识别、聚类与召回,设计主动学习策略筛选高价值样本。
- 研发图像、音频、视频等合成数据的能力,基于生成式模型、仿真与数据增强,补充长尾、稀缺与隐……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。