岗位描述(节选)
【岗位职责】
1. 参与构建与清洗大规模多模态数据集(音频、文本、视频、动作轨迹等),支撑动作生成模型训练与评估。
2. 跟踪并复现动作生成、语音/文本到姿态、多模态 any-to-motion 等方向的前沿工作,沉淀可落地的技术方案。
3. 参与基于 Diffusion Transformer 或其他生成式架构的全身/上肢动作生成模型的训练、调优与评估,提升动作自然度、时序一致性与表达力。
4. 与产品、语音交互、应用开发等团队协作,将生成动作接入人形机器人真实场景(讲解、社交互动、主持表演等),持续迭代模型效果与可用性。
【任职要求】
1. 计算机、人工智能、自动化等相关专业,硕士及以上学历。
2. 具备扎实的深度学习基础,熟悉常见模型结构(CNN、Transformer 等)。
3. 有生成式模型(Diffusion、VAE 等)、序列/动作生成(motion generation……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 10664 个深圳岗位(全城各职能合计),其中 1773 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 16K,最低 1K、最高 100K。
在招岗位较多的企业:字节跳动 845 个安克创新科技股份有限公司 600 个顺丰 581 个华大智造 498 个华大基因 485 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。