岗位描述(节选)
1. 参与通用音频生成与编辑、音视频联合编辑相关算法研究与落地。
2. 围绕音视频生成与编辑问题,开展模型调研、方案设计、实验复现与效果优化。
3. 参与高质量音视频数据集构建与清洗,包括质量筛选、音视频相关性检测、音频/视频 caption、标签体系建设和训练数据 pipeline 优化。
4. 建立并完善模型评测体系,围绕音视频质量、语义一致性、编辑可用率等指标进行实验评估和结果分析。
5. 输出阶段性研究成果,包括算法代码、模型权重、实验报告、技术方案以及论文/专利等相关材料。
1. 计算机、人工智能、电子信息、自动化等相关专业硕士研究生,具备较好的深度学习基础。
2. 熟悉 PyTorch 等深度学习框架,具备较强的工程实现能力,能够独立完成模型训练、实验调参、结果分析和代码整理。
3. 了解音视频生成、音视频编辑、多模态学习、扩散模型等相关方向之一;有相关论文复现或项目经验者优……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。