岗位描述(节选)
1.深入参与语音大模型的构建,搭建具有通用性和可拓展性的语音端到端大模型评测框架(对话、NLP、TTS、ASR等方向),深度配合算法、产品进行自研探索和业务落地;
2.结合行业趋势及业务应用场景,迭代更新评测标准、构建评测题库,负责语音大模型效果评测,定期反馈评估结果,产出评估报告,确保大模型评估结果置信;
3.通过PE、代码、Workflow、Agent完成数据预处理、分析和清洗,按照训练需求进行标注、分析和验证调优,提升模型效果;
4.与产品算法团队协同,积极探索自动化模型评估、数据合成等方法,提高评测效率。