岗位描述(节选)
全面负责定义、设计并实现下一代实时音视频通话 AI 应用的核心模型能力与交互体验,围绕 Omni 多模态模型在实时对话场景中的落地,重点攻坚模型后训练、数据构建与评测体系等关键问题,持续提升模型在聊天、问答、生活办事等场景下的自然度、智能性、趣味性与任务完成效果。您将直接参与塑造面向海量用户的实时 AI 通话体验,推动 AI 从“能回答”走向“更像真人、更懂用户、更会互动”的下一代产品形态。
【工作职责】
1. 结合实时音视频通话场景中的用户需求与交互特点,定义模型能力目标与体验标准,制定后训练与效果演进方案,持续优化响应速度、表达自然度、理解准确性与任务完成效果。
2. 围绕 Omni 多模态模型开展 Post-training 工作,包括 SFT、RL、数据配比优化、训练目标设计与策略迭代,提升模型在多轮对话、上下文理解、情绪感知、口语表达等方面的能力。
3. 构建实时 AI 通话场景……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。