岗位描述(节选)
负责千问智能硬件(眼镜/耳机等)的云端大模型能力体系,打造面向文本、语音、图像、视频流等全模态交互的硬件 AI 助手。主导llm/vlm/omni模型后训练、agentic范式、数据体系等方向持续迭代,提升模型在聊天、文本问答、视觉问答、livetalk、agent任务执行的能力;联动硬件侧多模态传感器(如眼动追踪等)开展融合建模与能力增强,进一步拓展模型在真实交互场景下的理解、推理与执行上限,打造自然流畅、有温度、能办事的 AI 体验。
【任职要求】
● 计算机科学、人工智能、数学等相关专业硕士及以上学历;
● 有扎实的大模型理论基础,熟悉业界前沿模型架构&技术;并且熟练掌握基本工具/主流框架的使用(如python/pytorch/swift/verl/megatron等);
● 具备大模型、对话系统、多模态模型或语音交互方向研发经验,对实时对话式 AI 产品有较深理解,具备较强的工程……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。