岗位描述(节选)
你将负责智能眼镜 AI视觉理解与视觉推理方向 的产品规划与落地,包括:
1. 持续跟踪多模态大模型、VLM、Video LLM、Visual Reasoning、Spatial Reasoning、Egocentric 等方向的发展,理解主流模型的能力边界、技术趋势与产品机会;
2. 从智能眼镜第一视角场景出发,定义视觉感知相关产品能力,包括场景理解、物体与状态识别、空间关系、视频理解、视觉记忆、多步视觉推理等;
3. 将模型能力转化为具体用户体验,探索找物、导航、学习、安装指导、工作辅助、生活决策等真实场景;
4. 与研发团队共同制定能力 Benchmark、评测标准和数据需求,判断不同模型方案是否达到产品可用水平;
5. 推动从技术验证、原型设计到产品落地的完整流程,并持续根据真实用户反馈优化产品方向;
6. 协同软件、硬件和系统团队,平衡模型效果、延迟、功耗、带宽和端云协同等现实约束……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。