岗位描述(节选)
【岗位职责】
职位愿景:
加入我们,你将参与打造机器人新一代的“交互大脑”。我们致力于通过 Omni 多模态大模型突破传统交互边界,实现文本、语音、视觉、视频与物理动作的统一建模,让机器人在复杂物理世界中具备实时、自然、可靠且可持续迭代的交互与决策能力。
核心职责:
根据个人专长,重点负责以下一个或多个方向:
1、参与 Omni 多模态大模型的技术路线规划与核心架构设计,推进文本、语音、视觉、视频和动作等模态的统一表征、理解、推理与生成;
2、攻关可泛化、具备规模扩展能力的模型架构与训练方法,重点解决跨模态对齐、时序建模、长上下文理解、实时流式交互及端到端 Audio-to-Audio、Speech-to-Action 等关键问题;
3、建设多模态数据体系和大规模训练流程,制定数据质量与配比方案,推进预训练、后训练、指令微调、偏好对齐或强化学习,并持续优化训练效率与稳定性;
4、研发面向真……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 19019 个北京岗位(全城各职能合计),其中 2814 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3923 个小米集团 1142 个快手 1017 个阿里巴巴集团(含高德/阿里云) 801 个美团 753 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。