岗位描述(节选)
工作职责:
1、负责大语言模型的指令微调(SFT)与强化学习(RLHF/DPO)训练,结合RAG与向量数据库技术,解决Agent在复杂业务场景中的知识幻觉与长尾问题,并协同优化数智员工SDECore-工具匹配成功率,提升Agent在业务执行中工具选择的准确性与匹配效率;
2、参与数智员工核心技术研发,包括但不限于多智能体间通信、协作机制设计、harnessengineering,多智能体编排,记忆管理,智能体自进化等前沿技术的研发
3、负责Agent视觉交互能力的研发与优化,屏幕语义理解能力的突破,提升元素拾取精确率,结合多模态大模型与Playwright、CDP等底层操作协议,实现高精度的GUI元素定位与操作,保障Agent在复杂页面中的稳定执行;
4、保持学术敏锐性,关注多智能体、GUI自动化、视觉语言模型等前沿技术,与产品、工程及业务部门紧密协同,推动Agent在政务、金融、审计、人……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。