岗位描述(节选)
1. Code Agent模型Badcase分析与优化
深入分析Code Agent在真实研发场景中产生的Badcase,定位模型在代码生成、理解、调试等环节的缺陷根因;
针对典型Badcase构建可复现的评测样本,主导设计并落地针对性优化方案(如SFT数据构造、RL策略调整等),推动模型能力持续提升。
2. Code Agent评测体系建设
主导构建和完善 Code Agent评测体系,涵盖代码正确性、研发流程遵从性、工具调用准确性、多轮对话一致性等维度;
设计自动化评测流程与归因分析框架,对模型表现进行多维度量化分析与根因归因,输出结构化的评测报告并驱动改进落地。
3. 模型与Agent协同进化
探索模型能力与Agent架构的协同优化路径,研究工具调用、规划推理、记忆机制等Agent能力对模型进化的反哺作用;
主导模型迭代与Agent框架的联合优化实验,推动“数据->模型->评测-……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。