进入工作台 →

【Dots】大模型算法工程师-Alignment/偏好对齐/Agent学习

🏢 小红书📍 上海市,北京市,杭州市
🎯 社招 发布于 2026-09-16 来源:小红书招聘
登录查看完整 JD、匹配评分与一岗一历

岗位描述(节选)

关于岗位 模型能力变强,并不自动意味着它更值得信任:它可能在缺乏证据时自信作答,在复杂约束下遗漏指令,在偏好优化中学会迎合,或在长程任务中偏离目标。如何通过后训练,让模型既有能力解决问题,也能稳定地做出正确的行为选择? 你将围绕幻觉、复杂指令遵循、偏好对齐与 Agent 协作开展算法研究,探索如何将证据、偏好和交互反馈转化为有效的学习信号。这里的 Alignment 不止于调整回答风格,而是通过数据、奖励与训练方法,塑造模型在复杂交互中的判断和行动能力。你可以根据专长深入其中一个或多个方向,并参与从问题定义到训练验证的完整过程。 你将探索的技术问题 让模型知道何时继续验证、何时停止作答: 如何把证据充分性与不确定性转化为训练信号,减少幻觉,而不是让模型一味拒答? 让偏好优化学到真实目标: 如何避免奖励投机、谄媚和表面风格拟合,在有用性、诚实性与用户自主权之间形成稳定的行为策略? 让 Age…… 完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
© 2026 求职者营地 · 岗位数据受版权与反爬保护,禁止抓取与镜像