岗位描述(节选)
【岗位职责】
1、理解大模型能力,跟进大模型评测领域的前沿研究范式,掌握定性和定量的用户研究方法,探索不同场景下AI回复模型的理想态牵引体系;
2、对Tako线上体验负责,综合内部专家评估、众测、LLM自动化评估等方式构建评测指标,找到体验短板并针对性地提出改进建议,帮团队量化和明确解决问题的优先级与方向;
3、协同国际化运营团队推动评估计划的实施,包含评测集的维护&沉淀、Benchmark评测例行执行与分析。
【任职要求】
1、硕士学位或以上,专业背景优先人工智能、计算机科学、认知科学、教育测量、社会科学定量研究;
2、在大模型评测领域有3年及以上工作及研究经验,设计过AI理想态评估机制,有用户研究、数据分析等项目经历;
3、工作细致有条理,逻辑清晰,沟通能力强,具备团队合作精神。
本站当前在招 1694 个北京运营岗位,其中 43 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 16K,最低 5K、最高 35K。
在招岗位较多的企业:字节跳动 905 个京东 221 个美团 181 个快手 168 个长鑫科技 39 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。