岗位描述(节选)
【岗位职责】
团队介绍:Data AML是字节跳动的机器学习中台,为抖音/今日头条/西瓜视频等业务提供推荐/广告/CV/语音/NLP的训练和推理系统。为公司内业务部门提供强大的机器学习算力,并在这些业务的问题上研究一些具有通用性和创新性的算法。同时,也通过火山引擎将一些机器学习/推荐系统的核心能力提供给外部企业客户。
1、负责字节跳动推荐/广告/搜索类业务中多模态数据生产链路的搭建与ETL流程设计开发,构建一套标准的、面向广义推荐系统场景的多模态特征数据的生产、清洗和存储链路,并针对未来模型演进方向构建高效的样本生产、存储和访问链路;设计与开发高效、高可用的数据管道;
2、基于Spark构建百亿规模、PB级别数据的清洗框架,优化数据预处理效率;完成多模态结合搜推特征的生产,包括数据去重、过滤、spam数据处理、数据均衡等操作,并将生产链路平台化;
3、针对多模态特征特点,构建多模态特征缓……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 19019 个北京岗位(全城各职能合计),其中 2814 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3923 个小米集团 1142 个快手 1017 个阿里巴巴集团(含高德/阿里云) 801 个美团 753 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。