岗位描述(节选)
1、负责海量多模态数据(视频、图片、音频等)的采集、清洗、去燥、标注与增强,构建高置信度训练数据集,支撑大模型训练与优化;
2、构建领域数据集,优化数据分布与质量,解决数据稀疏性、偏差性等问题;
3、分析模型训练中的数据瓶颈,提出改进方案。
【任职要求】
1、硕士及以上学历,数学、统计、计算机、人工智能等相关专业优先;
2、熟悉统计模型、机器学习、深度学习、自然语言处理等技术,掌握数据挖掘核心技术例如特征工程、聚类分析、异常检测、关联规则挖掘等;
3、具有优秀的编程基础,熟练掌握Python或Java等编程语言;
4、熟悉大数据平台和计算引擎(如Hadoop、Spark、Kafka、Hive等),具备熟练的SQL操作经验;
5、具有较好的学习能力、沟通表达能力和团队协作意识,能有效对接各种需求,并确保进展顺利;
6、责任心强,抗压能力强。
本站当前在招 11110 个北京岗位(全城各职能合计),其中 2404 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 5.6K ~ 16K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:美团 1313 个快手 1014 个阿里巴巴集团(含高德/阿里云) 797 个理想汽车 498 个京东 336 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。