岗位描述(节选)
1、遵循robots协议,采集互联网上允许搜索爬虫采集的公开非敏感信息,满足大模型、电商、本地等公司核心业务数据需求;
2、负责分布式采集系统的建设与迭代优化,负责数据调度、采集、数据结构化、持久化全链路核心流程迭代升级;
3、帮助团队攻克各种采集技术难关,提升系统的采集效果与效率。
【任职要求】
1、本科及以上学历,计算机相关专业,有强烈的好奇心和技术敏锐度,对AI大模型和采集相关技术有浓厚的兴趣;
2、熟悉Java、Python等语言,具备扎实的编码能力;熟悉主流采集技术及框架工具,如Frida、Puppeteer、Scrapy等;
3、熟悉常见互联网风控策略,并具备相关的实战经验;
4、加分项:App逆向、反混淆、脱壳、算法与多模态内容理解。
本站当前在招 11029 个北京岗位(全城各职能合计),其中 2386 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 5.5K ~ 16K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:美团 1313 个快手 1014 个阿里巴巴集团(含高德/阿里云) 797 个理想汽车 498 个京东 336 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。