岗位描述(节选)
1. 负责 RLake 数据湖存储引擎的核心模块研发,包括但不限于文件格式、元数据管理、读写优化、Schema Evolution 等;
2. 参与构建面向 AI 场景的统一存储服务,支持结构化(表数据)与非结构化(向量、文件、多模态)数据的统一存储与高效访问;
3. 深入 Flink / Spark 等计算引擎,优化数据湖在流式写入、批量读取、联邦查询等场景下的性能表现;
4. 参与跨语言 SDK(Python / C++ / Rust)的设计与开发,为上层 AI 和数据科学场景提供高性能访问接口;
5. 参与开源社区(Apache Paimon 等)的技术共建,跟进前沿数据湖技术趋势,将创新成果沉淀到产品中;
6. 负责线上稳定性保障,定位和解决生产环境中的性能瓶颈与疑难问题。
【任职要求】
1. 计算机基础知识扎实,精通引擎性能优化和问题定位;
2. 熟悉 Paimon / Hud……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。