诚聘实时数据引擎 / CDC 核心开发工程师
经验要求:7 年以上 Java 工程,近 3 年仍在写代码
关键词:Java, CDC, Binlog, WAL, Debezium, Canal, Kafka Connect, Hazelcast Jet, 连接器, Exactly-Once
产品形态可以理解为:
源库 → 日志 CDC → 自研引擎( Hazelcast Jet )→ 变换 / 多表合并 → MongoDB 等当前状态
而不是:
源库 → Debezium → Kafka → Flink → Doris/Paimon
核心职责:
1. 引擎运行时:在 Hazelcast Jet 上实现流水线 DAG 、Processor 、状态、checkpoint 、反压、故障恢复;补齐高可用、持久 offset 、Exactly-Once 。
2. CDC 采集:实现或加固 MySQL binlog 、PostgreSQL WAL 等日志捕获;处理快照切增量、GTID/LSN 、DDL 、大事务、无主键、断点续传。
3. 连接器:基于 PDK / SPI 开发 Source 与 Sink ,覆盖类型映射、幂等写入、schema 变更和异构库差异。
4. 状态物化:把多表增量变更合并为可查询的当前状态(文档嵌套、1:N 、回放、补数)。
5. 控制面协同:任务生命周期、可观测性、失败诊断;必要时参与 Spring Boot 控制面与 CLI 。
任职要求:
1. 计算机或相关专业本科及以上。
2. 7 年以上 Java 工程经验,近 3 年仍亲自写核心代码;具备并发、内存、故障恢复方面的系统编程能力。
3. 必须具备以下至少一类「开发」经验,而不是工具使用:
- CDC / 日志复制开发:Debezium 、Canal 、Maxwell 、Kafka Connect 、自研 binlog/WAL 解析、数据库复制组件;
- 连接器开发:Source/Sink 插件、PDK 、Flink CDC Connector 源码级改动;
- 流引擎运行时开发:Hazelcast Jet 、Flink Runtime/Operator 、Kafka Streams 、Storm 框架层,而不是 SQL 作业。
- CDC / 数据复制、ETL / 数据集成、实时流处理、数据库 / 数据库内核、大数据计算引擎、数据基础平台。
- 我们尤其关注是否真正开发过系统或核心模块,而不仅仅是使用 Kafka 、Flink 等组件搭建企业数据平台。
- 熟悉分布式系统基本原理,对一致性、容错、状态管理、并发控制、故障恢复有实际工程经验。
- 有复杂生产环境的性能优化和 Troubleshooting 经验。
- 能够独立负责复杂技术模块,并推动问题从设计、编码到生产验证完整闭环。
4. 深入理解至少一种主流数据库的复制机制( MySQL binlog 、PostgreSQL logical decoding 、Oracle/SQL Server/Mongo 复制同等)。
5. 能讲清 at-least-once / exactly-once 、checkpoint 与下游写入的对齐方式。
加分项:
开发过 Flink / Flink CDC / Debezium / Canal / Kafka Connect 或类似系统。
有数据库日志解析、CDC 、复制机制相关研发经验。
做过数据库内核、存储引擎、查询引擎或分布式计算引擎。
做过商业 ETL / Data Integration / 实时计算平台产品。
对 Flink 、Kafka 、Debezium 、Paimon 、Doris 、Spark 等有源码级理解或二次开发经验。
有 Apache 或其他主流开源基础软件项目 Contributor / Committer / PMC 经历。
有企业级基础软件产品研发经验,熟悉稳定性、兼容性、性能和长期版本演进问题。
能用英语阅读和讨论设计文档
双休,9:00-18:00 ,14 薪
简历投递: [email protected]
建议附上 github 主页链接
经验要求:7 年以上 Java 工程,近 3 年仍在写代码
关键词:Java, CDC, Binlog, WAL, Debezium, Canal, Kafka Connect, Hazelcast Jet, 连接器, Exactly-Once
产品形态可以理解为:
源库 → 日志 CDC → 自研引擎( Hazelcast Jet )→ 变换 / 多表合并 → MongoDB 等当前状态
而不是:
源库 → Debezium → Kafka → Flink → Doris/Paimon
核心职责:
1. 引擎运行时:在 Hazelcast Jet 上实现流水线 DAG 、Processor 、状态、checkpoint 、反压、故障恢复;补齐高可用、持久 offset 、Exactly-Once 。
2. CDC 采集:实现或加固 MySQL binlog 、PostgreSQL WAL 等日志捕获;处理快照切增量、GTID/LSN 、DDL 、大事务、无主键、断点续传。
3. 连接器:基于 PDK / SPI 开发 Source 与 Sink ,覆盖类型映射、幂等写入、schema 变更和异构库差异。
4. 状态物化:把多表增量变更合并为可查询的当前状态(文档嵌套、1:N 、回放、补数)。
5. 控制面协同:任务生命周期、可观测性、失败诊断;必要时参与 Spring Boot 控制面与 CLI 。
任职要求:
1. 计算机或相关专业本科及以上。
2. 7 年以上 Java 工程经验,近 3 年仍亲自写核心代码;具备并发、内存、故障恢复方面的系统编程能力。
3. 必须具备以下至少一类「开发」经验,而不是工具使用:
- CDC / 日志复制开发:Debezium 、Canal 、Maxwell 、Kafka Connect 、自研 binlog/WAL 解析、数据库复制组件;
- 连接器开发:Source/Sink 插件、PDK 、Flink CDC Connector 源码级改动;
- 流引擎运行时开发:Hazelcast Jet 、Flink Runtime/Operator 、Kafka Streams 、Storm 框架层,而不是 SQL 作业。
- CDC / 数据复制、ETL / 数据集成、实时流处理、数据库 / 数据库内核、大数据计算引擎、数据基础平台。
- 我们尤其关注是否真正开发过系统或核心模块,而不仅仅是使用 Kafka 、Flink 等组件搭建企业数据平台。
- 熟悉分布式系统基本原理,对一致性、容错、状态管理、并发控制、故障恢复有实际工程经验。
- 有复杂生产环境的性能优化和 Troubleshooting 经验。
- 能够独立负责复杂技术模块,并推动问题从设计、编码到生产验证完整闭环。
4. 深入理解至少一种主流数据库的复制机制( MySQL binlog 、PostgreSQL logical decoding 、Oracle/SQL Server/Mongo 复制同等)。
5. 能讲清 at-least-once / exactly-once 、checkpoint 与下游写入的对齐方式。
加分项:
开发过 Flink / Flink CDC / Debezium / Canal / Kafka Connect 或类似系统。
有数据库日志解析、CDC 、复制机制相关研发经验。
做过数据库内核、存储引擎、查询引擎或分布式计算引擎。
做过商业 ETL / Data Integration / 实时计算平台产品。
对 Flink 、Kafka 、Debezium 、Paimon 、Doris 、Spark 等有源码级理解或二次开发经验。
有 Apache 或其他主流开源基础软件项目 Contributor / Committer / PMC 经历。
有企业级基础软件产品研发经验,熟悉稳定性、兼容性、性能和长期版本演进问题。
能用英语阅读和讨论设计文档
双休,9:00-18:00 ,14 薪
简历投递: [email protected]
建议附上 github 主页链接