Published onAugust 27, 2026Flink Checkpoint 生命周期管理:从 HDFS 清理到 DolphinScheduler 资源一致性FlinkCheckpointDolphinSchedulerHDFS运维解释 RETAIN_ON_CANCELLATION 为什么会留下历史 Checkpoint,如何通过 DolphinScheduler 安全清理,以及资源中心与 HDFS 显示不一致的原因。
Published onAugust 14, 2026Protecting Checkpoint Storage Configurationflinkcheckpointinfrastructuredefensive-programmingdistributed-storageA practical infrastructure pattern to prevent Flink checkpoint misconfiguration in production.
Published onAugust 9, 2026Flink 1.18 Checkpoint EssentialsFlinkCheckpointStateStream-ProcessingFault-Tolerance以 Flink 1.18 为例,梳理 State、StateBackend、CheckpointStorage 以及 Checkpoint 核心参数之间的关系。
Published onAugust 8, 2026Kafka Share Groups: From Streams to QueuesKafkaShare-GroupsFlinkAI-InfrastructureDistributed-SystemsKafka 4.2 makes Share Groups production-ready, giving Kafka a queue-like consumption model while preserving a clear boundary with Flink stateful stream processing.
Published onAugust 3, 2026从 OceanBase 到 StarRocks:基于 Kappa 架构构建现代实时数仓OceanBaseCloudCanalKafkaFlinkStarRocks实时数仓Kappa以 OceanBase、CloudCanal、Kafka、Flink SQL 和 StarRocks 为例,说明如何将采集、传输、计算和查询解耦,构建一条可扩展、可回放的实时数仓链路。