2026-08-28 Kubernetes 위의 Apache Flink: Operator 패턴으로 스트리밍 잡을 무중단 운영하기

왜 스트리밍 플랫폼은 Kubernetes로 향하는가 데이터 플랫폼 팀들은 이제 Flink 잡을 전용 클러스터가 아니라 Kubernetes 위에서 운영하는 방향으로 이동하고 있다. 조직 안에 이미 표준 오케스트레이션 계층이 존재하는데, 팀마다 별도 인프라를 두는 대신 배치·스트리밍 워크로드를 하나의 플랫폼에서 함께 관리하려는 요구가 커졌기 때문이다. Apache Flink 공식 문서는 Flink Kubernetes Operator가 “Kubernetes API를 커스텀 리소스로 확장해 Flink 애플리케이션의 생명주기(배포, 무중단 업그레이드, 오토스케일링)를 관리한다"고 설명한다(Operator Overview). CNCF도 오퍼레이터 패턴 자체를 “커스텀 리소스를 도메인 지식을 가진 컨트롤러가 지속적으로 조정(reconcile)하는 확장 모델"로 정의하며, 선언적 상태와 실제 상태를 계속 수렴시키는 피드백 루프가 핵심이라고 설명한다(Kubernetes Operators 101). 스트리밍 잡을 하나의 CR로 선언하고 컨트롤 루프가 알아서 원하는 상태로 맞춰준다는 것이, 이 흐름의 핵심 아이디어다. ...

August 28, 2026 · 3 min · 519 words · jeonck