Apache Flink ist ein Framework und eine verteilte Verarbeitungs-Engine für zustandsbehaftete Berechnungen auf unbegrenzten und begrenzten Datenströmen. Flink bietet Exactly-once-Konsistenz des Zustands, Verarbeitung nach Ereigniszeit und den Umgang mit verspätet eintreffenden Daten, mit geschichteten Schnittstellen: SQL für Stream- und Batch-Daten, die DataStream-API und ProcessFunction für die feingranulare Steuerung von Zeit und Zustand. Typische Einsatzbereiche sind ereignisgesteuerte Anwendungen, Stream- und Batch-Analysen sowie Datenpipelines oder ETL. Flink ist für gängige Cluster-Umgebungen ausgelegt, unter anderem mit einem Kubernetes Operator als dokumentierter Option, und unterstützt Hochverfügbarkeit und Savepoints. Sie stellen die Software selbst bereit und betreiben sie.
Flink ist ein Projekt der Apache Software Foundation, einer US-amerikanischen Non-Profit-Organisation (501(c)(3)); der Code steht unter der Apache License 2.0. Da kein Anbieter einen Flink-Dienst betreibt, werden Ihre Daten dort verarbeitet, wo Sie den Cluster betreiben: auf eigenen Servern, bei einem europäischen Hosting-Anbieter oder in einer Cloud-Region Ihrer Wahl. Eine europäische Organisation behält so die Kontrolle über Standort und Zugriff und übernimmt den Betriebsaufwand selbst.