Apache Kafka est une plateforme open source de diffusion d'événements en flux distribué. Les organisations l'utilisent pour des pipelines de données, des analyses en flux, l'intégration de données et des applications critiques. Kafka stocke durablement les flux d'événements dans un cluster tolérant aux pannes, propose un traitement de flux avec notamment des jointures, des agrégations et des filtres, et inclut Kafka Connect pour se relier à des systèmes comme Postgres, JMS, Elasticsearch et AWS S3. Kafka est un logiciel que vous exploitez vous-même, sur vos propres serveurs ou dans le cloud de votre choix.
Kafka est développé par l'Apache Software Foundation, organisation américaine à but non lucratif basée dans le Delaware, sous licence Apache 2.0. Le logiciel étant open source et auto-hébergé, vous décidez de l'emplacement du cluster et des données d'événements. Une organisation européenne peut donc exploiter Kafka dans l'UE et garder la maîtrise de ses données. Si vous recourez plutôt à un service Kafka géré par un tiers, l'implantation et la juridiction de ce prestataire s'appliquent.