Pandera is een open-source Python-bibliotheek voor het valideren van dataframes. Datawetenschappers en data-engineers leggen schema's en controles vast en valideren data bij de ingang en uitgang van een pijplijn. Pandera kan ook schema's afleiden uit schone data en synthetische testdata genereren. De bibliotheek ondersteunt onder meer pandas, Polars en PySpark, valt onder de MIT-licentie en wordt als gewoon Python-pakket geïnstalleerd via PyPI of conda-forge. Het draait dus in uw eigen omgeving en niet als gehoste dienst.
Pandera begon als communityproject en wordt sinds 2022 onderhouden door Union.ai, een Amerikaans bedrijf. Omdat de broncode open is, kunt u die inspecteren, forken en vastzetten op een bepaalde versie. De MIT-licentie staat dat ook toe als de koers van het project verandert. Voor een Europese organisatie zit de afhankelijkheid daarom vooral in de toekomstige richting van een door een Amerikaans bedrijf aangestuurd open-sourceproject, en niet in het hosten van gegevens, omdat de validatie lokaal in uw eigen code en infrastructuur plaatsvindt.