> Markdown version of [/jobs/ext/14593-data-ingenieur-python-elk](https://www.wearedevelopers.com/jobs/ext/14593-data-ingenieur-python-elk). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Ingénieur Python ELK - **Company:** CHARLI GROUP - **Location:** Paris, France - **Contract:** Permanent contract - **Skills:** Airflow, Apache HTTP Server, Code Coverage, Continuous Integration, Extract Transform Load (ETL), DevOps, Elasticsearch, Hadoop Distributed File System, Python (Programming Language), Linux System Administration, Logstash, Ansible, Prometheus, Parquet, Data Processing, Pytest, Data Lakes, Apache Flink, Apache Kafka, Kibana, Terraform, Dynatrace - **Published:** May 13, 2026 - **Apply:** https://fr.indeed.com/viewjob?jk=00ddac518aff6a98 ## About the Role Expérience Python indispensable * Expert Python en contexte professionnel et en production, * Bonne connaissance de la programmation asynchrone (asyncio, aiohttp) pour les pipelines I/O-bound * Maitrise kubernetes et CI/CD (gitops, etc ) Stack data indispensable: * Expérience avancée d'Apache Flink pour le traitement de flux en temps réel * Exploitation d'Apache Kafka en production (brokers, topics, groupes de consommateurs, réplication, rétention) * Maîtrise de la stack ELK ? administration Elasticsearch, pipelines Logstash, dashboards Kibana, alerting * Solides compétences modélisation de données * Aisance dans un environnement entièrement on-premise et autogéré * Bonnes bases en administration Linux, réseau et stockage Apprécié * Expérience avec dbt pour la transformation de données * Connaissance des formats lakehouse (Delta Lake, Apache Iceberg) sur HDFS/MinIO * Familiarité avec les agents Beats (Filebeat, Metricbeat) * Expérience avec Ansible ou Terraform * Expérience avec Dynatrace ou Prometheus pour le monitoring ## Description * Conception et construction des pipelines de données scalables pour le traitement batch et temps réel * Dévelopement et maintenance des workflows avec Apache Airflow (orchestration) et Apache Flink (traitement de flux) * Mise en place et opération des clusters Apache Kafka pour le streaming d'événements à haut débit * Déployement et administration la stack ELK (Elasticsearch, Logstash, Kibana) pour l'ingestion de logs, l'indexation, la recherche et l'observabilité * Écriture du code Python propre, efficacité et test pour la logique ETL/ELT et les outils internes * Garantie de la qualité des données, la fiabilité des pipelines et la résilience de l'infrastructure * Collaboration avec les équipes DevOps sur la planification de capacité et les opérations cluster * Accompagnement et augmentation en compétences des ingénieurs moins expérimentés, * Maîtrise des paradigmes avancés : décorateurs, générateurs, contexte managers, métaclasses, typage statique avec mypy * Conception de packages Python structurés et réutilisables, gestion de dépendances * Écriture de tests robustes : pytest, mocking, fixtures, tests paramétrés, couverture de code * Développement de clients Kafka en Python (confluent-kafka, kafka-python) : producteurs, consommateurs, gestion des offsets et des erreurs * Expérience avec les clients Elasticsearch en Python (elasticsearch-py) pour l'indexation et la recherche * Développement d'opérateurs et de hooks Airflow custom en Python * Manipulation de données avec pandas et PyArrow pour les formats colonnaires (Parquet, ORC) * Maîtrise des outils de qualité de code : black, ruff, pylint, pre-commit ## Related Videos - [Python-Based Data Streaming Pipelines Within Minutes](https://www.wearedevelopers.com/videos/1233-python-based-data-streaming-pipelines-within-minutes) - [Debug a Kubernetes Operator](https://www.wearedevelopers.com/videos/487-debug-a-kubernetes-operator) - [pytest: Simple, rapid and fun testing with Python](https://www.wearedevelopers.com/videos/213-pytest-simple-rapid-and-fun-testing-with-python) - [From DevOps to Scaled DevOps: How We’re Rebuilding Continuous Delivery as a Platform](https://www.wearedevelopers.com/videos/100018-from-devops-to-scaled-devops-how-we-re-rebuilding-continuous-delivery-as-a-platform) - [Add Location-based Searching to Site with ElasticSearch](https://www.wearedevelopers.com/videos/77-add-location-based-searching-to-site-with-elasticsearch) - [Enjoying SQL data pipelines with dbt](https://www.wearedevelopers.com/videos/823-enjoying-sql-data-pipelines-with-dbt) ## Related Articles - [Top Big Data Technologies That You Need to Know](https://www.wearedevelopers.com/magazine/108-top-big-data-technologies-that-you-need-to-know) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [The 13 Best Python Libraries for Developers in 2025](https://www.wearedevelopers.com/magazine/371-the-13-best-python-libraries-for-developers-in-2025) - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Highest Paying Tech Companies for Developers](https://www.wearedevelopers.com/magazine/220-highest-paying-tech-companies-for-developers) - [Best Companies to Work For in France: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/189-best-companies-to-work-for-in-france-top-25-companies-in-2023)