Expert observabilité H/F

LES FILLES ET LES GARCONS DE LA TECH
France
14 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours
Job source

Tech stack

Debian Linux Linux PostgreSQL Ansible Prometheus Grafana Git Deployment Automation Docker

Job description

Dans le cadre de l’évolution de la plateforme de supervision de notre client, nous recherchons un Consultant Observabilité / SRE capable de reprendre, faire évoluer et industrialiser la stack de monitoring existante.

L’environnement actuel repose sur Prometheus, Grafana, Thanos et différents exporters déployés sur l’ensemble de leur infrastructure.

Cette mission est davantage orientée réalisation que conseil, avec un véritable objectif de modernisation et de simplification de l’architecture.

Vos missions : Vous interviendrez sur l’ensemble de la plateforme d’observabilité afin de :

Reprendre en main l’architecture existante et la documenter.

Simplifier et fiabiliser la stack de monitoring.

Faire évoluer le stockage des métriques afin de conserver un historique d’environ 1 an (stockage local ou cloud).

Remplacer l’architecture actuelle reposant sur MinIO par une solution plus adaptée.

Optimiser les métriques Prometheus (nettoyage des métriques et des labels afin de limiter les coûts de stockage).

Industrialiser le déploiement et la mise à jour de la plateforme via Ansible.

Mettre en place un véritable processus de provisioning Grafana (dashboards versionnés, déploiement automatisé, limitation des modifications manuelles).

Améliorer la documentation technique de l’architecture et des procédures d’exploitation.

Objectifs complémentaires : Selon l’avancement de la mission, vous pourrez également intervenir sur :

Le remplacement de pg_agent par un exporteur PostgreSQL plus récent (ex : pgwatch) compatible avec PgBouncer.

L’amélioration de l’expérience utilisateur Grafana avec un dashboard d’accueil plus pertinent.

La gestion des hôtes décommissionnés afin d’améliorer le cycle de vie des métriques.

Contraintes techniques : Déploiement via Ansible, intégré au dépôt Git existant.

Installation sur un serveur Debian (Bookworm ou Trixie).

Une architecture Docker Compose est privilégiée.

Une installation native (systemd) pourra être envisagée si elle garantit un niveau de sécurité élevé et une maintenance simple.

Requirements

Nous recherchons un consultant disposant d’une solide expérience sur :

Prometheus

Grafana

Thanos

Exporters Prometheus

Docker Compose

Ansible

PostgreSQL

Linux Debian

Git / Infrastructure as Code

Une expérience sur les problématiques de stockage longue durée, de provisioning Grafana, d’observabilité et d’industrialisation d’infrastructures sera fortement appréciée.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:39 min

Experiencing core Linux capabilities for DevOps administration

Michael Cade · LIVE

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · WWC 2025

2:07 min

Inspecting default bridge architectures and custom Docker networks

Oliver Seitz Oliver Seitz · WWC 2025

2:57 min

Core technical practices for robust data engineering

Sandhya Menon Sandhya Menon · WWC Europe 2026

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

Videos

See all

Related articles

See all