Expert observabilité H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
Job description
Dans le cadre de l’évolution de la plateforme de supervision de notre client, nous recherchons un Consultant Observabilité / SRE capable de reprendre, faire évoluer et industrialiser la stack de monitoring existante.
L’environnement actuel repose sur Prometheus, Grafana, Thanos et différents exporters déployés sur l’ensemble de leur infrastructure.
Cette mission est davantage orientée réalisation que conseil, avec un véritable objectif de modernisation et de simplification de l’architecture.
Vos missions : Vous interviendrez sur l’ensemble de la plateforme d’observabilité afin de :
Reprendre en main l’architecture existante et la documenter.
Simplifier et fiabiliser la stack de monitoring.
Faire évoluer le stockage des métriques afin de conserver un historique d’environ 1 an (stockage local ou cloud).
Remplacer l’architecture actuelle reposant sur MinIO par une solution plus adaptée.
Optimiser les métriques Prometheus (nettoyage des métriques et des labels afin de limiter les coûts de stockage).
Industrialiser le déploiement et la mise à jour de la plateforme via Ansible.
Mettre en place un véritable processus de provisioning Grafana (dashboards versionnés, déploiement automatisé, limitation des modifications manuelles).
Améliorer la documentation technique de l’architecture et des procédures d’exploitation.
Objectifs complémentaires : Selon l’avancement de la mission, vous pourrez également intervenir sur :
Le remplacement de pg_agent par un exporteur PostgreSQL plus récent (ex : pgwatch) compatible avec PgBouncer.
L’amélioration de l’expérience utilisateur Grafana avec un dashboard d’accueil plus pertinent.
La gestion des hôtes décommissionnés afin d’améliorer le cycle de vie des métriques.
Contraintes techniques : Déploiement via Ansible, intégré au dépôt Git existant.
Installation sur un serveur Debian (Bookworm ou Trixie).
Une architecture Docker Compose est privilégiée.
Une installation native (systemd) pourra être envisagée si elle garantit un niveau de sécurité élevé et une maintenance simple.
Requirements
Nous recherchons un consultant disposant d’une solide expérience sur :
Prometheus
Grafana
Thanos
Exporters Prometheus
Docker Compose
Ansible
PostgreSQL
Linux Debian
Git / Infrastructure as Code
Une expérience sur les problématiques de stockage longue durée, de provisioning Grafana, d’observabilité et d’industrialisation d’infrastructures sera fortement appréciée.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Apply on fr.indeed.comGood distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
DevOps Engineer Salary [2023]
Effortlessly Scale Prometheus With The Telemetry Data Platform – And Keep your Grafana Dashboards, Too!
Dev Digest 120 - Apple and peers
Is Software Engineering Over-Saturated?