Ingénieur Sre Observabilité Grafana - Grafana Cloud H/F

Grafana Cloud
France
2 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
8 years minimum
Working hours
Regular working hours
Languages
English

Tech stack

Java (Programming Language) Amazon Web Services Amazon Elastic Compute Cloud Cloud Computing Python (Programming Language) Load Testing Prometheus WebKit Data Server Interface Grafana Kubernetes Terraform
+1 more
Golang

Job description

Déployer et fine-tuner la plateforme Grafana Cloud sur de nouvelles équipes applicatives : configuration des connecteurs, dashboards, règles d’alerting et healthchecks.

  • Concevoir des setups standardisés et réutilisables pour industrialiser l’onboarding de chaque nouvelle équipe.
  • Instrumenter les applications avec les équipes de développement : métriques applicatives, logs structurés, traces distribuées et suivi de l’expérience utilisateur.
  • Définir et mettre en oeuvre les processus de gestion d’incidents : règles d’alerte, routage, escalade, runbooks, et passage d’une détection passive à une détection proactive avant impact client.
  • Définir les SLI/SLO des applications du périmètre avec les équipes, et exploiter les error budgets comme outil d’arbitrage.
  • Réduire le bruit d’alerting et maîtriser les volumes d’ingestion (cardinalité, labellisation, rétention).
  • Accompagner chaque équipe de bout en bout : état des lieux, configuration, tests, suivi de la montée en maturité.
  • Faire converger les pratiques de monitoring entre les équipes et s’aligner avec la DSI sur la trajectoire globale.

Requirements

Profil recherché8 ans minimum en ingénierie de production, dont une expérience substantielle et récente sur l’observabilité.Compétences techniques :Expérience confirmée de mise en place d’une plateforme d’observabilité basée sur l’écosystème Grafana : Grafana Cloud ou Grafana self-hosted (communautaire), les deux sont recevables.Maîtrise opérationnelle d’au moins trois des services de la suite : Loki (logs), Tempo (traces), Mimir ou Thanos (métriques longue durée), Alloy (collecte), Faro (RUM front), k6 (synthetic et tests de charge).Prometheus et OpenTelemetry : collecte, instrumentation, PromQL.Expérience réelle de la production applicative : gestion d’incidents en production, diagnostic et analyse de causes racines. C’est un prérequis ferme.SLI/SLO, error budgets, conception de règles d’alerting et réduction des faux positifs.Kubernetes et AWS (EC2, EKS, RDS).Compétences techniques : appréciéesUn passé de développeur applicatif (Java, Python, Go ou équivalent), ou une pratique régulière du code d’instrumentation aux côtés des équipes de dev.Provisionnement de l’observabilité as code (Terraform, opérateurs Kubernetes, CRD Grafana).Soft skillsCapacité à accompagner des équipes de développement dans l’adoption de nouvelles pratiques, y compris face à des priorités concurrentes.Aptitude à vulgariser des sujets techniques et à dialoguer aussi bien avec des développeurs qu’avec une DSI.Autonomie LanguesAnglais courant : documentation en anglais, au moins deux équipes anglophones.

Mais aussi…

Taux journalier :670€/jour.css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(–chakra-space-1-5);padding-inline-start:var(–chakra-space-1-5);-webkit-padding-end:var(–chakra-space-1-5);padding-inline-end:var(–chakra-space-1-5);text-transform:none;font-size:var(–chakra-fontSizes-xs);border-radius:var(–chakra-radii-md);font-weight:var(–chakra-fontWeights-semibold);background:var(–chakra-colors-success-200);color:var(–chakra-colors-success-700);box-shadow:var(–badge-shadow);padding:4px 6px;–badge-bg:var(–chakra-colors-success-100);–badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{–badge-bg:rgba(226, 243, 232, 0.16);–badge-color:var(–chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(–chakra-colors-rythm-600);}, * 8 ans minimum en ingénierie de production, dont une expérience substantielle et récente sur l’observabilité.

Compétences techniques :

  • Expérience confirmée de mise en place d’une plateforme d’observabilité basée sur l’écosystème Grafana : Grafana Cloud ou Grafana self-hosted (communautaire), les deux sont recevables.
  • Maîtrise opérationnelle d’au moins trois des services de la suite : Loki (logs), Tempo (traces), Mimir ou Thanos (métriques longue durée), Alloy (collecte), Faro (RUM front), k6 (synthetic et tests de charge).
  • Prometheus et OpenTelemetry : collecte, instrumentation, PromQL.
  • Expérience réelle de la production applicative : gestion d’incidents en production, diagnostic et analyse de causes racines. C’est un prérequis ferme.
  • SLI/SLO, error budgets, conception de règles d’alerting et réduction des faux positifs.
  • Kubernetes et AWS (EC2, EKS, RDS).

Compétences techniques : appréciées

  • Un passé de développeur applicatif (Java, Python, Go ou équivalent), ou une pratique régulière du code d’instrumentation aux côtés des équipes de dev.
  • Provisionnement de l’observabilité as code (Terraform, opérateurs Kubernetes, CRD Grafana).

Soft skills

  • Capacité à accompagner des équipes de développement dans l’adoption de nouvelles pratiques, y compris face à des priorités concurrentes.
  • Aptitude à vulgariser des sujets techniques et à dialoguer aussi bien avec des développeurs qu’avec une DSI.
  • Autonomie

Langues

  • Anglais courant : documentation en anglais, au moins deux équipes anglophones., Prometheus Anglais AWS Routage Grafana Kubernetes Autonomie

About the company

Notre client, éditeur de solutions logicielles pour les professionnels de la finance et de la gestion de patrimoine, renforce son équipe Observabilité. Le groupe s’est construit par croissance externe et mène un chantier de rationalisation autour d’une plateforme Grafana Cloud déjà déployée et validée sur deux équipes pilotes. L’enjeu est désormais de l’étendre à une dizaine d’équipes supplémentaires, sur un périmètre de 20 à 25 équipes et environ 300 ingénieurs.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

1:59 min

Configuring the browser speech recognition class and grammar

Tobias Münch Tobias Münch · World Congress 2024

1:08 min

Building solutions with open source GoLang infrastructure tools

Jad Wahab · LIVE

10:40 min

Visualizing Prometheus open metrics using custom Grafana dashboards

Stijn Polfliet · LIVE

3:52 min

Comparing French work-life balance principles with international engineering practices

Chris Heilmann +2 · LIVE

4:47 min

Automating frontend performance metrics with Google Lighthouse

Miki Lombardi · JS Congress

2:49 min

Evaluating cross-browser support and persistent platform limitations

Nico Martin · LIVE

Videos

See all

Related articles

See all