Expert Observabilité SI - Datadog

Visian
Paris, France
2 months ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Regular working hours
Job source

Tech stack

Application Programming Interfaces (APIs) Bash Shell Cloud Computing Continuous Integration Python (Programming Language) Software Engineering Datadog Reliability of Systems Terraform

Job description

MissionsDéfinition du modèle d?observabilité (Blueprints & Standards)

Concevoir et maintenir les blueprints d?observabilité (logs, métriques, traces, RUM, synthetics)

Définir les standards d?instrumentation (OpenTelemetry, tagging, naming, SLO/SLI)

Structurer une approche ?Observability by Design? intégrée aux cycles de développement

Formaliser des patterns d?intégration Datadog pour différents types d?applications et architectures

Plateforme Datadog & Enablement des équipes

Piloter et optimiser la plateforme Datadog (APM, Logs, Infrastructure, RUM, Synthetic Monitoring)

Mettre en place des mécanismes self-service pour les équipes (templates, dashboards prêts à l?emploi, librairies)

Intégrer l?observabilité dans les chaînes CI/CD

Conjointement avec les experts de l’infrastructure Cloud, automatiser les déploiements et configurations (Terraform, API Datadog)

Supervision de la supervision & FinOps

Définir et mettre en ?uvre les pratiques de ?monitoring de la plateforme d?observabilité? :

Qualité des données

Taux de couverture

Pertinence des alertes

Piloter la maîtrise des coûts Datadog : Optimisation du volume de logs et traces

Politique de rétention

Gouvernance des usages

Mettre en place des indicateurs FinOps et tableaux de bord de pilotage

Approche SRE & fiabilité des systèmes

Déployer les pratiques SRE (SLO/SLI, error budgets, toil reduction)

Accompagner les équipes dans la gestion proactive des performances et incidents

Contribuer à l?amélioration continue de la résilience des systèmes

Promouvoir l?usage de l?observabilité pour la prise de décision opérationnelle (gestion des événements)

Animation de la communauté & conduite du changement

Animer une communauté SRE / Observabilité transverse

Organiser des ateliers, formations et retours d?expérience

Produire de la documentation, guidelines et bonnes pratiques

Acculturer les équipes aux enjeux d?observabilité moderne et de fiabilité

Compétences techniquesMaîtrise de Datadog (APM, Logs, RUM, Synthetic Monitoring, Infrastructure Monitoring)

Excellente connaissance des concepts d?observabilité (logs, métriques, traces, OpenTelemetry)

Requirements

Expérience dans la définition de modèles / standards d?observabilité à l?échelle

Connaissance des pratiques SRE (SLO, SLI, error budgets)

Expérience en FinOps appliqué aux outils de monitoring

Compétences en automatisation (Terraform, scripting Python/Bash)

Bonne compréhension des environnements cloud et architectures distribuées

Connaissance des apports de l?IA appliquée à l?observabilité (AIOps)

Compétences comportementalesVision produit et approche plateforme

Forte capacité d?influence et de leadership transverse

Esprit analytique et orientation résultats

Pédagogie et capacité à embarquer des communautés techniques

Autonomie et proactivité

Outils & EnvironnementAWS (niveau avancé, 5 à 8 ans d?expérience)

Datadog

Bonnes pratiques de développement logiciel, Minimum 5 ans d?expérience dans les domaines de l?observabilité, de la supervision ou du SRE, avec une forte orientation plateforme et transformation des pratiques

Maîtrise de Datadog (APM, Logs, RUM, Synthetic Monitoring, Infrastructure Monitoring)

Excellente connaissance des concepts d?observabilité (logs, métriques, traces, OpenTelemetry)

Expérience dans la définition de modèles / standards d?observabilité à l?échelle

Connaissance des pratiques SRE (SLO, SLI, error budgets)

Expérience en FinOps appliqué aux outils de monitoring

Compétences en automatisation (Terraform, scripting Python/Bash)

Bonne compréhension des environnements cloud et architectures distribuées

Connaissance des apports de l?IA appliquée à l?observabilité (AIOps)

Vision produit et approche plateforme

Forte capacité d?influence et de leadership transverse

Esprit analytique et orientation résultats

Pédagogie et capacité à embarquer des communautés techniques

Autonomie et proactivité

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

5:34 min

Managing token budgets and enterprise usage of coding agents

Chris Heilmann +2 · LIVE

1:34 min

Essential commands for running and testing Terraform configurations

Hennie Francis · LIVE

3:52 min

Avoiding remote code execution from unsanitized inputs

Alexander Pirker · WWC 2022

2:57 min

Core technical practices for robust data engineering

Sandhya Menon Sandhya Menon · WWC Europe 2026

1:16 min

Combining saas and open-source observability for extreme scale

Mikael Robert Mikael Robert · WWC 2025

54 sec

Interpreting complex terminal commands safely using external explanation utilities

Dan Cranney +2 · LIVE

Videos

See all

Related articles

See all