AI Jobs Map

RIDCHA DATA · Sophia Antipolis (06)

INGÉNIEUR PRODUCTION & SRE

Posted today
Apply on IndeedOpens the original posting. AI Jobs Map never asks for your details.

Stack mentioned

sreelasticsearchopentelemetrypythonperformance-testingjavakubernetespostgresqlcassandradevopsjenkins

Notre client, acteur majeur des services numériques de confiance, recherche un Ingénieur Production & SRE pour renforcer son équipe d?ingénierie.

Vous évoluerez sur des plateformes numériques critiques, avec un objectif clair : améliorer la fiabilité, l?observabilité et la performance de la production tout en réduisant progressivement le RUN et les escalades vers le N3.

? Votre missionVous serez au c?ur des sujets Production, SRE et Observabilité, avec une forte dimension d?analyse et d?amélioration continue.

Vos principales responsabilités :

? Administrer et maintenir la stack Elastic : Elasticsearch, Kibana, Logstash, Filebeat

? Mettre en place et faire évoluer les dashboards, alertes et indicateurs de supervision

? Développer l?observabilité applicative avec APM / OpenTelemetry

? Définir et suivre les SLO / SLI

? Analyser les logs, corréler les signaux et identifier les causes racines des incidents

? Détecter les patterns récurrents, signaux faibles, problèmes de capacité et dérives de performance

? Réaliser les post-mortems et piloter les plans d?actions associés

? Construire des runbooks et accompagner les équipes Support N1/N2

? Faire monter les équipes de développement en autonomie sur le diagnostic et l'analyse de production

? Automatiser les tâches récurrentes avec Python

? Réaliser des tests de performance avec JMeter

? Contribuer à la roadmap technique et aux démarches d?amélioration de la fiabilité

? Participer aux instances Agile / SAFe / PI Planning

? L'objectif n'est pas d'ajouter du RUN, mais bien de reprendre l'existant, le fiabiliser, l'industrialiser et progressivement le réduire.

?? Environnement technique : Observabilité / Logs :

Elastic Stack, Elasticsearch, Kibana, Logstash, Filebeat, APM, OpenTelemetry

Développement & automatisation :

Java, Python

Infrastructure :

Kubernetes, environnements de production critiques

Bases de données :

PostgreSQL, Cassandra

DevOps / CI-CD :

Jenkins, SonarQube, Nexus

Performance :

JMeter

Méthodologie :

Agile / SAFe / PI Planning

Profil candidat:

Vous êtes diplômé(e) d'une formation Bac+5 en informatique et disposez d'une expérience significative en Production, SRE, Observabilité ou DevOps.

Vous êtes particulièrement à l'aise pour :

?? Partir d'un log ou d'un symptôme et remonter jusqu'à la cause racine

?? Lire du code Java afin de comprendre l'origine d'un problème

?? Analyser des incidents complexes dans des environnements critiques

?? Identifier les problèmes avant qu'ils ne deviennent des incidents

?? Mettre en place des solutions durables plutôt que des contournements

?? Transmettre vos connaissances et rendre les équipes autonomes

?? Travailler avec des indicateurs : MTTR, SLA, taux d'escalade, couverture d'alerting, etc.

? Ce qui fera la différenceAu-delà des compétences techniques, nous recherchons une personne avec une véritable posture SRE :

? Esprit d'analyse et capacité à prendre du recul

? Culture de la fiabilité et de la performance

? Pédagogie et esprit de coaching

? Goût pour la mesure et l'amélioration continue

? Rigueur dans la documentation

? Aisance pour présenter ses analyses aussi bien aux équipes techniques qu'au management

More jobs at RIDCHA DATA