AI Jobs Map

VISIAN · 06000 Nice

Ingénieur(e) Production & SRE - Nice (IT) / Freelance

Posted today
Apply on IndeedOpens the original posting. AI Jobs Map never asks for your details.

Stack mentioned

sreelasticsearchopentelemetryperformance-testingjavapythonpostgresqlcassandrakubernetesjenkins

Le contextePour l'un de nos clients, nous recherchons un(e) Ingénieur(e) Production & SRE afin de reprendre en main la chaîne d'observabilité existante sur un périmètre applicatif critique, l'améliorer et réduire le RUN. L'objectif est de rendre les équipes dev et support autonomes et de faire baisser durablement les escalades N3.

Vos missions

Maintien en conditions opérationnelles de la stack Elastic (Elasticsearch, Kibana, Logstash, Filebeat) sur tous les environnements : utilisateurs et rôles, index et ILM, upgrades, pipelines d'ingestion, alerting

Observabilité applicative : APM / OpenTelemetry, dashboards et alerting préventifs par composant critique, définition et suivi des SLO / SLI, tests de performance JMeter

Analyse de production : lecture et corrélation des logs, détection des patterns récurrents et signaux faibles (saturation, dérives de performance, capacity) pour traiter les causes avant l'incident

Post-mortems et recherche de causes racines sur les incidents majeurs, plans d'action trackés, alimentation du Problem Management

Shift-left avec le support : runbooks avec le N2, dashboards exploitables par le N1 / N2

Montée en autonomie des développeurs : pairing (lecture de logs, diagnostic), kit d'autonomie dev

Pilotage par la mesure : baseline et indicateurs (heures de support N3, taux d'escalade, MTTR, SLA applicatives, couverture d'alerting)

Contribution à la roadmap technique fiabilité et observabilité, portée en PI Planning

Profil candidat:

Profil recherchéBac+5 informatique, 5 ans minimum en production / SRE sur des environnements critiques

Maîtrise de la stack Elastic en administration (pas seulement en usage) : ILM, pipelines Logstash, upgrades, RBAC

APM / OpenTelemetry, conception de dashboards et d'alerting, SLO / SLI

Lecture de code Java indispensable pour relier un log à sa cause dans le code

Scripting Python pour l'automatisation d'exploitation

Connaissance de PostgreSQL, Cassandra, Kubernetes, Jenkins / Sonar / Nexus

Pratique de l'agile à l'échelle (SAFe) appréciée

Posture de coach et bon rédacteur : runbooks, synthèses, post-mortems lisibles par des non-experts

Français courant impératif

More jobs at VISIAN