
Ingénieur Sre (h/f)
Posted 4 days ago
Company Description
View moreInetum est un leader européen des services numériques. Pour les entreprises, les acteurs publics et la société dans son ensemble, les 26 000 consultants et spécialistes du Groupe visent chaque jour l’impact digital : des solutions qui contribuent à la performance, à l’innovation et au bien commun.
Présent dans 19 pays au plus près des territoires, et avec ses grands partenaires éditeurs de logiciels, Inetum répond aux enjeux de la transformation digitale avec proximité et flexibilité.
Porté par son ambition de croissance et d’industrialisation, Inetum a généré en 2025 un chiffre d’affaires de 2,2 milliards d’euros.
Job Description
Missions principales
Maintien en conditions opérationnelles
Surveiller le SI et traiter les alertes selon les engagements de service (SLA/SLO)
Diagnostiquer et résoudre les incidents en coordination avec les équipes applicatives et infra
Contribuer à la gestion des incidents majeurs
Interventions préventives
Analyser les tendances (alertes récurrentes, saturation, dérives de performance)
Mettre en place des actions préventives (optimisation, tuning, scaling, patching)
Anticiper les risques via l’analyse des métriques, traces et logs
Participer à la réduction du run correctif au profit du run préventif
Observabilité & supervision
Faire évoluer la plateforme d’observabilité
Concevoir, maintenir et améliorer les dashboards Grafana
Définir et ajuster les alertes Prometheus (seuils, pertinence, réduction du bruit)
Améliorer en continu la supervision et la qualité des indicateurs
Amélioration continue
Identifier les points de fragilité du SI et proposer des actions correctives et préventives
Contribuer à la fiabilisation (automatisation, standardisation)
Participer aux retours d’expérience (post-mortem)
Collaboration & support
Travailler en lien avec les équipes dev, infra et métier
Apporter un support technique aux équipes pour améliorer l’exploitabilité et la robustesse des services
Organisation & contraintes
Plage normale d’intervention : 7h30 – 18h30 (jours ouvrés)
Participation aux astreintes en soirée, week-end et jours fériés
Compétences attendues
Bonne maîtrise des outils d’observabilité (Grafana, Prometheus)
Connaissance des environnements systèmes, réseaux et cloud
Compréhension des concepts SRE : SLA, SLO, SLI, error budget
Capacité d’analyse proactive et prévention des incidents
Automatisation (scripts / outils : Bash, Python, etc.)
Votre profil
Formation Bac+5 en informatique
Expérience de plus de 5 ans sur un poste similaire
Esprit analytique et orienté résolution de problème
Proactivité et capacité d’anticipation
Culture de l’amélioration continue
Bon relationnel et travail transverse
Rigueur et sens du service
Benefits
- 70% de transport est pris en charge
- Télétravail possible
- Un CSE
