Description du poste
Rejoignez une entreprise dynamique dans le secteur de l'informatique et contribuez à notre succès en tant que Senior Observability & Automation Engineer. Basé à Rabat, ce poste stratégique vous invite à repousser les limites de la performance et de la fiabilité de nos systèmes. Votre mission principale sera d'assurer une visibilité inégalée sur nos opérations et de concevoir des solutions d'automatisation innovantes pour optimiser notre infrastructure.
Votre rôle sera essentiel pour garantir la stabilité, l'efficacité et la scalabilité de nos plateformes. Vous piloterez l'amélioration continue de nos capacités d'observabilité, permettant une détection proactive des problèmes et une résolution accélérée. L'automatisation des tâches répétitives et complexes sera au cœur de vos contributions, libérant ainsi du temps pour des initiatives à plus forte valeur ajoutée et renforçant notre agilité opérationnelle.
Au quotidien, vous serez amené à :
- Concevoir, implémenter et maintenir des solutions d'observabilité de bout en bout (monitoring, logging, tracing).
- Développer et déployer des scripts et des outils d'automatisation pour la gestion de l'infrastructure et les opérations.
- Collaborer étroitement avec les équipes de développement et d'exploitation pour identifier les besoins en matière d'observabilité et d'automatisation.
- Analyser les données de performance et les alertes pour identifier les tendances, les goulets d'étranglement et les opportunités d'amélioration.
- Participer à la définition de l'architecture cible et à la sélection des technologies appropriées.
- Former et accompagner les équipes sur les bonnes pratiques de l'observabilité et de l'automatisation.
Vous travaillerez sur des environnements complexes, en utilisant les technologies les plus avancées pour garantir la performance et la disponibilité de nos services.
Profil recherche
Vous possédez un diplôme de niveau Bac +5 et plus, idéalement dans le domaine de l'informatique ou de l'électronique. Votre parcours académique vous a doté de solides bases théoriques et d'une compréhension approfondie des systèmes complexes.
Forte d'une expérience significative de 5 à 10 ans dans des rôles similaires, vous avez déjà fait vos preuves dans la mise en place de stratégies d'observabilité et le déploiement de solutions d'automatisation à grande échelle. Votre parcours témoigne d'une capacité avérée à gérer des projets d'envergure et à avoir un impact tangible sur la performance des systèmes.
- Maîtrise des concepts et outils d'observabilité (Prometheus, Grafana, ELK Stack, Datadog, etc.).
- Excellente connaissance des langages de scripting (Python, Bash, PowerShell) et des outils d'automatisation (Ansible, Terraform, Chef, Puppet).
- Solides compétences en cloud computing (AWS, Azure, GCP) et en conteneurisation (Docker, Kubernetes).
- Compréhension des architectures distribuées et des microservices.
- Capacité à diagnostiquer et résoudre des problèmes complexes dans des environnements de production.
- Autonomie, rigueur, et excellentes compétences en communication.
Si vous êtes passionné par l'optimisation des systèmes et que vous souhaitez laisser votre empreinte dans une entreprise leader, votre profil nous intéresse vivement.
Observability
Dynatrace (Managed et SaaS)
Zabbix (Expert)
OpenTelemetry
Prometheus
Grafana
Elastic/OpenSearch
Logs, Metrics & Traces
SLI / SLO / SLA
Synthetic Monitoring
Real User Monitoring (RUM)
APM
Infrastructure Monitoring
Network Monitoring
Automation
• Python
• PowerShell
• Bash
• Ansible
• Terraform (un plus)
• Git
• CI/CD (GitLab CI, GitHub Actions ou Jenkins)
• API REST
• JSON / YAML
Infrastructure
• Linux
• Windows
• VMware
• Hyper-V
• Kubernetes
• Docker
• Azure
• AWS (un plus)
ITSM
• ServiceNow
• GLPI
• SMAX
• Jira
• Intégration Monitoring ↔ ITSM
• Auto-ticketing
• Auto-remediation
Base de données
• MySQL
• PostgreSQL
• SQL Server
Soft Skills
• Leadership technique
• Esprit d'analyse
• Résolution de problèmes
• Documentation
• Communication
• Coaching des équipes
• Travail sous pression
• Gestion des priorités
Les responsabilités
• Concevoir l'architecture des plateformes d'observabilité.
• Administrer les plateformes Zabbix et Dynatrace.
• Définir les standards de supervision.
• Mettre en œuvre les stratégies d'observabilité.
• Développer les automatisations et les auto-remédiations.
• Intégrer les plateformes avec les outils ITSM.
• Optimiser les performances et la disponibilité des plateformes.
• Participer aux projets Cloud et Kubernetes.
• Assurer le support N3.
• Produire des KPI et des tableaux de bord.
• Participer aux revues d'architecture.
• Encadrer techniquement les membres de l'équipe.
• Garantir la continuité des activités en assurant un rôle de backup sur les plateformes critiques.
Profil recherché
• 7 à 10 ans d'expérience en supervision, observabilité ou exploitation IT.
• Expertise confirmée sur Zabbix et Dynatrace ou equivalent.
• Solides compétences en automatisation et scripting.
• Bonne connaissance des architectures Cloud et des environnements hybrides.
• Expérience des environnements critiques 24/7.
• Bon niveau d'anglais professionnel.