Mener une veille technologique et stratégique sur les écosystèmes cloud, les pratiques DevOps et les nouvelles architectures en évaluant leur pertinence technique et métier pour orienter les choix de solutions et les propositions d'innovation Conduire une analyse des besoins utilisateurs en mobilisant des techniques d'entretien et d'atelier participatif afin d'identifier les objectifs fonctionnels, non-fonctionnels (performance, sécurité) et les impératifs d'accessibilité, du système d'information Auditer les systèmes techniques et les processus existants en s'appuyant sur l'analyse documentaire et les entretiens avec les parties prenantes, afin d'éclairer les choix d'évolution et orienter la stratégie d'architecture future Évaluer la faisabilité technique d'un projet en analysant les contraintes technologiques, budgétaires, temporelles et environnementales afin de valider ou ajuster le périmètre d'intervention Concevoir une architecture cloud-native en appliquant les patterns d'architecture cloud adaptés, afin de garantir la résilience, la scalabilité horizontale et la maintenabilité dans des environnements dynamiques et élastiques Sélectionner les modèles de service cloud (IaaS, CaaS, PaaS, FaaS, SaaS) et les technologies associées, en comparant leurs performances, coûts, compatibilités et leur efficience énergétique, afin d'optimiser l'adéquation avec les besoins métier dans une démarche de sobriété numérique Définir les principes de sécurité dès la conception en conciliant contraintes réglementaires et bonnes pratiques de cybersécurité pour assurer la protection des systèmes et des données Modéliser les architectures et flux de données en utilisant les outils de modélisation appropriés (UML, diagrammes d'architecture) afin de s'aligner avec les équipes et les parties prenantes autour d'une architecture cible Présenter et argumenter les choix architecturaux auprès des interlocuteurs techniques et métier en adaptant le niveau de communication pour obtenir la validation des solutions Produire la documentation d'architecture de référence (notes de cadrage, spécifications techniques, schémas) en formalisant les principes, les choix et les contraintes pour guider les équipes et assurer la maintenabilité de la solution Documenter les interfaces et protocoles d'échanges en précisant les formats, sécurisations et modalités techniques pour permettre l'intégration des composants Planifier les projets techniques en appliquant les méthodologies adaptées au contexte (ex: agile) afin de définir les livrables, les étapes clés et ressources nécessaires Orchestrer le flux de travail des équipes en animant les sessions collaboratives, en procédant aux arbitrages techniques pour lever les points de blocage, et en s'appuyant sur les outils de gestion partagés, afin d'assurer la fluidité des activités et la prévisibilité des livraisons Définir et piloter le système de mesure de la performance projet, en instrumentant son cycle de vie avec des indicateurs actionnables, afin d'aider à la prise de décision et de communiquer efficacement sur sa progression Piloter les risques projet (techniques, humains, organisationnels) en procédant aux arbitrages nécessaires sur les contraintes de qualité, coût et délai, afin de garantir le respect des engagements et de sécuriser l'atteinte des objectifs Piloter la résolution d'incidents et de problèmes complexes en mobilisant une expertise technique pour diagnostiquer les causes racines et mettre en œuvre les plans d'action appropriés afin de rétablir et de fiabiliser le service Organiser la gestion de crise en définissant les procédures d'escalade et de communication pour minimiser l'impact sur les activités métier Élaborer la documentation technique opérationnelle (playbooks, runbooks, procédures) en formalisant les bonnes pratiques et processus pour faciliter l'autonomie des équipes Organiser le transfert de compétences en animant des sessions de formation et d'accompagnement technique, en adaptant les modalités pédagogiques et les outils aux besoins spécifiques des collaborateurs, y compris ceux en situation de handicap, tout en respectant les principes d'ergonomie et de prévention des risques professionnels, pour développer l'expertise des équipes dans des conditions de travail saines Mettre en place les outils et processus d'accompagnement à l'adoption des bonnes pratiques DevOps, y compris celles relatives à l'accessibilité numérique, en créant les supports et cadres de travail appropriés pour accélérer la montée en maturité Concevoir des pipelines CI/CD adaptés aux projets en analysant les besoins de déploiement et les contraintes techniques afin d'automatiser le cycle de vie applicatif de bout en bout Définir les stratégies de déploiement (blue-green, canary, rolling) en évaluant les risques et les exigences de disponibilité pour minimiser l'impact sur la production Implémenter les mécanismes de rollback et de monitoring des déploiements en intégrant les outils d'observabilité pour garantir la réversibilité et la traçabilité des livraisons Développer l'infrastructure as code en utilisant les outils appropriés (tel que Terraform ou Ansible) pour provisionner et gérer les ressources de manière reproductible Versionner et organiser le code d'infrastructure en appliquant les bonnes pratiques de développement et de gestion de configuration pour assurer la maintenabilité et la collaboration Gérer les environnements multi-cloud et hybrides en adaptant les templates et configurations pour optimiser la portabilité et l'efficience des déploiements Intégrer les tests automatisés dans les pipelines en orchestrant les tests unitaires, d'intégration, de performance et d'accessibilité (a11y) pour valider la qualité du code et des déploiements Interconnecter les outils de la chaîne CI/CD via APIs et webhooks en configurant les flux d'échanges de données pour créer une chaîne outillée cohérente et automatisée Automatiser les tâches opérationnelles récurrentes en développant des scripts et workflows personnalisés pour limiter les interventions manuelles, réduire la charge de travail répétitive et améliorer l'efficacité et les conditions de travail des équipes Conduire un audit de sécurité d'un système (application, infrastructure, pipeline) en s'appuyant sur des référentiels de bonnes pratiques (ex: OWASP, CIS) et des analyses techniques, afin d'identifier et de hiérarchiser les vulnérabilités, les défauts de configuration et les écarts de conformité Élaborer un plan de remédiation priorisé en traduisant les vulnérabilités identifiées en actions correctives techniques et organisationnelles, afin de proposer une feuille de route claire pour l'amélioration de la sécurité et d'éclairer la prise de décision Mettre en œuvre une stratégie de "Shift Left Security" en intégrant des outils d'analyse (SAST, DAST, SCA) au cœur des pipelines CI/CD, afin de détecter et de permettre la correction des vulnérabilités au plus tôt du cycle de vie logiciel Automatiser l'analyse des vulnérabilités des conteneurs et images en utilisant les scanners spécialisés (tel que Trivy, Clair ou Snyk) pour sécuriser les artefacts avant leur déploiement Mettre en place les politiques de remédiation automatisée en définissant les seuils critiques et les actions correctives pour traiter les vulnérabilités selon leur criticité Gérer les secrets et données sensibles en implémentant les coffres-forts numériques (avec des outils tel que Vault ou AWS Secrets Manager) et les mécanismes de rotation automatique pour protéger les informations critiques Sécuriser les communications réseau en configurant les politiques de segmentation, chiffrement et contrôle d'accès pour garantir la confidentialité, l'intégrité et la segmentation des flux de données Durcir les configurations systèmes et applicatives en appliquant les benchmarks de sécurité (CIS, OWASP) et les principes de moindre privilège pour réduire la surface d'attaque Mettre en œuvre une approche de "Compliance as Code" en traduisant les exigences réglementaires (telles que RGPD, PCI-DSS, HDS) et préparer les audits de conformité (tels que SOC 2 ou ISO 27001), en traduisant ces exigences en règles et contrôles automatisés afin de garantir et de prouver la conformité en continu tout au long du cycle de livraison Documenter et tracer les mesures de sécurité mises en œuvre en produisant les preuves d'audit et rapports de conformité pour faciliter les contrôles réglementaires Maintenir la gouvernance sécuritaire en définissant les politiques de sécurité, procédures d'incident et plans de continuité, en intégrant la gestion du stress lié aux incidents de sécurité, pour assurer la sécurité opérationnelle continue sans compromettre le bien-être des équipes Orchestrer des applications conteneurisées avec Kubernetes en configurant les ressources, services et politiques de résilience pour garantir la scalabilité automatique et la haute disponibilité Concevoir des architectures multi-zones et multi-régions en exploitant les services cloud managés (AWS, GCP, Azure) pour assurer la continuité de service et la reprise après sinistre Implémenter les patterns de résilience applicative (circuit breaker, retry, timeout) en intégrant les mécanismes de tolérance aux pannes pour maintenir la performance en cas de défaillance partielle Définir les Service Level Indicators (SLI) en identifiant les métriques critiques de performance, disponibilité et latence pour mesurer objectivement la qualité de service Établir les Service Level Objectives (SLO) en fixant les seuils de performance acceptables basés sur les besoins métier pour contractualiser les niveaux de service attendus Contribuer à la négociation des Service Level Agreements (SLA) en traduisant les SLO en engagements contractuels réalisables, afin de garantir l'alignement entre les attentes métier et les capacités techniques Architecturer la supervision complète des systèmes en déployant les solutions de monitoring, logging et alerting (tel que Prometheus, Grafana ou ELK) pour assurer l'observabilité en temps réel Optimiser les performances et les coûts d'infrastructure (FinOps) en analysant les métriques d'utilisation, en mesurant l'empreinte carbone (GreenOps) et en ajustant le dimensionnement pour maximiser l'efficience opérationnelle et environnementale Gérer les incidents de production en appliquant les méthodes SRE (post-mortem, error budget, chaos engineering) en préservant l'équilibre et la charge de travail des équipes pour améliorer continuellement la fiabilité des services