Bonjour, je suis

Djibril Faty

15 ans d'exploitation sur plateformes critiques (SLA, astreintes 24/7, incidents P1) et une spécialisation Cloud Native (Kubernetes, Terraform, GitOps, SRE). Positionné sur les transformations DevOps de contextes exigeants, notamment Cloud Souverain. J'apporte la culture de la fiabilité aux équipes qui industrialisent leurs pratiques.

Cloud Engineer / Site Reliability Engineer (SRE)

Mon approche

Ces trois valeurs guident mon travail au quotidien sur des environnements de production critiques.

Fiabilité & Disponibilité Icon

Fiabilité & Disponibilité

15 ans à garantir la haute disponibilité et le Disaster Recovery de plateformes de production critiques : respect des SLA, astreintes 24/7 et gestion d'incidents P1, avec un haut niveau d'exigence sur la continuité de service.

Automatisation & SRE

Monitoring, logging et automatisation (Ansible, scripting) pour fiabiliser les opérations, avec une approche SRE de la gestion d'incidents.

Cloud Native & Souverain

Certifié AWS SysOps Administrator et spécialisé Cloud Souverain / SRE : Kubernetes, Terraform et GitOps pour industrialiser des plateformes fiables, y compris sur des infrastructures souveraines (OVH, Proxmox).

Compétences & Outils

Les technologies et outils que je maîtrise, issus de 15 ans d'exploitation en production et de ma spécialisation Cloud Souverain / SRE.

Cloud & Conteneurisation

Infrastructures cloud publiques et souveraines, virtualisation et orchestration de conteneurs, jusqu'au réseau Kubernetes.

AWS

OVH

Proxmox

Kubernetes

Helm

Docker

Ingress-NGINX

Traefik

cert-manager

Cilium

Infrastructure as Code & Automatisation

Provisionnement et configuration des infrastructures en code : reproductibles, versionnées et automatisées.

Terraform

Ansible

Python

Bash

CI/CD & GitOps

Pipelines d'intégration et de déploiement continus, déploiements GitOps, gestion centralisée des secrets et des images.

Git

GitLab CI/CD

GitHub Actions

ArgoCD

Vault

Harbor

Observabilité & SRE

Métriques, alerting et logs centralisés au service de la haute disponibilité, avec une gestion d'incidents rigoureuse jusqu'à l'analyse des causes racines.

Prometheus

Grafana

Alertmanager

Logging centralisé

Haute dispo & DR

RCA

Systèmes, Réseaux & Données

Administration Linux, fondamentaux réseau et stockage distribué, bloc et objet, pour Kubernetes.

Linux (RHEL)

TCP/IP & DNS

Load balancing

SSH / SFTP

Longhorn

MinIO

SeaweedFS

Mon parcours

15 ans d'expérience sur des plateformes de production critiques, de la formation d'ingénieur au Cloud Engineering.

Spécialisation Ingénieur Cloud Souverain / SRE

Programme intensif de 450 h orienté production : Kubernetes, Terraform, GitOps, observabilité, pratiques SRE et Cloud Souverain. Projet de synthèse d'un mois soutenu devant un jury professionnel.

Certification Cloud — AWS SysOps Administrator

Certification AWS SysOps Administrator, en complément de l'expertise Kubernetes, Terraform et Ansible acquise sur le terrain.

Ingénieur Exploitation & Support

Pilotage du support de plateformes Cloud (OVH, AWS), garantie de la fiabilité, de la haute disponibilité et du Disaster Recovery sur des comptes clients Big Data (géolocalisation, marketing contextuel, SMS Gateway), avec une approche SRE : monitoring, logging, automatisation et gestion des incidents.

Référent Technique Validation PFS

Intégration et validation de plateformes de services IPTV/VOD, tests d'interconnexion de bout en bout, automatisation des tests de non-régression et coordination des équipes internes et partenaires.

Contact

N'hésitez pas à me contacter pour toute question ou opportunité de collaboration.

LinkedIn Icon

LinkedIn

linkedin.com/in/dfaty

Se connecter sur LinkedIn Se connecter sur LinkedIn Arrow

Envie de collaborer ?

Une question, un projet, ou simplement échanger sur le Cloud et la fiabilité des systèmes ? N'hésitez pas à me contacter.

Me contacter