CV · Mis à jour en août 2026

Site Reliability & Platform Engineer

Dix ans d'infrastructure : deux ans en administration systèmes et réseaux, puis huit ans en DevOps et SRE, dont huit de Kubernetes en production. Je construis et j'exploite des plateformes cloud internes et publiques de bout en bout — du matériel physique au self-service développeur — avec le run, l'astreinte et l'amélioration continue qui vont avec.

Aujourd'hui, j'exploite une plateforme OpenStack privée sur trois datacenters : 13 clusters Kubernetes et 250 nœuds, 200 applications, 72 clusters RabbitMQ, 127 bases PostgreSQL et une plateforme LLM on-premise. Auparavant chez Kering, j'ai assuré le support de 500+ microservices sur ECS/Fargate et six clusters Kubernetes, ainsi que d'un socle Couchbase multi-région de 2 To. En parallèle, j'ai audité et construit des infrastructures AWS et GCP pour une dizaine de clients.

Culture SLI/SLO et error budgets, tout en code. Depuis 2025, focalisé sur l'exécution de grands modèles de langage on-premise et leur application à l'exploitation.

Télécharger le PDF
Contact gabin@chambon.io +33 7 69 79 53 63 Paris, France · Remote
Autorisation de travail

Citoyen français, basé à Paris. CDI ou freelance ; disponibilité à discuter. Mobilité : France, Europe et Canada.

Expérience
Juin 2025 — aujourd'hui Inherent Group (Unyc) SRE / Platform Engineer

Opérateur télécom B2B. Équipe SRE de sept personnes responsable de tout le socle technique — cloud OpenStack privé réparti sur 3 datacenters, serveurs, baies de stockage, 13 clusters Kubernetes et plateforme de livraison. Objectif de disponibilité : 99 %.

  • Exploitation de tout le socle technique du groupe, du matériel aux applications : cloud OpenStack privé réparti sur 3 datacenters (Kolla, bare metal via Bifrost/Ironic), baies Pure Storage et 13 clusters Kubernetes totalisant 250 nœuds et 200 applications.
  • Conception et maintien du chart Helm plateforme qui déploie toutes les applications du groupe, et de la couche données : 72 clusters RabbitMQ, 127 bases PostgreSQL sous CNPG, 60 instances Redis/Valkey, un cluster Cassandra de 3 To sur 18 nœuds, et MySQL.
  • Migration de 110 applications et serveurs de l'IT interne vers le cloud OpenStack/Kubernetes privé, sans interruption sur le périmètre critique.
  • Initiative et livraison de la plateforme d'agents LLM on-premise (vLLM, llm-d, GAIE, KServe, Hermes) avec RBAC et base vectorielle Milvus/RagFlow : triage automatisé des alertes, temps de qualification des incidents réduit d'environ 80 %.
  • Migration des 13 clusters de Kubespray vers Talos — build 1 heure → 5 minutes — et rédaction puis répétition du plan de reprise : restauration d'etcd, recréation complète, sauvegardes, RTO et RPO par périmètre.
  • Standardisation du GitOps (Argo CD, Helm, Kustomize), de la conformité policy-as-code (Kyverno) et de l'élasticité (KEDA sur les files RabbitMQ) ; automatisation des accès (Boundary), de l'identité (Keycloak/OIDC via Terraform) et des mises à jour (Renovate).
Juin 2024 — juin 2025 Kering Site Reliability Engineer

Groupe de luxe mondial. Équipe infrastructure de dix personnes. Plateforme multi-cloud AWS / Alibaba, avec la majorité des workloads sur ECS/Fargate et le reste sur 6 clusters Kubernetes (3 EKS, 3 Alibaba ACK), 500+ microservices en déploiement continu et self-service Crossplane pour ~50 équipes produit. Objectif de disponibilité : 99,9 %.

  • Co-responsable du support en production de la base clients et fidélité mondiale sur Couchbase / Amazon EKS : 2 To, 18 nœuds, moteur Magma, XDCR sur trois régions.
  • Responsable de l'observabilité de ce périmètre de bout en bout — instrumentation, dashboards et règles d'alerte sur Mimir / Loki / Grafana — pour détecter les dérives de réplication et de capacité avant tout impact client.
  • Exploitation quotidienne des deux plans de déploiement : 6 clusters Kubernetes totalisant environ 200 nœuds et les stacks ECS/Fargate du groupe pilotées par Terraform, dimensionnés pour les ventes privées, les drops et la Fashion Week.
  • Réglage de l'élasticité de la flotte avec Karpenter et KEDA sur les files SNS et RabbitMQ, les métriques d'ingress et système — capacité alignée sur la charge plutôt que provisionnée pour les pics.
  • Industrialisation des infrastructures AWS et Alibaba sur 5 stacks socles Terraform / Terragrunt / Terramate, au quotidien dans un modèle Crossplane où une équipe livre application et infrastructure dans une seule merge request.
  • Maintien du chart Helm partagé par tous les microservices du groupe et de ses pipelines GitHub Actions ; policies Kyverno, IAM/IRSA et Vault pour les secrets.
  • Participation aux cellules de crise lors d'incidents majeurs, en coordonnant le diagnostic et la reprise entre les équipes infrastructure, base de données et produit.
Juin 2021 — juin 2024 Ministère de la Transition écologique DevOps Engineer

3 jours par semaine pendant trois ans, en parallèle d'une autre mission à la fois. Plateforme GitLab interne pour l'IT de l'État — équipe produit de cinq personnes au service de 2 500 développeurs et 350 projets.

  • Déploiement et exploitation de la plateforme GitLab CE interne : d'abord sur OpenStack avec Ansible et NGINX, puis migrée sur Kubernetes, pour 2 500 développeurs et 350 projets.
  • Industrialisation de la flotte de runners sur Kubernetes (RKE2, OpenStack Magnum, Helm, Argo CD) avec proxy de sortie Squid mutualisé : temps d'attente des jobs −70 %.
  • Publication de modules Terraform OpenStack réutilisables, adoptés par la communauté DevOps du ministère — provisionnement d'un environnement complet : 1 jour → 2 heures.
  • Migration de l'infrastructure as code d'OpenStack HEAT vers Terraform et déménagement de la plateforme vers une nouvelle tenancy OpenStack de l'État, sans interruption.
  • Construction de la stack d'observabilité (Prometheus, Grafana, Loki, Mimir, Fluent Bit) et des pipelines DevSecOps Terraform et Ansible ; administration de Vault sur backend Consul.
2020 — aujourd'hui Clients indépendants (~10) Consultant & auditeur cloud — AWS / GCP

Missions freelance courtes menées en parallèle des missions longues, exclusivement sur cloud public : audit d'infrastructure, et build / industrialisation. Clients anonymisés pour confidentialité ; références sur demande.

  • Audits d'infrastructure pour une dizaine de clients : revue d'architecture et de fiabilité, posture de sécurité (IAM, exposition réseau, secrets), couverture d'observabilité et coûts — livrés en plan de remédiation priorisé.
  • Reconstruction complète de l'infrastructure GCP d'un client après une compromission : évaluation du parc, reconstruction intégrale en code, redéploiement de GKE et Pub/Sub avec accès et exposition durcis.
  • Migration d'un parc WordPress d'AWS Lightsail vers EC2 — Terraform et Ansible, bases vers RDS, protection périmétrique via Cloudflare (WAF, CDN, TLS).
Juil. 2023 — juin 2024 RAS Intérim DevOps Engineer

2 jours par semaine en parallèle de la mission au ministère. Groupe d'intérim, division digitale de 20 personnes. Objectif : sortir d'Elastic Beanstalk et conteneuriser le parc.

  • Migration de 40 microservices hors d'Elastic Beanstalk en un an, en arbitrant service par service entre Amazon ECS et Kubernetes.
  • Réduction de la durée des pipelines de livraison de 20 à 3 minutes (−85 %), avec de meilleures performances applicatives et une meilleure couverture d'observabilité.
  • Accompagnement des développeurs sur Docker jusqu'à l'autonomie complète ; durcissement IAM et réseau, alerting CloudWatch, administration de RDS et MongoDB Atlas.
Juil. 2022 — juil. 2023 Coffreo DevOps Engineer

2 jours par semaine en parallèle de la mission au ministère. Équipe infrastructure de cinq personnes, migration de Proxmox / LXC vers Kubernetes chez OVHcloud.

  • Mise en place du déploiement blue/green pour 50 applications par bascule DNS CNAME, sur une infrastructure qui coupait le service à chaque release : zéro interruption, rollback instantané, lead time 30 minutes → 5.
  • Migration de 50 applications de LXC sur Proxmox vers Kubernetes chez OVHcloud, avec Helm, pipelines GitLab et secrets gérés par SOPS.
  • Déploiement de la stack d'observabilité LGTM (Loki, Grafana, Tempo et Mimir) sur les 50 applications migrées.
  • Déploiement de Consul Service Mesh et formation des équipes de développement à Kubernetes, Helm, Kustomize et SOPS jusqu'à l'autonomie de déploiement.
Mars 2020 — juil. 2022 Blocs et Compagnie DevOps Engineer

Premier recrutement technique — temps plein jusqu'en juin 2021, puis 2 jours par semaine en parallèle de la mission au ministère. Architecture, automatisation et R&D sur le confidential computing en enclaves sécurisées.

  • Conception de bout en bout de la plateforme OpenStack / RKE2 hébergeant l'application Geowallet et les workloads en enclave Intel SGX (Scone), et support en production.
  • Migration de toutes les ressources AWS et de leurs données CouchDB et PostgreSQL vers une plateforme OVHcloud OpenStack / RKE2, avec provisionnement automatisé par Terraform et Ansible.
  • Construction des pipelines GitLab CI/CD, des templates Helm, de l'observabilité et des contrôles de sécurité des microservices Node.js (Trivy, Falco, Snyk) ; développement d'un outil d'automatisation en Go sur l'API OVHcloud.
Mars 2019 — mars 2020 Atawiz Cloud & DevOps Engineer

Agence de services cloud. Missions AWS et Azure sur plusieurs comptes clients.

  • Conception et livraison d’architectures AWS et Azure pour plusieurs comptes clients.
  • Administration de Kubernetes managé sur EKS, AKS et GKE.
  • Réalisation d’une preuve de concept Hyperledger Fabric avec des smart contracts en Go.
Juin 2018 — août 2019 Equativ Ingénieur systèmes — alternance

Plateforme ad-tech. Équipe infrastructure, on-premise et AWS.

  • Déploiement et exploitation de Kubernetes on-premise avec Kubespray sur KVM.
  • Écriture de modules Terraform AWS réutilisables et de playbooks Ansible.
  • Administration AWS au quotidien : EC2, S3, IAM, Route 53.
Juin 2016 — juin 2018 Microcred · Baobab Group Administrateur systèmes & réseaux — alternance

Groupe de microfinance présent en Afrique et en Chine.

  • Administration de serveurs Linux et Windows dans les filiales du groupe.
  • Gestion des réseaux Ubiquiti et de la virtualisation VMware.
  • Support de niveau 1 à 2 auprès des utilisateurs internes.
Certifications

Certified Kubernetes Security Specialist (CKS) — Linux Foundation, 2022

Certified Kubernetes Administrator (CKA) — Linux Foundation, 2021

HashiCorp Certified: Terraform Associate — 2022

AWS Certified Solutions Architect – Associate — 2019

Recertification en cours sur les quatre.

Formation & langues

Licence Analyste en informatique et systèmes — CFA Insta, Paris, 2019.

BTS SIO, option Infrastructure, systèmes & réseaux — CFA Insta, Paris, 2018.

Français — langue maternelle · Anglais — C1, utilisé quotidiennement en équipe internationale.

Références sur demande.