Site Reliability · AI Platform · Paris, remote

Moins d'incidents. Une facture cloud plus légère.

Dix ans d'infrastructure, dont huit de Kubernetes en production. 50 clusters, 1 000+ nœuds, du bare metal au multi-cloud. Ce que je laisse derrière moi : une plateforme que votre équipe exploite sans moi.

Missions

Les plateformes que j'ai portées, et ce qui a changé

Inherent · Unyc 2025 — aujourd'hui · Opérateur télécom B2B

Tout le socle technique, du matériel au self-service développeur : cloud OpenStack privé, 13 clusters Kubernetes et 250 nœuds, 72 clusters RabbitMQ et 127 bases PostgreSQL. 110 applications migrées dessus sans interruption sur le périmètre critique.

Construction d'un cluster : 1 heure → 5 minutes. Temps de qualification des incidents réduit de 80 % avec un agent LLM on-premise.

Kering 2024 — 2025 · Groupe de luxe

Plateforme multi-cloud AWS et Alibaba : une majorité de workloads sur ECS/Fargate et 6 clusters Kubernetes, environ 200 nœuds et 500+ microservices en déploiement continu pour les maisons du groupe, dimensionnée pour absorber les ventes privées et la Fashion Week. Co-responsable de la base clients et fidélité mondiale — Couchbase, 2 To, XDCR sur trois régions.

Capacité alignée sur la charge réelle avec Karpenter et KEDA, plutôt que provisionnée pour les pics.

Ministère de la Transition écologique 2021 — 2024 · Administration centrale

La plateforme GitLab interne déployée sur Kubernetes pour 2 500 développeurs et 350 projets, sa flotte de runners industrialisée sur Kubernetes et des modules Terraform réutilisables adoptés par la communauté DevOps du ministère.

Temps d'attente des jobs : −70 %. Provisionnement d'un environnement : 1 jour → 2 heures.

Clients indépendants 2020 — aujourd'hui · ~10 missions

Missions courtes sur cloud public, en parallèle des missions longues : audits d'architecture, de fiabilité, de sécurité et de coûts, livrés sous forme de plan de remédiation priorisé — et les chantiers qui suivent. Une infrastructure GCP entièrement reconstruite en code après une compromission.

Cloud public

AWS et GCP, en production

C'est là qu'a eu lieu l'essentiel du travail sur cloud public. Le reste de la stack est plus bas.

AWS Depuis 2018 · Solutions Architect – Associate

EKS et ECS en déploiement continu pour 500+ microservices, cinq stacks socles Terraform / Terragrunt / Terramate réparties sur plusieurs comptes, Karpenter et KEDA pour l'élasticité, IAM et IRSA pour les accès, avec RDS, Aurora, ElastiCache, SNS, SQS et CloudWatch en dessous. Self-service Crossplane au-dessus : une équipe produit livre application et infrastructure dans une seule merge request.

40 microservices sortis d'Elastic Beanstalk en un an. Pipeline de livraison : 20 minutes → 3.

GCP Depuis 2019 · GKE, Pub/Sub

Kubernetes managé sur GKE et chaînes d'événements sur Pub/Sub pour des clients indépendants, en parallèle des missions AWS — dont l'infrastructure complète d'un client reconstruite de zéro en infrastructure as code après une compromission : évaluation, reconstruction, accès et exposition réseau durcis.

Un parc compromis remis en production, entièrement en code.

Stack

Ce que j'utilise

Les outils sont une preuve, pas l'argument. Voici ce qui tourne en production aujourd'hui.

Conteneurs & orchestration

Kubernetes — EKS, ACK, GKE, RKE2, Talos, Kubespray, OpenShift, Magnum · Docker · Helm · Kustomize · Karpenter · KEDA · Kyverno · Crossplane

Cloud & infrastructure

AWS · OpenStack · GCP · Alibaba Cloud · OVHcloud · Scaleway · Cloudflare · Pure Storage · Linux (Debian, Ubuntu, RHEL)

Infrastructure as code

Terraform · OpenTofu · Terragrunt · Terramate · Spacelift · Ansible · Helm · OpenStack HEAT

CI/CD & GitOps

GitLab CI · GitHub Actions · Azure DevOps · Argo CD · Flux · Renovate · Jenkins · déploiement blue/green

Observabilité

Prometheus · Grafana · Loki · Mimir · Tempo · Alloy · Faro · OpenTelemetry · Alertmanager · Datadog · Sentry · Fluent Bit

IA / LLMOps

vLLM · KServe · HolmesGPT · Kagent · LiteLLM · Milvus · RagFlow · MCP · AWS Bedrock · Hugging Face

Sécurité & secrets

HashiCorp Vault · Boundary · Consul · Keycloak (OIDC) · SOPS · Trivy · Falco · IAM/IRSA · policy-as-code

Données & stockage

Couchbase · PostgreSQL (CNPG) · Cassandra · MySQL · MongoDB Atlas · Redis / Valkey · RabbitMQ · ClickHouse · Ceph · MinIO

Pratiques

SLI / SLO / error budgets · métriques DORA · post-mortems sans blâme · astreinte · réduction du toil · self-service développeur · FinOps · DevSecOps

Blog

Derniers articles

Tous les articles
Disponible — T4 2026

Une mission plateforme longue, ou deux semaines d'audit qui disent la vérité.

Paris, 100 % remote. De la startup en amorçage au grand groupe régulé. Freelance ou salarié.

Démarrer la discussion