Retours d'expérience

Mes cas clients
des problèmes critiques,
des résultats mesurés.

Coûts · résilience · performance

Ce qui coinçait, ce qu'on a fait, et ce que ça a changé, sur des infrastructures en production.

Startups et PME sans équipe infra

Un fondateur ou une petite équipe tech, et personne dont c'est le métier de s'occuper de l'infra.

Gam'in

Startup edtech · fondateur développeur, pas d'équipe infra

Résultat

Son infra suit sa croissance, et il déploie seul

Il pousse son code, une préproduction se crée, la production suit. Sans ops, et sans avoir appris Kubernetes.

Le problème

Tout tournait sur un seul serveur configuré à la main : s'il tombait, tout tombait, et impossible d'essayer une modification avant la mise en production. Avec une centaine de nouveaux clients par semaine.

Ce qu'on a fait

  • Infra reconstruite sur OVHcloud, entièrement décrite en code et reproductible
  • Une préproduction créée automatiquement à chaque modification
  • Base de données redondante, restaurable à la minute près, supervision et sauvegardes

« J'ai eu l'occasion de faire appel à Arthur pour l'infra de Gam'in avant la mise en production. Rigueur, efficacité et sur le plan humain Arthur est une personne qui mérite le détour. Je recommande les yeux fermés. Merci »

Frédéric Hugonnet · Président Fondateur, Gam'in Tech
Détails techniques
  • · Socle Kubernetes managé sur OVHcloud, entièrement décrit en OpenTofu (cluster, bases managées, stockage objet, DNS, load balancer)
  • · GitOps ArgoCD : un environnement de prévisualisation créé automatiquement à chaque pull request
  • · Les deux applications rendues stateless, fichiers externalisés vers le stockage objet
  • · PostgreSQL en haute disponibilité avec restauration à la minute près, secrets en coffre-fort, SSO devant les interfaces d'administration
  • · Supervision, journaux, sauvegardes du cluster, HTTPS et DNS automatiques
  • · Puis, dans un second temps, le site public et son CDN d'assets
OVHcloud Kubernetes managé OpenTofu ArgoCD CloudNativePG Laravel

Écris-Moi

App de rencontre · avant le lancement

Résultat

-69 % sur la facture AWS, prod stable au lancement

Plus de redémarrages intempestifs, et une alerte avant que ça casse.

Le problème

À quelques semaines du lancement, l'infra plantait régulièrement, personne ne voyait ce qui se passait dedans, et les serveurs étaient surdimensionnés.

Ce qu'on a fait

  • Infra stabilisée avant le lancement
  • Supervision et alertes mises en place
  • Serveurs dimensionnés sur la consommation réelle et ajustés automatiquement à la charge

« Un énorme merci ! :) »

Détails techniques
  • · Résolution des problèmes de stabilité du cluster EKS
  • · Monitoring et alerting : stack VictoriaMetrics + Grafana
  • · Charts Helm prod-ready : PDB, HPA, VPA, Anti-Affinity
  • · ACM + ALB pour certificats wildcard automatiques
  • · Sizing pods et storage basé sur les métriques réelles
  • · Autoscaling : Karpenter, HPA, VPA
AWS EKS Karpenter Helm VictoriaMetrics Grafana

Monnier Paris

E-commerce mode & luxe · plateforme sur Heroku

Résultat

-72 % sur la facture cloud

Après un audit des coûts et une migration de Heroku vers AWS.

Le problème

Heroku facture la puissance de calcul au prix fort, et rien n'était dimensionné sur la consommation réelle de la boutique.

Ce qu'on a fait

  • Audit des coûts, poste par poste
  • Migration de Heroku vers AWS
  • Serveurs dimensionnés sur la consommation réelle, déploiements automatisés

« Merci Arthur pour ta disponibilité sur cette migration ! »

Détails techniques
  • · Audit des coûts, puis migration de Heroku vers AWS Elastic Beanstalk
  • · Right-sizing basé métriques
  • · Migration de la stack de logs
  • · Pipeline GitLab CI avec S3 + AWS CLI
Heroku → AWS Elastic Beanstalk GitLab CI S3

Exxact Robotics

Robotique agricole · infra héritée d'un ancien prestataire

Résultat

Commercialisation débloquée

+100 k€ de budget débloqués par le groupe suite aux audits.

Le problème

L'ancien prestataire était parti : il ne restait qu'un compte AWS, et personne ne savait comment l'infra fonctionnait. Impossible de vendre le produit dans cet état.

Ce qu'on a fait

  • Audit complet de l'existant
  • Infra documentée et décrite en code, redéployable rapidement
  • Des environnements de test pour chaque évolution

« Arthur s'investit à fond dans notre projet. […] Il est très pédagogue et prend le temps d'expliquer ce qu'il a mis en place et pourquoi. Si vous cherchez un expert cloud, kube, devops je vous recommande chaudement Arthur ! »

Hugo Baltz · Ingénieur logiciel, Exxact Robotics
Détails techniques
  • · Audit complet DevOps
  • · Reverse engineering, documentation, IaC modulaire OpenTofu pour redéployer la plateforme rapidement
  • · Cluster multi-AZ pour le jumeau numérique, avec environnements de preview
AWS OpenTofu Kubernetes Environnements de preview

ValueXchange

Salons B2B en ligne · chat, visio et billetterie en temps réel

Résultat

Plusieurs salons en simultané, pics de charge tenus

Aucun dommage à l'image de ValueXchange auprès de ses exposants.

Le problème

Un salon en ligne n'a pas de seconde chance : si la plateforme lâche pendant le pic, tous les exposants le voient. Il fallait tenir plusieurs salons en même temps.

Ce qu'on a fait

  • Tests de charge en conditions réelles, serveurs dimensionnés et montés en puissance automatiquement avant chaque salon
  • Un environnement de répétition isolé avant chaque événement
  • Supervision en temps réel pendant les salons

« Notre plateforme est devenue capable de supporter sans difficulté plusieurs salons en simultané, y compris lors de pics de charge importants, avec un niveau de fiabilité et de performance remarquable. »

Détails techniques
  • · Load testing intensif micro-services avec right-sizing + prescaling automatique
  • · Chart Helm générique : Anti-Affinity, PDB, HPA, VPA
  • · Staging isolé pour répétitions événement
  • · Stack monitoring VictoriaMetrics + VMScrape/VMProbe
  • · Code IaC réduit ÷4
Kubernetes Helm VictoriaMetrics Load testing

Conservatoire Augmenté

Plateforme d'apprentissage musical · vidéo, audio, contenus immersifs

Résultat

Plateforme en production, hébergée en France, coûts maîtrisés

Déploiements automatiques, supervision et haute disponibilité en place.

Le problème

L'hébergement de départ ne tenait pas la charge face aux contenus lourds. Il fallait une infra souveraine qui suive, sans faire exploser le budget.

Ce qu'on a fait

  • Infra sur Scaleway, entièrement décrite en code
  • Déploiements automatiques à chaque nouvelle version
  • Supervision et haute disponibilité

« Sa disponibilité et sa capacité à proposer une architecture à la fois robuste, évolutive et optimisée en termes de coûts ont été déterminantes pour la réussite du projet. »

Détails techniques
  • · IaC Terraform sur Scaleway Kapsule
  • · GitOps ArgoCD + Image Updater
  • · Stack monitoring Grafana + VictoriaMetrics
  • · HA via PDB, HPA, VPA
  • · Secrets et reloads automatisés : External Secrets Operator + Stakater Reloader
Scaleway Kapsule Terraform ArgoCD VictoriaMetrics

Ton contexte ressemble à un de ces cas ?

30 minutes en visio, gratuit. Tu repars avec les 2 ou 3 pistes que je regarderais en premier chez toi.

Diagnostic gratuit — 30 min

Et chez les grands comptes

Les mêmes méthodes, à une autre échelle.

Rakuten France

E-commerce & marketplace · 60+ services

Résultat

60+ services migrés sans coupure, équipe autonome

Une migration qui partait en vrille, remise sur les rails. Code d'infra divisé par 30.

Le problème

La migration vers Kubernetes partait en vrille : une stack surchargée de technos, une équipe qui ne s'y retrouvait plus et commençait à rejeter le projet.

Ce qu'on a fait

  • Grand ménage : on ne garde que ce que l'équipe peut maîtriser
  • Tout refait en binôme avec l'équipe, pour qu'elle reprenne la main
  • Migration progressive sans coupure, 5 sysadmins formés

« Sa pédagogie et son expertise nous ont permis de monter en compétence dans ce domaine. Il a été force de proposition et nous a même challengé sur d'autres scopes de l'infrastructure qui ne faisaient pas partie de sa mission. Si vous cherchez un expert Kubernetes et/ou devops arrêtez-vous ici. »

Détails techniques
  • · Énorme ménage dans la stack : tout ce qui n'était pas 100 % utile et facilement apprenable par l'équipe a dégagé
  • · Une session de pair à chaque intervention : Kubernetes et le GitOps se transmettent en faisant, pas en slides
  • · Refonte de quasiment tout, proprement, en pair programming avec leur nouvelle recrue
  • · Tampon avec le responsable infra pour tempérer les objectifs de la direction et retrouver un rythme tenable
  • · Cluster k0s multi-master HA + Calico CNI
  • · CI/CD Jenkins + Helm charts génériques + SOPS
  • · Migration progressive HAProxy/keepalived zero-downtime
  • · Code infra 300k → 10k lignes, formation Kubernetes de 5 sysadmins
k0s Calico Jenkins Helm SOPS HAProxy

Enedis

Distribution d'électricité · plateforme Kubernetes interne

Résultat

Problèmes de performance et de qualité de service de longue date résolus

Traitement des incidents récurrents automatisé, déploiements débloqués.

Le problème

Trop d'alertes inutiles, des incidents récurrents traités à la main, et une règle interne qui bridait les applications.

Ce qu'on a fait

  • Alertes refondues : moins de bruit, résolution plus rapide
  • Incidents récurrents réparés automatiquement
  • Équipes applicatives formées à la performance et à la résilience

« Il est bon techniquement, orienté utilisateur, avec une capacité importante à être force de proposition. Il a su s'intégrer rapidement à l'équipe et prendre les sujets en autonomie. »

Détails techniques
  • · Refonte de l'alerting et de la réponse à incident (règles, routage, sévérités)
  • · Autoremédiation déclenchée sur alertes Prometheus
  • · Retrait d'un contrôle d'allocation custom qui bloquait les rolling updates et poussait les pods au throttling
  • · Coaching des équipes : onboarding Kubernetes, ateliers Performance et Résilience
  • · Dashboards Grafana de qualité production pour la plateforme et les workloads métiers
  • · Contribution à la V2 de l'offre : architecture, modèle de service, parcours utilisateur
Kubernetes Rancher VictoriaMetrics Grafana Traefik GitLab CI

Réversibilité : ton équipe peut reprendre la main

Tout ce que je construis doit pouvoir être repris sans moi. Former les équipes fait partie du travail, comme chez Rakuten avec 5 sysadmins, ou en école.

Éstiam

École d'informatique · Lyon

Résultat

Des développeurs autonomes sur Docker et Kubernetes

3 mois sur site, sur les situations qu'ils rencontreront en poste.

Le problème

Former des développeurs à déployer et déboguer eux-mêmes leurs applications, sans en faire des administrateurs d'infra.

Ce qu'on a fait

  • Chaque notion mise en pratique immédiatement
  • Les gestes du quotidien : lire une config, déployer, déboguer
  • La même pédagogie que celle utilisée pour former tes équipes en mission
Détails techniques
  • · Module Docker : conteneurs, build d'images, volumes et réseau, Dockerfile, compose multi-services
  • · Module Kubernetes : Pods, Deployments, Services, ConfigMaps, Secrets, Ingress, manifestes YAML, déploiement et debug
  • · Posture orientée développeur : déployer son application, lire un manifeste fourni par l'équipe ops, déboguer un pod qui ne démarre pas
Docker Kubernetes YAML Linux

Tagether : connexion entre l'app et la base de données réparée

« Arthur travaille efficacement, rapidement et est à l'écoute. Un plaisir d'avoir travaillé avec lui. »

Mehdi Berra · Co-Fondateur, Tagether

Diagnostic gratuit

Le prochain cas,
c'est le tien

Diagnostic gratuit — 30 min

30 minutes en visio, gratuit. Et si tu n'as pas besoin de moi, je te le dis.