Un fondateur ou une petite équipe tech, et personne dont c'est le métier de s'occuper de l'infra.
Gam'in
Startup edtech · fondateur développeur, pas d'équipe infra
Résultat
Son infra suit sa croissance, et il déploie seul
Il pousse son code, une préproduction se crée, la production suit. Sans ops, et sans avoir appris Kubernetes.
Le problème
Tout tournait sur un seul serveur configuré à la main : s'il tombait, tout tombait, et impossible d'essayer une modification avant la mise en production. Avec une centaine de nouveaux clients par semaine.
Ce qu'on a fait
Infra reconstruite sur OVHcloud, entièrement décrite en code et reproductible
Une préproduction créée automatiquement à chaque modification
Base de données redondante, restaurable à la minute près, supervision et sauvegardes
« J'ai eu l'occasion de faire appel à Arthur pour l'infra de Gam'in avant la mise en production. Rigueur, efficacité et sur le plan humain Arthur est une personne qui mérite le détour. Je recommande les yeux fermés. Merci »
Détails techniques
· Socle Kubernetes managé sur OVHcloud, entièrement décrit en OpenTofu (cluster, bases managées, stockage objet, DNS, load balancer)
· GitOps ArgoCD : un environnement de prévisualisation créé automatiquement à chaque pull request
· Les deux applications rendues stateless, fichiers externalisés vers le stockage objet
· PostgreSQL en haute disponibilité avec restauration à la minute près, secrets en coffre-fort, SSO devant les interfaces d'administration
· Supervision, journaux, sauvegardes du cluster, HTTPS et DNS automatiques
· Puis, dans un second temps, le site public et son CDN d'assets
-69 % sur la facture AWS, prod stable au lancement
Plus de redémarrages intempestifs, et une alerte avant que ça casse.
Le problème
À quelques semaines du lancement, l'infra plantait régulièrement, personne ne voyait ce qui se passait dedans, et les serveurs étaient surdimensionnés.
Ce qu'on a fait
Infra stabilisée avant le lancement
Supervision et alertes mises en place
Serveurs dimensionnés sur la consommation réelle et ajustés automatiquement à la charge
« Un énorme merci ! :) »
Détails techniques
· Résolution des problèmes de stabilité du cluster EKS
· Monitoring et alerting : stack VictoriaMetrics + Grafana
· ACM + ALB pour certificats wildcard automatiques
· Sizing pods et storage basé sur les métriques réelles
· Autoscaling : Karpenter, HPA, VPA
AWS EKSKarpenterHelmVictoriaMetricsGrafana
Monnier Paris
E-commerce mode & luxe · plateforme sur Heroku
Résultat
-72 % sur la facture cloud
Après un audit des coûts et une migration de Heroku vers AWS.
Le problème
Heroku facture la puissance de calcul au prix fort, et rien n'était dimensionné sur la consommation réelle de la boutique.
Ce qu'on a fait
Audit des coûts, poste par poste
Migration de Heroku vers AWS
Serveurs dimensionnés sur la consommation réelle, déploiements automatisés
« Merci Arthur pour ta disponibilité sur cette migration ! »
Détails techniques
· Audit des coûts, puis migration de Heroku vers AWS Elastic Beanstalk
· Right-sizing basé métriques
· Migration de la stack de logs
· Pipeline GitLab CI avec S3 + AWS CLI
Heroku → AWSElastic BeanstalkGitLab CIS3
Exxact Robotics
Robotique agricole · infra héritée d'un ancien prestataire
Résultat
Commercialisation débloquée
+100 k€ de budget débloqués par le groupe suite aux audits.
Le problème
L'ancien prestataire était parti : il ne restait qu'un compte AWS, et personne ne savait comment l'infra fonctionnait. Impossible de vendre le produit dans cet état.
Ce qu'on a fait
Audit complet de l'existant
Infra documentée et décrite en code, redéployable rapidement
Des environnements de test pour chaque évolution
« Arthur s'investit à fond dans notre projet. […] Il est très pédagogue et prend le temps d'expliquer ce qu'il a mis en place et pourquoi. Si vous cherchez un expert cloud, kube, devops je vous recommande chaudement Arthur ! »
Détails techniques
· Audit complet DevOps
· Reverse engineering, documentation, IaC modulaire OpenTofu pour redéployer la plateforme rapidement
· Cluster multi-AZ pour le jumeau numérique, avec environnements de preview
AWSOpenTofuKubernetesEnvironnements de preview
ValueXchange
Salons B2B en ligne · chat, visio et billetterie en temps réel
Résultat
Plusieurs salons en simultané, pics de charge tenus
Aucun dommage à l'image de ValueXchange auprès de ses exposants.
Le problème
Un salon en ligne n'a pas de seconde chance : si la plateforme lâche pendant le pic, tous les exposants le voient. Il fallait tenir plusieurs salons en même temps.
Ce qu'on a fait
Tests de charge en conditions réelles, serveurs dimensionnés et montés en puissance automatiquement avant chaque salon
Un environnement de répétition isolé avant chaque événement
Supervision en temps réel pendant les salons
« Notre plateforme est devenue capable de supporter sans difficulté plusieurs salons en simultané, y compris lors de pics de charge importants, avec un niveau de fiabilité et de performance remarquable. »
Détails techniques
· Load testing intensif micro-services avec right-sizing + prescaling automatique
Plateforme en production, hébergée en France, coûts maîtrisés
Déploiements automatiques, supervision et haute disponibilité en place.
Le problème
L'hébergement de départ ne tenait pas la charge face aux contenus lourds. Il fallait une infra souveraine qui suive, sans faire exploser le budget.
Ce qu'on a fait
Infra sur Scaleway, entièrement décrite en code
Déploiements automatiques à chaque nouvelle version
Supervision et haute disponibilité
« Sa disponibilité et sa capacité à proposer une architecture à la fois robuste, évolutive et optimisée en termes de coûts ont été déterminantes pour la réussite du projet. »
Une migration qui partait en vrille, remise sur les rails. Code d'infra divisé par 30.
Le problème
La migration vers Kubernetes partait en vrille : une stack surchargée de technos, une équipe qui ne s'y retrouvait plus et commençait à rejeter le projet.
Ce qu'on a fait
Grand ménage : on ne garde que ce que l'équipe peut maîtriser
Tout refait en binôme avec l'équipe, pour qu'elle reprenne la main
Migration progressive sans coupure, 5 sysadmins formés
« Sa pédagogie et son expertise nous ont permis de monter en compétence dans ce domaine. Il a été force de proposition et nous a même challengé sur d'autres scopes de l'infrastructure qui ne faisaient pas partie de sa mission. Si vous cherchez un expert Kubernetes et/ou devops arrêtez-vous ici. »
Détails techniques
· Énorme ménage dans la stack : tout ce qui n'était pas 100 % utile et facilement apprenable par l'équipe a dégagé
· Une session de pair à chaque intervention : Kubernetes et le GitOps se transmettent en faisant, pas en slides
· Refonte de quasiment tout, proprement, en pair programming avec leur nouvelle recrue
· Tampon avec le responsable infra pour tempérer les objectifs de la direction et retrouver un rythme tenable
· Code infra 300k → 10k lignes, formation Kubernetes de 5 sysadmins
k0sCalicoJenkinsHelmSOPSHAProxy
Enedis
Distribution d'électricité · plateforme Kubernetes interne
Résultat
Problèmes de performance et de qualité de service de longue date résolus
Traitement des incidents récurrents automatisé, déploiements débloqués.
Le problème
Trop d'alertes inutiles, des incidents récurrents traités à la main, et une règle interne qui bridait les applications.
Ce qu'on a fait
Alertes refondues : moins de bruit, résolution plus rapide
Incidents récurrents réparés automatiquement
Équipes applicatives formées à la performance et à la résilience
« Il est bon techniquement, orienté utilisateur, avec une capacité importante à être force de proposition. Il a su s'intégrer rapidement à l'équipe et prendre les sujets en autonomie. »
Détails techniques
· Refonte de l'alerting et de la réponse à incident (règles, routage, sévérités)
· Autoremédiation déclenchée sur alertes Prometheus
· Retrait d'un contrôle d'allocation custom qui bloquait les rolling updates et poussait les pods au throttling
· Coaching des équipes : onboarding Kubernetes, ateliers Performance et Résilience
· Dashboards Grafana de qualité production pour la plateforme et les workloads métiers
· Contribution à la V2 de l'offre : architecture, modèle de service, parcours utilisateur
KubernetesRancherVictoriaMetricsGrafanaTraefikGitLab CI
Réversibilité : ton équipe peut reprendre la main
Tout ce que je construis doit pouvoir être repris sans moi. Former les équipes fait partie du travail, comme chez Rakuten avec 5 sysadmins, ou en école.
Éstiam
École d'informatique · Lyon
Résultat
Des développeurs autonomes sur Docker et Kubernetes
3 mois sur site, sur les situations qu'ils rencontreront en poste.
Le problème
Former des développeurs à déployer et déboguer eux-mêmes leurs applications, sans en faire des administrateurs d'infra.
Ce qu'on a fait
Chaque notion mise en pratique immédiatement
Les gestes du quotidien : lire une config, déployer, déboguer
La même pédagogie que celle utilisée pour former tes équipes en mission