Agent e-commerce · boutique Shopify
Agent IA autonome pour une boutique e-commerce
ACTIF 24/7 · crons depuis 05/2026
Contexte
Une boutique Shopify française d'environ 96 produits actifs répartis sur 19 collections, portée par un fondateur non-développeur. Une première phase d'automatisation — toolkit Node.js sans dépendance npm, API Admin GraphQL, génération de contenu par IA — avait déjà assaini le catalogue : 369 mutations appliquées sans erreur, problèmes critiques ramenés de 169 à 1, score SEO interne passé de 6,8 à 10/10, emailing migré de Klaviyo vers Shopify Email.
Problème
L'outillage livré exigeait quelqu'un pour le lancer, lire les rapports et valider les actions. Trois options après la fin de la mission : un freelance (coût non maîtrisé), un SaaS (abonnement, dépendance), ou un agent qui surveille la boutique, propose des actions chaque semaine et apprend de ses résultats. La troisième a été retenue.
Approche
Avant toute implémentation, le périmètre a été arrêté par écrit dans une charte de mission relue et amendée par le dirigeant : sources surveillées, rythme des livrables, trois niveaux d'autonomie, règles non négociables. L'agent lui-même a été construit avec Claude Code et repose sur une architecture à skills et une mémoire sémantique locale — la robustesse vient de cette architecture autant que de la maîtrise des outils IA de pointe qui l'animent. Un mode « mega-prompt », testé en premier, a produit de faux résultats et a été rejeté au profit de cette approche outillée. Le système reste indépendant d'un fournisseur LLM donné : lors du test de recette final, un rate-limit a été contourné en basculant de fournisseur en 5 minutes, sans redémarrage.
Ce qui a été livré
- 21 skills en production chez le client — audit KPI, monitoring, génération SEO et contenu, mutations Shopify avec snapshot et rollback, emailing, reporting — dont 4 auto-créés par l'agent sur détection de patterns récurrents, validés par revue humaine avant activation ; 25 skills dans le framework open source.
- 4 crons (fuseau Europe/Paris) : rapport de performance chaque lundi 9 h, propositions créatives chaque samedi 10 h, méta-revue d'auto-amélioration chaque dimanche 20 h, watchdog de conversion toutes les 6 heures sans appel LLM.
- Mémoire sémantique locale : embeddings calculés sur le VPS (modèle local de 36 Mo, base SQLite) — aucune donnée envoyée à un cloud d'embeddings.
- Hébergement : VPS Ubuntu 24.04 LTS (OVH, France), SSH par clé uniquement, pare-feu UFW, services systemd. Coût récurrent complet : moins de 10 € par mois.
Stack
- Python
- Node.js
- Bash
- Shopify Admin GraphQL
- Klaviyo
- Telegram
- VPS Ubuntu 24.04 (OVH)
- systemd/cron
- SQLite (mémoire sémantique locale)
- LLM interchangeable (API OpenAI-compatible)
Résultats observés
14/05/2026 — test de recette final de bout en bout : 9/9 critères validés, 0 hallucination, 0 mutation persistante, 11/11 emails confirmés par preuve technique, 5/5 tests adversariaux réussis — dont le refus d'une instruction déguisée lui demandant d'ignorer ses propres règles.
test de recette daté · 14/05/2026
18/05/2026 — premier rapport de performance hebdomadaire réel envoyé au client.
livrable client daté · 18/05/2026
27/05/2026 — 88 exécutions de crons cumulées sans erreur depuis la mise en service ; mise à jour groupée de 62 produits en un seul run ; environ 1,08 M de tokens consommés sur 7 jours pour environ 6 h de temps actif.
suivi d'exécution daté · vérifié 02/07/2026
Ce qui reste humain
Trois niveaux de garde-fous, inscrits dans des règles immuables : l'agent agit seul uniquement sur les corrections sans risque (alt-texts, tags, meta-titles vides) ; il propose et attend une validation Telegram pour les descriptions, les prix (moins de 5 %) et les brouillons de publication ; il n'agit jamais seul sur les prix au-delà de 5 %, les suppressions, le thème ou les paiements. Chaque publication sur les réseaux sociaux exige une approbation explicite du commerçant.