Gamme officielle 2026 Souveraineté numérique

Le système d'exploitation cognitif
souverain de vos agents IA

Vos agents oublient tout à chaque session, vos outils vivent en silos et vos données partent chez un tiers. GuardMemory installe sous eux une mémoire unique, persistante et gouvernée — vault Markdown PARA+ versionné Git, RAG hybride BM25 + BGE-M3 sous 350 ms, 79 outils MCP natifs (23 modules) et une gouvernance qui bloque mécaniquement les régressions. Sur votre matériel. Sous votre contrôle.

-70% Temps de recherche & de reconstitution de contexte épargné
0 Régression d'architecture tolérée (10 gates mécaniques)
100% Secrets d'affaires & patrimoine conservés on-premise
<0ms
Recherche hybride
BM25 + vecteurs denses, fusionnés par RRF
0
Outils MCP natifs
23 modules · tous vos agents connectés
0
Gates mécaniques
La gouvernance bloque, elle ne conseille pas
0octet
Sortie possible
Mode 100 % local, aucune dépendance cloud
RGPD by design Compatible HDS SecNumCloud Ready Aligné ISO/IEC 27001 AI Act — traçabilité native Hors périmètre CLOUD Act

Lecture honnête : ces mentions qualifient l'architecture du produit (localisation des données, traçabilité, cloisonnement, réversibilité), et non des certificats détenus par l'éditeur. GuardMemory est conçu pour être déployé à l'intérieur d'un périmètre déjà certifié — le vôtre ou celui de votre hébergeur. Le détail claim par claim figure en section Conformité.

La thèse

Un LLM n'est pas un collaborateur tant qu'il n'a pas de mémoire, pas de règles et pas de lieu où la vérité est écrite. GuardMemory ne vend pas une IA de plus : il vend la couche qui manque sous toutes celles que vous utilisez déjà.

Le marché vous propose des assistants. Chacun avec son abonnement, son silo, son historique inaccessible et ses conditions de traitement. GuardMemory inverse la relation : la connaissance de l'entreprise reste chez vous, en fichiers Markdown lisibles à l'œil nu et versionnés Git ; les modèles, eux, deviennent interchangeables — locaux ou cloud, choisis requête par requête par un routeur 3 tiers. Vous pouvez changer de fournisseur d'IA un lundi matin sans perdre une ligne de mémoire.

Ce que GuardMemory n'est pas  ➔  Ce qu'il vous apporte

  • Pas un simple chatbot Un système d'exploitation cognitif qui retient l'intégralité de votre contexte technique.
  • Pas un habillage de Copilot Un moteur RAG hybride multi-modèles avec routage local gratuit et budget maîtrisé.
  • Pas une base propriétaire captive Un coffre ouvert en Markdown & Git : réversibilité immédiate et zéro lock-in.
  • Pas un SaaS sous CLOUD Act Votre sanctuaire physique inviolable hébergé sur votre propre réseau local.
  • Pas une charte théorique ignorée Une gouvernance exécutable (GDEC/GREG) dont les 10 gates bloquent physiquement les dérives.

GuardMemory est une infrastructure de mémoire et de gouvernance. Elle ne concurrence aucun de vos assistants : elle leur donne un endroit où se souvenir, et des règles auxquelles se tenir.

Diagnostic

Quatre frictions coûtent aujourd'hui plus cher que l'IA elle-même

Elles ne se règlent pas en changeant de modèle. Elles se règlent en changeant de socle.

Friction 01

L'amnésie chronique des agents

Claude Code, Cursor, Agy, Codex repartent de zéro à chaque session. Ils oublient les décisions d'architecture, rejouent des bugs déjà corrigés et saturent leur fenêtre de contexte à force de tout relire.

Réponse GuardMemory

Mémoire persistante structurée en memory/<domaine>.md, cycle imposé prep → work → close, mémoire court terme / long terme et rappel ciblé au lieu de relecture intégrale.

Friction 02

La fragmentation CLI / GUI

Un IDE pour coder, un terminal pour opérer, un chat web pour chercher, un wiki pour documenter. Quatre silos, quatre historiques, aucune synchronisation d'état — et personne ne sait où est la version qui fait foi.

Réponse GuardMemory

Un serveur MCP universel de 79 outils natifs (23 modules fonctionnels), en stdio et HTTP, qui raccorde 100 % de vos agents CLI et GUI à la même source de vérité.

Friction 03

La fuite de données et la rente API

Les mémoires SaaS exposent secrets industriels, dossiers patients et pièces d'instruction à des juridictions étrangères — tout en facturant au siège occupé, avec des ruptures de quota au pire moment.

Réponse GuardMemory

Fichiers 100 % locaux, chiffrement au repos, masquage DLP avant tout appel externe, routeur LLM 3 tiers avec exécution NPU/GPU locale et Mode Rat : audit de code nocturne gratuit.

Friction 04

Le chaos Git et les régressions

À plusieurs agents, chacun écrase le travail du précédent, ignore les décisions passées et fabrique des conflits de merge que plus personne ne sait arbitrer. La régression devient le mode de fonctionnement normal.

Réponse GuardMemory

Gouvernance exécutable GDEC / GREG : injection pré-vol des décisions, règles anti-régression et 10 gates mécaniques qui bloquent l'action fautive au lieu de la déplorer après coup.


Architecture

Trois couches découplées.
Une seule vérité.

GuardMemory sépare strictement ce qui sait, ce qui accède et ce qui calcule. C'est ce découplage qui rend l'ensemble portable du Mac mini au cluster DGX — sans réécrire une ligne.

Couche 3 · Agents

Vos agents et vos interfaces, tels quels

Aucun agent à remplacer, aucune migration d'outillage. GuardMemory se branche sous l'existant.

Claude CodeCursorCodex AgyOpenCodeClaude Desktop VS CodeObsidianTerminalDSH Web
Couche 2 · Accès

Serveur MCP universel & gouvernance exécutable

Un contrat unique — stdio ou HTTP — qui expose la mémoire, les tags, le RAG, les tâches et les verrous. Toute écriture passe par les gates : ce qui viole une décision est refusé, pas signalé.

79 outils natifs23 modulesBearer / multi-tenantLocks multi-agent GDEC · décisionsGREG · anti-régressionDLP pré-appel
G1G2G3G4G5 G6G7G8G9G10
Couche 1 · Socle

Vault Markdown PARA+ versionné Git, index local, calcul routé

Aucune base propriétaire. Vos connaissances sont des fichiers texte que vous pouvez lire, diffuser, sauvegarder et emporter — même si GuardMemory disparaît demain. L'index et l'inférence vivent à côté, jamais à la place.

Markdown PARA+Git (bare, signé)SQLite FTS5 Vecteurs BGE-M3Routeur LLM 3 tiersNPU / GPU localCloud optionnel
Réversibilité

Vos données restent lisibles sans GuardMemory. Zéro export à négocier, zéro format captif.

Portabilité

Le même code, du poste solo au cluster en baie. Un palier n'est pas un produit différent.

Auditabilité

Chaque décision, chaque source, chaque écriture est datée et versionnée dans Git.

Spec F-CORE-03 · F-ADV-08

Le flux de recherche hybride, sans fusion silencieuse

Une recherche purement vectorielle rate les identifiants exacts ; une recherche purement lexicale rate le sens. GuardMemory exécute les deux en parallèle puis les réconcilie par Reciprocal Rank Fusion. Et quand deux sources se contredisent, la divergence est exposée — jamais moyennée en douce.

Entrée
Requête agent
Question, symbole, décision, fragment de code
Rail lexical
BM25 · SQLite FTS5
Identifiants, noms de fichiers, références exactes
Rail sémantique
BGE-M3 dense
Intention, reformulations, proximité de sens
Fusion
RRF
Rangs réconciliés, pondération sans réglage manuel
Sortie
Manifest de provenance
Chaque extrait porte son vault d'origine ; divergences signalées
Budget de latence — recherche fédérée bout en bout < 350 ms
Rail lexical FTS5
Rail dense BGE-M3
Fusion RRF + manifest
Marge de garde

Répartition indicative du budget cible ; les valeurs mesurées varient selon le volume du vault et le matériel d'inférence.

Le noyau

Six briques, toutes adossées à une spécification exécutable

Chaque promesse commerciale ci-dessous porte l'identifiant de la spécification qui la teste. Rien n'est du vocabulaire marketing sans contrepartie technique.

F-CORE-01

Vault PARA+ & moteur Git

Stockage en fichiers Markdown ouverts, organisés en PARA+ (Inbox, Projets, Ressources, Zettelkasten, Journal, memory). Commit et historisation automatiques. Aucune base propriétaire, aucune migration à prévoir pour en sortir.

0base propriétaire
100 %lisible sans l'outil
F-CORE-03 · F-ADV-08

RAG hybride & fédéré

BM25 lexical et vecteurs denses BGE-M3 exécutés en parallèle puis fusionnés par RRF. En fédéré, chaque résultat porte son manifest de provenance et toute divergence entre vaults est explicitement remontée.

< 350 mslatence cible
RRFfusion sans réglage
F-CORE-06 · EPIC-3

MCP universel (79 outils · 23 modules)

Un contrat unique stdio / HTTP, compatible Claude Code, Cursor, Agy, Codex, OpenCode, Claude Desktop et Zcode. Mémoire bitemporale, STM, RAG, BDD, consensus multi-agent, tâches et verrous exposés nativement à tous vos agents.

79outils natifs
23modules
EPIC-7 · F-CORE-22

Gouvernance GDEC / GREG

Les décisions d'architecture (GDEC) sont injectées avant l'action ; les règles anti-régression (GREG) sont vérifiées pendant. Dix gates mécaniques transforment la doctrine en contrainte réellement opposable à l'agent.

10gates bloquants
Pré-volinjection décisions
EPIC-4 · F-CORE-09

Routeur 3 tiers & Mode Rat

Chaque requête est routée selon sa complexité : NPU/GPU local d'abord, modèle intermédiaire ensuite, modèle frontière en dernier recours. Suivi des quotas API à 3 niveaux. La nuit, le Mode Rat audite le code sur le matériel local — à coût marginal nul.

3tiers de routage
Nuitaudit local gratuit
EPIC-5 · F-ADV-20

Dashboard DSH & santé continue

Hub d'administration temps réel : état des vaults, quotas, métriques d'usage, graphe de connaissances, Kanban des tâches et exécution continue des 18 health checks système.

18health checks
Temps réelvaults & quotas

La gamme

Un code, quatre paliers de déploiement

Ce n'est pas quatre produits, mais un seul socle logiciel décliné selon votre échelle. On ne change pas d'outil en grandissant : on change d'infrastructure sous le même outil.

Palier 01
Solo / Pro
1 utilisateur
Le poste de travail devient souverain.
Palier 02
MultiUser
3 – 15 utilisateurs
La mémoire devient collective, sans mélanger les privés.
Palier 03
Server · GMS
20 – 100 utilisateurs
L'entreprise dispose de son propre calcul, sous le bureau.
Palier 04
ServerEntreprise · GMSE
250 + utilisateurs
L'IA entre dans le SI : identité, HA, PRA, audit, LoRA métier.
Palier 01

Solo / Pro

MONO-UTILISATEUR
Développeurs indépendants, professions libérales (avocats, médecins, experts-comptables), artisans, consultants.
« Mon second cerveau, mon matériel, mon fournisseur d'IA — et le secret professionnel qui va avec. »
  • Liberté totale du provider : 100 % souverain local (Qwen Coder 14B/32B, DeepSeek-R1 Distill, GLM-5 / GLM-5.3-Flash, Llama 3.3, Mistral) ou cloud au choix (GLM-5.3 API, DeepSeek V3, Claude 3.7, GPT-4o, Mistral Large) via OmniRoute.
  • Vault Markdown & Git privé : dossiers clients en fichiers ouverts, chiffrés au repos, zéro lock-in.
  • 79 outils MCP natifs (23 modules) branchés directement sur VS Code, Cursor, Obsidian, le terminal et Claude Code (modes all ou core).
  • Budget de tokens & DLP : plafonds stricts et masquage automatique des données sensibles avant tout appel externe.
  • Packs métier prêts à l'emploi : démarrage en quelques minutes avec une structure de vault adaptée à votre profession.
Matériel pour le mode 100 % souverain

Mac mini M4 Pro / Mac Studio (64–128 Go unifiés), tour PC RTX 4080/4090, ou laptop workstation RTX Mobile 12–16 Go.

Guide matériel
Palier 02

MultiUser

GMMU · 3 à 15 personnes
Collectifs de développeurs, agences digitales, cabinets d'associés, équipes produit et PME agiles.
« L'intelligence collective en temps réel — sans qu'un seul octet privé ne franchisse la cloison. »
  • Vaults hybrides étanches : un vault privé par membre, des vaults d'équipe partagés, jamais de recouvrement implicite.
  • RAG fédéré isolé (F-ADV-08) : la recherche traverse le vault personnel et ceux de l'équipe — jamais ceux des collègues.
  • Git bare centralisé (Forgejo / GitLab local) : synchronisation asynchrone, fin des conflits de merge à répétition.
  • Sas de promotion anti-secrets : passage Perso ➔ Équipe filtré par Gitleaks, jetons Bearer SHA-256 par membre.
  • Serveur MCP multi-tenant avec verrous coordonnés : plusieurs agents travaillent sans s'écraser.
Infrastructure cible

Serveur Linux existant, VM d'équipe, ou nœud compact type Jetson Orin NX mutualisé (bge-m3 + Qwen 4 Coder / DeepSeek-R1 Distill 14B).

Déployer pour mon équipe
Palier 04

ServerEntreprise

GMSE · 250 + collaborateurs
Grands comptes, GHT et hôpitaux, banques, assurances, ministères, défense, groupes industriels.
« Puissance frontière et gouvernance d'établissement — dans notre datacenter, sous notre annuaire. »
  • Cluster en baie : grappe NVIDIA DGX (A100 / H100 / B200), SAN NVMe-oF, interconnexion InfiniBand ou RoCE.
  • Haute disponibilité & PRA : control plane redondé, data plane GPU distribué, réplication multi-sites.
  • Identité d'entreprise : Active Directory / LDAP, Keycloak, SAML v2, provisioning SCIM, RBAC granulaire.
  • LoRA métier continu : adaptateurs réentraînés chaque semaine sur le corpus interne, sans sortie de données.
  • Compliance Pack : audit trail immuable exporté vers le SIEM (Splunk / Elastic), HSM/KMS, cartographie des flux.
Infrastructure cible

Baie datacenter, cluster distribué TensorRT-LLM / vLLM pour modèles MoE géants (DeepSeek-V3/V4, GLM-5.3, Qwen 4 Max), orchestration K3s/Slurm, support 24/7.

Équipe grands comptes
Palier 01 · démarrage

Packs métier : un vault structuré dès la première ouverture

Le palier Solo / Pro est livré avec des structures de vault, des tags et des rituels pré-configurés par profession. Pas de page blanche : la méthode est déjà là.

Pack Avocat

Dossiers par client et par juridiction, chronologies de procédure, moteur de recherche sur les pièces — et un mode strictement local pour le secret professionnel.

Pack Santé

Séparation nette des données patients et du savoir médical, journalisation des accès, exécution locale : rien ne transite par un fournisseur tiers.

Pack Développeur

Décisions d'architecture, registre des régressions, indexation du code par projet, Mode Rat nocturne et gates Git dès le premier commit.

Pack Conseil & Chiffre

Missions, livrables, veille sectorielle et mémoire de comptes rendus — avec plafonds de tokens et masquage DLP sur les données clients.


Guide d'achat · palier 01

Le matériel est un choix, pas une contrainte

Le logiciel GuardMemory est entièrement découplé du matériel. Ce guide ne concerne que les professionnels qui retiennent le mode 100 % souverain local et veulent faire tourner confortablement les modèles souverains de pointe 2026 — Qwen 4 Coder (14B & 32B) pour le code, DeepSeek-R1 Distill (14B & 32B) pour le raisonnement logique, jusqu'à GLM-5.3 ou DeepSeek-V3 MoE quantifiés sur Mac Studio 128 Go ou station multi-GPU. En mode cloud ou hybride, un ordinateur de bureau standard suffit.

Mac mini · Mac Studio

Silence absolu
  • Machine
    Mac mini M4 Pro, Mac Studio ou Mac Pro
  • Mémoire
    64 à 128 Go de mémoire unifiée
  • Bande p.
    273 à 400 Go/s selon la puce
  • Conso.
    < 80 W en charge d'inférence
Le choix bureau par défaut. La mémoire unifiée Apple Silicon permet d'allouer une très large part de la RAM au modèle : un DeepSeek-R1 Distill 32B/70B, Qwen 2.5/4 72B ou GLM-5 / GLM-5.3-Flash quantifié tourne dans un silence absolu — dans un cabinet, un open space ou un salon.

Tour PC Desktop IA

Débit maximal
  • GPU
    NVIDIA GeForce RTX 4080 (16 Go) ou RTX 4090 (24 Go de VRAM)
  • RAM
    64 Go système
  • Stockage
    SSD NVMe PCIe 4.0 pour l'index vectoriel
  • Accél.
    Tensor Cores dédiés aux embeddings
La vitesse de génération la plus élevée du palier. Débit typiquement supérieur à 50 tokens/seconde sur un modèle de code quantifié : la bonne configuration pour un développeur ou un analyste qui réindexe souvent son corpus.

Laptop Workstation

Mobilité totale
  • GPU
    RTX 4080 / 4090 Mobile (12–16 Go) ou RTX Ada
  • Exemples
    ThinkPad P16, Legion Pro 7, Dell Precision, ASUS ProArt
  • Réseau
    Fonctionnement complet hors connexion
Votre cerveau IA en clientèle. Au tribunal, en visite, sur chantier ou en zone sans réseau : le modèle et l'intégralité du vault sont sur la machine. Aucune donnée client n'est jamais exposée à un réseau public.
Cartographie technologique 2026

Panorama des Meilleurs LLM Locaux Open-Weights & Délestage Hybride

Moteurs : Ollama · llama.cpp · vLLM · MLX (Apple Silicon) · OmniRoute
Famille & Modèle Statut d'Exécution Licence / Poids Spécialité & Cas d'Usage de Prédilection Tailles Clés VRAM / Configuration Recommandée
Qwen Coder & Chat
Alibaba Cloud
● 100 % Local
Ollama / vLLM / MLX
Apache 2.0 / Open-Weights Roi du Code & Agents MCP. Compréhension multi-fichiers, refactoring lourd, génération de tests BDD et exécution autonome d'outils. 7B · 14B · 32B · 72B 16 Go (14B Q4) à 64 Go unifiée (32B/72B) — Mac Studio / RTX 4080/4090
DeepSeek (R1 & V3)
DeepSeek AI
● 100 % Local (Distills)
+ Hybride / Cluster (671B)
MIT / Open-Weights Champion du Raisonnement Pur. Chaîne de pensée (CoT) native, résolution de problèmes logiques complexes, synthèse juridique et audit d'architecture. Distill 14B · 32B · 70B · 671B MoE Distills 14B/32B sur 16–32 Go VRAM. MoE 671B complet sur Appliance DGX Station (160–320 Go).
Mistral AI
Mistral AI (France / UE)
● 100 % Local
+ Cloud souverain (La Plateforme)
Apache 2.0 / Mistral Research Frugalité & Souveraineté Européenne. Français irréprochable, faible empreinte mémoire, vitesse d'inférence très élevée. Codestral 22B excelle en développement. NeMo 12B · Small 24B · Codestral 22B 12 à 24 Go VRAM — Tour PC RTX 4080 ou Laptop Workstation Mobile
Meta Llama (3.3 & 3.1)
Meta
● 100 % Local
Ollama / vLLM / MLX
Llama 3.3 Community License Le Standard de l'Industrie. Llama 3.3 70B offre les performances de l'ancien 405B dans une empreinte réduite. Très polyvalent pour le RAG généraliste et l'analyse de documents. 8B · 70B 8B sur laptop/NPU (8 Go). 70B quantifié sur Mac Studio 64/128 Go ou multi-GPU RTX (48 Go VRAM).
GLM Series (Zhipu / Z.ai)
Tsinghua / Zhipu AI
● 100 % Local (GLM-5 / 5.2 / Flash)
● Hybride API-first (GLM-5.3 Flagship)
MIT (GLM-5/5.2/Flash) · API Z.ai Multimodalité Rapide & Contexte Massif. GLM-5.3-Flash & GLM-5/5.2 tournent 100 % en local sous licence libre MIT. Le flagship GLM-5.3 est accessible en délestage sécurisé OmniRoute. GLM-4-9B · GLM-5.3-Flash · GLM-5.3 (API) GLM-5.3-Flash & 9B dès 12–16 Go VRAM. GLM-5.3 Flagship via passerelle API chiffrée.
Grands Modèles Propriétaires
Anthropic · OpenAI · Google
○ Débrayage Cloud Uniquement
Orchestré via OmniRoute
Propriétaire (SaaS API) Délestage Ponctuel Haute Intensité. Pour les synthèses nécessitant des contextes colossaux (jusqu'à 1M de tokens) ou des benchmarks extrêmes, sans jamais sacrifier le vault local. Claude 3.7 Sonnet · GPT-4o · Gemini 1.5 Pro Zéro VRAM locale requise. Appels chiffrés point-à-point avec masquage de données sensibles.
Le Statut Exact de GLM-5.3 & des Modèles Open-Source Zhipu AI a publié GLM-5, GLM-5.2 et GLM-5.3-Flash sous licence open-source MIT (poids téléchargeables sur Hugging Face pour une exécution 100 % locale hors-ligne). Le modèle flagship GLM-5.3 est quant à lui lancé en API-first (Z.ai), ses poids complets étant en cours d'audit de sécurité. GuardMemory offre le meilleur des deux mondes : inférence 100 % locale avec GLM-5/Flash, DeepSeek et Qwen, ou délestage transparent vers GLM-5.3 via OmniRoute.
La Règle d'Or GuardMemory : Souveraineté & Zéro Remplacement Aucun modèle n'est imposé ni exclu. Vous conservez vos abonnements ou accès existants (OpenAI, Anthropic, Mistral) tout en déployant les modèles open-weights les plus puissants du marché (DeepSeek-R1, Qwen-Coder, Llama 3.3). L'orchestrateur local OmniRoute route chaque invite vers le bon modèle selon vos critères : confidentialité stricte (local forcé), vitesse ou coût.
Palier 03 · rupture pour la PME

Le datacenter tient sous un bureau

Pas de salle blanche climatisée. Pas d'ingénieur MLOps à recruter. Pas de projet à dix-huit mois. GuardMemory Server transforme la NVIDIA DGX Station de bureau en appliance d'entreprise pré-packagée : OS durci, vLLM multi-modèles, OmniRoute, Git interne et DSHGM Web. Vous branchez la prise et le câble réseau — l'entreprise dispose de son propre calcul d'inférence souverain.

Niveau sonore< 37 dB
AlimentationPrise 220 V
VRAM unifiée160 – 320 Go
Utilisateurs servis50 – 100

Mise en service

  1. Poser l'appliance sous un bureau classique — aucun aménagement de local.
  2. Brancher la prise 220 V et le câble réseau RJ45.
  3. Les équipes se connectent sur https://ia.votre-entreprise.local.
  4. La première nuit, l'auto-digest indexe les partages NAS / SMB existants.
🛡️ Support J+1 sur site Garantie constructeur NVIDIA Entreprise 3 à 5 ans avec pièces et main-d'œuvre.
⚡ Zéro MLOps OS durci pré-packagé, conteneurs vLLM orchestrés et infogérance partenaire disponible.
💼 Financement flexible Disponible à l'achat amortissable (Capex) ou en leasing mensuel dès ~1 200 € HT.
Analyse financière

Abonnement perpétuel ou actif d'entreprise ?

La question posée au comité de direction n'est pas « quelle IA est la meilleure », mais « que possédons-nous au bout de trois ans ? »

Assistant SaaS américain

Copilot / Cursor Business — par siège, par mois
64 800 €Dépense cumulée sur 36 mois
  • Charge récurrente : la dépense recommence chaque mois et croît avec l'effectif. Aucun actif au bilan à l'issue.
  • Exposition juridique : les traitements s'exécutent hors de votre périmètre, sous l'empire du CLOUD Act.
  • Traçabilité limitée : peu ou pas de manifest de provenance, arbitrage des contradictions invisible.
  • Dépendance réseau : une coupure d'accès suspend la productivité de toute l'entreprise.
  • Réversibilité faible : l'historique de vos échanges et de votre contexte reste chez l'éditeur.

GuardMemory Server (GMS)

Appliance DGX Station + licence logicielle
0 €Coût par token cloud, en mode 100 % local
  • Investissement amortissable : le matériel est un actif immobilisé, la dépense s'arrête, la capacité reste.
  • Étanchéité physique : aucun octet ne quitte le bâtiment ; RGPD et secret des affaires respectés par construction.
  • Latence LAN : réponses en réseau local, sans aller-retour internet ni file d'attente fournisseur.
  • Patrimoine indexé : quinze ans d'archives NAS deviennent interrogeables — un actif qui n'existait pas avant.
  • Réversibilité totale : le vault reste en Markdown Git, lisible et exportable sans l'outil.
Hypothèses de calcul & Seuil d'amortissement — à vérifier sur votre cas

Colonne SaaS : 60 collaborateurs × 30 € HT / mois / siège × 36 mois = 64 800 € HT à fonds perdus, hors dépassement de quotas de tokens, hors administration, hors intégration et hors hausses tarifaires annuelles.
Colonne GMS : L'investissement dans une Appliance DGX Station (ou sa location financière dès ~1 200 € HT / mois) couplée à la licence logicielle GuardMemory constitue un actif d'entreprise immobilisé et amortissable. Le point de bascule économique s'établit typiquement entre le 14ᵉ et le 18ᵉ mois : au-delà, le coût marginal par requête est de 0 €, les plafonds de tokens sont totalement levés pour l'ensemble des collaborateurs, et la valeur immatérielle de votre patrimoine indexé reste votre entière propriété. Un chiffrage nominatif détaillé avec simulation ROI est établi lors de l'étude de cadrage.


Trajectoire d'adoption

Grandir d'un palier ne doit jamais être un projet de migration

C'est là que la plupart des architectures cassent : on repart de zéro à chaque changement d'échelle. GuardMemory conserve le même schéma de données, le même contrat MCP et le même format de vault du poste solo au cluster. Voici les deux transitions sensibles, et ce qui les rend praticables.

Conséquence pour un comité d'investissement : le palier d'entrée n'engage pas la cible. Vous pouvez démarrer en Solo/Pro sur une poignée de postes et arbitrer le passage en GMS ou GMSE une fois l'usage démontré — sans avoir à réécrire ni à réimporter le patrimoine constitué entre-temps.

Palier 02 · MultiUser ➔ Palier 03 · Server GMS

Le risque : migrer les dépôts Git de l'équipe et réindexer intégralement les vaults historiques — l'étape où beaucoup de projets s'arrêtent faute de fenêtre d'interruption acceptable.

La réponse : procédure automatisée guardmemory-migrate-vault. L'appliance importe les dépôts bare existants tels quels et reconstruit les bases vectorielles rag.db sur ses Tensor Cores, en quelques minutes.

Palier 03 · Server GMS ➔ Palier 04 · ServerEntreprise

Le risque : passer d'une machine unique à un cluster distribué — haute disponibilité, réplication des bases, provisioning d'identités SCIM, exigences d'audit.

La réponse : l'API MCP et le schéma SQLite WAL sont strictement identiques d'un palier à l'autre. Le palier 4 ajoute une orchestration K3s / Helm pré-packagée : c'est un changement d'infrastructure, pas de produit.

À tout moment · sortie du produit

Le risque : le verrouillage fournisseur — l'argument qui bloque le plus de dossiers en commission d'achat.

La réponse : il n'y a rien à exporter. Le vault est un dépôt Git de fichiers Markdown. Vous en disposez déjà, en clair, à chaque instant, avec tout son historique.
Comparatif

Matrice technique des quatre paliers

Le même noyau logiciel, quatre profils de déploiement.

Comparatif fonctionnel des quatre paliers GuardMemory
Caractéristique 01 · Solo / Pro 02 · MultiUser 03 · Server GMS 04 · ServerEntreprise
Profil cible Indépendant, profession libérale, artisan Équipes et agences, 3 à 15 personnes PME 20 à 100 salariés, sans MLOps Grands comptes, GHT, banques — 250 +
Emplacement du calcul Mac mini/Studio, tour RTX ou laptop RTX Serveur Linux existant, VM ou Jetson Orin NX Sous le bureau — DGX Station 220 V Baie datacenter — SAN NVMe-oF, InfiniBand
Choix du provider LLM Totalement libre : local (Qwen 4 Coder 14B/32B, DeepSeek-R1 Distill) ou cloud (DeepSeek, GLM-5.3, Claude, GPT) Mutualisé via OmniRoute : bge-m3 + Qwen 4 / DeepSeek-R1 14B 100 % local vLLM : bge-m3 (:8010) + Qwen 4 Coder 32B (:8001) + DeepSeek-R1 / GLM-5.3 (:8002) Cluster distribué : MoE géants (DeepSeek-V3/V4, GLM-5.3, Qwen 4 Max), TensorRT-LLM
Interface d'accès Cursor, VS Code, Obsidian, CLI, Claude Code Éditeurs connectés + interface DSHGM DSHGM Web — navigateur, sans client lourd Portail d'entreprise unifié avec SSO
Cloisonnement des données Vault individuel chiffré au repos RAG fédéré isolé (F-ADV-08) + manifest de provenance Bases vectorielles étanches par vault, RBAC serveur Multi-tenancy strict, DLP, HSM / KMS
Ingestion du patrimoine Manuelle, glisser-déposer, capture CLI Synchronisation Git d'équipe Auto-digest nocturne NAS / SMB Connecteurs SI continus (SharePoint, ERP, bases métier)
Identité & authentification Compte local du système d'exploitation Jetons Bearer SHA-256 par membre RBAC serveur intégré Active Directory / Keycloak / SAML v2 / SCIM
Gouvernance & conformité GDEC / GREG + Gitleaks local Sas de promotion anti-secrets, verrous coordonnés 18 health checks continus, journal d'appliance Audit trail immuable exporté SIEM (Splunk / Elastic)
Disponibilité Poste unique Nœud unique, sauvegarde Git Appliance unique + sauvegarde interne HA multi-nœuds, PRA multi-sites, 24/7
Spécialisation métier Packs métier pré-configurés Vaults d'équipe thématiques Corpus d'entreprise indexé en continu Fine-tuning LoRA hebdomadaire sur corpus interne

Le noyau — vault Markdown PARA+, RAG hybride, 79 outils MCP natifs (23 modules), gouvernance GDEC/GREG — est identique sur les quatre paliers. Seuls l'échelle, l'isolation et l'intégration au SI varient.


Souveraineté & conformité

Ce que nous affirmons, et ce que nous n'affirmons pas

Un dossier de conformité se gagne sur la précision, pas sur les logos. Voici la lecture exacte, claim par claim, de chaque mention portée sur ce document.

RGPD

Par conception

Minimisation native : les données ne quittent pas le périmètre choisi. Localisation, durée de conservation et droit à l'effacement sont pilotés par vous, sur votre stockage. Aucun sous-traitant imposé en mode local.

HDS — données de santé

Architecture compatible

GuardMemory se déploie à l'intérieur d'un périmètre HDS existant — le vôtre ou celui de votre hébergeur certifié. Le produit n'est pas lui-même un hébergeur : il n'introduit aucun flux sortant en mode local.

SecNumCloud

Ready — non certifié

L'architecture est conçue pour un déploiement en environnement qualifié SecNumCloud (on-premise ou cloud de confiance). Nous ne revendiquons aucune qualification ANSSI détenue en propre : la qualification porte sur l'hébergeur.

ISO/IEC 27001

Aligné sur les mesures

Journalisation, gestion des accès, séparation des environnements, traçabilité des changements par Git signé : les mesures techniques attendues sont outillées. La certification, elle, s'obtient au niveau de votre SMSI.

AI Act

Traçabilité native

Chaque réponse porte son manifest de provenance ; chaque décision et chaque règle sont versionnées et datées. Les obligations de documentation et de journalisation trouvent une matière factuelle, non reconstituée après coup.

CLOUD Act

Hors périmètre en mode local

En mode 100 % local, aucune donnée n'est confiée à un fournisseur soumis à une juridiction extraterritoriale : il n'y a rien à réquisitionner ailleurs que chez vous. En mode hybride, le DLP masque avant tout appel externe.

Comité d'achat

Les six objections qu'on nous oppose

01 Nous avons déjà Microsoft 365 Copilot. Pourquoi ajouter une couche ?
Parce que GuardMemory ne remplace pas un assistant : il lui donne une mémoire et des règles. Copilot reste excellent pour rédiger dans Office ; il ne conserve ni vos décisions d'architecture, ni l'historique de vos arbitrages, et ne peut pas garantir qu'un contenu sensible n'a pas quitté votre périmètre. GuardMemory s'installe sous vos agents, quels qu'ils soient, et reste utile le jour où vous en changez.
02 Nous n'avons pas d'équipe capable d'exploiter des GPU.
C'est précisément l'objet du palier 03. L'appliance GMS arrive pré-packagée : OS durci, vLLM, routage, Git interne et interface web. L'exploitation courante se résume à une page d'administration et aux 18 health checks qui tournent en continu. Aucun profil MLOps n'est requis pour l'usage nominal.
03 Que se passe-t-il si votre société disparaît ?
Vos données restent intégralement exploitables : ce sont des fichiers Markdown dans un dépôt Git, avec tout leur historique. Vous les ouvrez dans n'importe quel éditeur de texte, Obsidian ou VS Code, sans aucun outil GuardMemory. C'est la différence structurelle avec une base propriétaire — il n'y a pas d'export à négocier.
04 Un modèle local est-il vraiment au niveau des modèles cloud ?
Pas sur toutes les tâches, et nous ne le prétendons pas. C'est la raison d'être du routeur 3 tiers : les tâches courantes — recherche, extraction, résumé, indexation, audit nocturne — sont traitées en local, où le rapport coût/latence est imbattable ; les raisonnements les plus exigeants peuvent être escaladés vers un modèle frontière, après masquage DLP, si et seulement si votre politique l'autorise.
05 Comment évitez-vous que les agents se marchent dessus ?
Par des verrous coordonnés et une gouvernance opposable. Toute écriture passe par le serveur MCP, qui pose un verrou de domaine et applique les 10 gates : décisions injectées avant l'action (GDEC), règles anti-régression vérifiées pendant (GREG), et sas de promotion filtré par Gitleaks avant tout partage. Une violation n'est pas signalée après coup : elle est refusée.
06 Combien de temps avant un premier résultat mesurable ?
Le pilote de 30 jours est conçu pour cela : un périmètre restreint, un corpus réel, des critères d'acceptation écrits à l'avance. À l'issue, vous disposez d'une mesure — latence de recherche observée, volume de patrimoine indexé, régressions bloquées, part des requêtes traitées en local — et non d'une impression.
Prochaine étape

Un pilote de 30 jours, sur votre corpus réel

Pas de démonstration sur des données de synthèse. Nous cadrons un périmètre restreint, nous indexons votre patrimoine existant et nous mesurons — avec des critères d'acceptation écrits avant de commencer.

Semaine 1

Cadrage : périmètre, corpus, contraintes de conformité, critères d'acceptation formalisés.

Semaines 2 – 3

Déploiement du palier retenu, indexation du patrimoine, raccordement des agents existants.

Semaine 4

Mesure contradictoire, restitution chiffrée et décision : généraliser, ajuster le palier, ou s'arrêter.