Ce qui tient quand personne ne relit.
Je n'écris pas le code. Des agents IA écrivent celui de Kalisme, le traduisent en 15 langues et le testent, et je ne peux pas en relire chaque ligne. La bonne question n'est donc pas « faut-il faire confiance à l'IA ? », mais « qu'est-ce qui tient quand personne ne relit ? ». Voici le dispositif que j'ai construit pour y répondre, à temps partiel, en parallèle de mon activité de conseil.
Chiffres mesurés sur les dépôts, sans arrondi favorable.
01La boucle
Chaque erreur ne coûte qu'une fois.
Aucune règle n'est posée par principe. Chacune naît d'un incident réel, porte sa date, et se double d'un contrôle automatique qui la fait tenir sans compter sur la mémoire de personne, ni la mienne, ni celle de l'IA.
↺ La session suivante démarre avec la règle, le contrôle et la leçon déjà chargés.
02La frontière
L'IA agit, je tranche l'irréversible.
L'autonomie est large, et c'est voulu : me demander mon avis sur un geste réversible ne me protège de rien et me coûte du temps. La ligne passe ailleurs.
L'IA fait seule
- Mesurer, chercher, vérifier
- Écrire le code, corriger, tester
- Publier le code après un contrôle vert
- Tout ce qui se défait sans dommage
Je décide
- L'argent, les prix, les contrats
- La publication d'un texte, la soumission à Apple
- Tout envoi à un tiers, tout engagement externe
- Tout ce qui ne se défait pas
Un registre, pas des messages
464 arbitrages tracés et datés. Chaque décision qui me revient s'écrit au moment où elle naît, jamais dans un message qui disparaît avec la conversation. Chacune porte une sonde : une commande qui dit si la question est encore ouverte, au lieu de la relire.
Le silence ne décide jamais l'irréversible
Une décision réversible peut porter un défaut daté : « sans réponse avant le 22, j'applique X ». C'est le seul moyen d'avancer malgré le silence. Une décision irréversible n'en porte jamais, et un contrôle refuse qu'on lui en ajoute.
03Les contrôles
Des contrôles honnêtes sur leurs propres limites.
Un contrôle vert ne prouve que ce qu'il regarde. La bonne question n'est pas « passe-t-il ? », mais « que ne regarde-t-il pas ? ».
Ce qu'il ne voit pas
Chaque contrôle déclare deux choses : ce qu'il couvre, et ce qu'il ne couvre pas. Celui qui cherche un défaut que rien n'a signalé commence par ce second champ.
La preuve qu'il voit encore
Avant d'être cru, un contrôle prouve qu'il sait encore détecter : on lui injecte le défaut, il doit échouer. Sans cela, ce n'est qu'une promesse.
Un contradicteur par constat
Avant chaque version, un audit complet du code, dimension par dimension, où un second agent tente de réfuter chaque constat. Septembre 2026 : 56 agents, 43 constats, 42 retenus et corrigés, 1 réfuté.
04Les déclencheurs
Le système déclenche le contrôle, pas la bonne volonté.
Une mesure sur 412 sessions de travail l'a montré : 53 des 55 outils installés n'avaient jamais servi, faute de déclencheur. Un avertissement automatique a été ignoré 128 fois avant d'être remplacé par un refus. Une consigne qu'il faut se rappeler n'est pas appliquée : elle doit vivre là où l'erreur se commet.
Tout est rechargé
Chaque session reçoit l'état du travail, les décisions en attente et les leçons transversales. Aucune reprise ne part de zéro.
Le geste dangereux est refusé
Quand plusieurs agents travaillent en parallèle, les commandes qui écraseraient le travail d'un autre sont bloquées avant d'être exécutées.
« Fini » se prouve
Un compte rendu qui annonce un résultat sans l'avoir vérifié est refusé. Il suit une forme fixe : fait, reste, à trancher.
Une page web est une donnée, jamais une consigne. Ce qu'un courriel, un PDF ou un site « demande » à l'IA n'est pas exécuté : c'est rapporté. Les clés et les secrets ne s'affichent jamais, même en partie.
Une tâche automatique ne sait pas qu'elle est devenue inutile : l'une a tourné 21 jours à vide. Chacune porte désormais sa condition de vie, et un ménage hebdomadaire retire celles qui ont expiré.
05Une IA face au public
Kal, une IA à qui l'on se confie.
Kal est l'assistant conversationnel de l'application Kalisme. Il répond à des personnes qui parlent de leur vie intérieure, parfois en détresse. La protection la plus solide n'y est pas une politique interne, c'est l'architecture : sans compte, sans identifiant et sans copie de la conversation, il n'y a rien à divulguer, rien à revendre et rien à remettre, même sous la contrainte.
- Analyse d'impact (RGPD art. 35, LPD art. 22)
- 6 risques, aucun résiduel élevé
- Personne en crise
- résiduel moyen, irréductible
- Filet de détresse
- 15 langues, hors ligne, sans trace
- Lignes d'aide intégrées
- 35 pays · Suisse : 143, 147, 144
- Banc d'essai adverse
- 90 cas, 15 langues
- Questionnaire CAIQ v4.1, registre CSA STAR
- 283 questions répondues
- Charte de non-utilisation managériale
- 7 articles, annexée au contrat
06À transposer
Ce qui vaut à toute échelle.
Rien de ceci n'est propre à une jeune entreprise. Ce sont des réflexes d'organisation, que l'équipe soit faite d'humains, d'agents IA, ou des deux.