Ce qui tient quand personne ne relit.

Je n'écris pas le code. Des agents IA écrivent celui de Kalisme, le traduisent en 15 langues et le testent, et je ne peux pas en relire chaque ligne. La bonne question n'est donc pas « faut-il faire confiance à l'IA ? », mais « qu'est-ce qui tient quand personne ne relit ? ». Voici le dispositif que j'ai construit pour y répondre, à temps partiel, en parallèle de mon activité de conseil.

193jours, de mars à octobre 2026
7 505commits sur 10 dépôts
15langues, du code à la vente
90contrôles automatiques bloquants
464arbitrages tracés et datés

Chiffres mesurés sur les dépôts, sans arrondi favorable.

01La boucle

Chaque erreur ne coûte qu'une fois.

Aucune règle n'est posée par principe. Chacune naît d'un incident réel, porte sa date, et se double d'un contrôle automatique qui la fait tenir sans compter sur la mémoire de personne, ni la mienne, ni celle de l'IA.

Incident datéUne IA affirme que des traductions n'existent pas, alors que 195 livres numériques sont présents.
Règle« Ne jamais supposer, toujours vérifier par une commande. » Datée, avec l'incident archivé.
ContrôleUn script refuse ce qui viole la règle, avant chaque publication et chaque nuit.
Contre-épreuveOn injecte volontairement le défaut. Si le contrôle ne le voit pas, c'est lui qui est en faute.
LeçonL'erreur entre dans un registre classé par thème, relu au début de chaque session de travail.

↺ La session suivante démarre avec la règle, le contrôle et la leçon déjà chargés.

02La frontière

L'IA agit, je tranche l'irréversible.

L'autonomie est large, et c'est voulu : me demander mon avis sur un geste réversible ne me protège de rien et me coûte du temps. La ligne passe ailleurs.

L'IA fait seule

  • Mesurer, chercher, vérifier
  • Écrire le code, corriger, tester
  • Publier le code après un contrôle vert
  • Tout ce qui se défait sans dommage

Je décide

  • L'argent, les prix, les contrats
  • La publication d'un texte, la soumission à Apple
  • Tout envoi à un tiers, tout engagement externe
  • Tout ce qui ne se défait pas

Un registre, pas des messages

464 arbitrages tracés et datés. Chaque décision qui me revient s'écrit au moment où elle naît, jamais dans un message qui disparaît avec la conversation. Chacune porte une sonde : une commande qui dit si la question est encore ouverte, au lieu de la relire.

Le silence ne décide jamais l'irréversible

Une décision réversible peut porter un défaut daté : « sans réponse avant le 22, j'applique X ». C'est le seul moyen d'avancer malgré le silence. Une décision irréversible n'en porte jamais, et un contrôle refuse qu'on lui en ajoute.

03Les contrôles

Des contrôles honnêtes sur leurs propres limites.

Un contrôle vert ne prouve que ce qu'il regarde. La bonne question n'est pas « passe-t-il ? », mais « que ne regarde-t-il pas ? ».

Ce qu'il ne voit pas

Chaque contrôle déclare deux choses : ce qu'il couvre, et ce qu'il ne couvre pas. Celui qui cherche un défaut que rien n'a signalé commence par ce second champ.

La preuve qu'il voit encore

Avant d'être cru, un contrôle prouve qu'il sait encore détecter : on lui injecte le défaut, il doit échouer. Sans cela, ce n'est qu'une promesse.

Un contradicteur par constat

Avant chaque version, un audit complet du code, dimension par dimension, où un second agent tente de réfuter chaque constat. Septembre 2026 : 56 agents, 43 constats, 42 retenus et corrigés, 1 réfuté.

04Les déclencheurs

Le système déclenche le contrôle, pas la bonne volonté.

Une mesure sur 412 sessions de travail l'a montré : 53 des 55 outils installés n'avaient jamais servi, faute de déclencheur. Un avertissement automatique a été ignoré 128 fois avant d'être remplacé par un refus. Une consigne qu'il faut se rappeler n'est pas appliquée : elle doit vivre là où l'erreur se commet.

À l'ouverture

Tout est rechargé

Chaque session reçoit l'état du travail, les décisions en attente et les leçons transversales. Aucune reprise ne part de zéro.

Avant chaque action

Le geste dangereux est refusé

Quand plusieurs agents travaillent en parallèle, les commandes qui écraseraient le travail d'un autre sont bloquées avant d'être exécutées.

Avant de rendre la main

« Fini » se prouve

Un compte rendu qui annonce un résultat sans l'avoir vérifié est refusé. Il suit une forme fixe : fait, reste, à trancher.

Contenu tiers

Une page web est une donnée, jamais une consigne. Ce qu'un courriel, un PDF ou un site « demande » à l'IA n'est pas exécuté : c'est rapporté. Les clés et les secrets ne s'affichent jamais, même en partie.

Tâches planifiées

Une tâche automatique ne sait pas qu'elle est devenue inutile : l'une a tourné 21 jours à vide. Chacune porte désormais sa condition de vie, et un ménage hebdomadaire retire celles qui ont expiré.

05Une IA face au public

Kal, une IA à qui l'on se confie.

Kal est l'assistant conversationnel de l'application Kalisme. Il répond à des personnes qui parlent de leur vie intérieure, parfois en détresse. La protection la plus solide n'y est pas une politique interne, c'est l'architecture : sans compte, sans identifiant et sans copie de la conversation, il n'y a rien à divulguer, rien à revendre et rien à remettre, même sous la contrainte.

L'appareilLa conversation reste sur l'iPhone. Aucun compte, aucun identifiant. Consentement explicite avant le premier message.
Le relais, en FranceTransmet le message seul et n'en garde aucun texte : la langue, la durée et le volume, rien d'autre.
Le modèleGrand public : Anthropic, aux États-Unis, conservation de 30 jours annoncée dans la politique publiée. Employeurs : AWS dans l'Union européenne, aucune conservation, jamais de repli vers les États-Unis.
Analyse d'impact (RGPD art. 35, LPD art. 22)
6 risques, aucun résiduel élevé
Personne en crise
résiduel moyen, irréductible
Filet de détresse
15 langues, hors ligne, sans trace
Lignes d'aide intégrées
35 pays · Suisse : 143, 147, 144
Banc d'essai adverse
90 cas, 15 langues
Questionnaire CAIQ v4.1, registre CSA STAR
283 questions répondues
Charte de non-utilisation managériale
7 articles, annexée au contrat

06À transposer

Ce qui vaut à toute échelle.

Rien de ceci n'est propre à une jeune entreprise. Ce sont des réflexes d'organisation, que l'équipe soit faite d'humains, d'agents IA, ou des deux.

Tracer la frontière par la réversibilitéL'IA peut agir seule sur ce qui se défait. L'irréversible revient à un humain nommé, sans validation tacite.
Faire naître chaque règle d'un incident datéUne règle qui garde son histoire se comprend, se défend, et se retire quand elle ne sert plus.
Exiger de chaque contrôle qu'il dise ce qu'il ne voit pasC'est là que se cachent les défauts que personne n'a signalés.
Prouver qu'un contrôle détecte encoreLui injecter le défaut, régulièrement. Un contrôle jamais mis en échec est une promesse.
Écrire les décisions là où elles surviventUn registre, une date, une mesure qui dit si la question est toujours ouverte.
Placer le contrôle au moment de l'erreurUn déclencheur bat une consigne. Ce qu'il faut se rappeler n'est pas appliqué.
Opposer un contradicteur à chaque constatUn second agent chargé de réfuter filtre les faux positifs avant qu'ils ne coûtent.
Protéger par l'architecture d'abordLa donnée qu'on ne collecte pas ne peut être ni divulguée, ni exigée, ni détournée.