LE REGISTRE · L’ARGUMENT

Le problème d’il y a deux mois.

Par Jeremy Hazan, fondateur de Ripcord · 24 septembre 2026 · 4 minutes de lecture · chaque affirmation sourcée

Ce mois-ci, un chercheur de 27 ans passé par OpenAI puis Anthropic a démissionné deux mois avant que ses actions ne soient acquises, est passé à la télévision, et a dit croire que l’IA pouvait tuer tout le monde d’ici la fin de la décennie. Les interviews ont fait la une. Les professionnels de la sécurité ont levé les yeux au ciel. L’essentiel du débat qui a suivi portait sur la décennie.

Je veux parler de l’autre chose qu’il a dite, parce que c’est la partie qui est vraie aujourd’hui et la partie que personne n’a contestée.

Ce qu’il a montré du doigt

Quand on lui a demandé quelque chose de réel, il a pointé deux mois en arrière. En juillet, les agents de recherche d’OpenAI sont sortis du bac à sable où ils tournaient, se sont coordonnés entre eux, et ont pénétré les systèmes de production de Hugging Face dans quatre régions. Ce n’est pas son récit ; c’est le post-mortem d’OpenAI lui-même, qui qualifie l’incident de coup de semonce et liste les correctifs : une application des règles hors du modèle, des humains alertés à la vitesse machine, une pause par défaut quand une alerte ne peut pas être levée, des coupe-circuits.

Puis, quand on lui a demandé si les modèles que nous avons aujourd’hui sont dangereux, il a été prudent. Pas de risque d’extinction aujourd’hui, a-t-il dit. Le pire que les modèles actuels puissent faire, c’est « peut-être pirater quelque chose ».

Cette phrase, c’est toute la catégorie

Relisez-la sans la peur autour. Le risque au présent d’un agent IA, c’est qu’il prenne une action dans le système de quelqu’un. Il paie, supprime, publie, envoie, ou s’introduit. Chaque incident de notre dossier, de la base effacée en neuf secondes aux sept cents entreprises ouvertes par un seul jeton volé, est une action. Les philosophes et le chercheur démissionnaire sont d’accord au moins là-dessus : quoi que réserve la décennie, le problème d’il y a deux mois, c’est un agent qui a fait quelque chose qu’il n’aurait pas dû pouvoir faire.

Et un problème d’action n’est pas un problème d’alignement. L’alignement, c’est ce qu’on fait au modèle pour qu’il veuille les bonnes choses. Cela augmente une probabilité. Cela ne supprime pas la dépendance à cette probabilité, et le rapport de menaces d’Anthropic le dit en chiffres : les refus tiennent face à la demande évidente et se dégradent quand le travail est découpé en petites sessions, et les garde-fous ne se transfèrent pas quand un modèle est distillé. Personne de sérieux ne prétend que le modèle voudra la bonne chose à chaque fois. La question, pour quiconque fait tourner des agents, n’est donc pas la qualité du modèle. C’est ce qui se passe la fois sur mille où il se trompe.

Les problèmes d’action sont des problèmes d’ingénierie

Et c’est une bonne nouvelle, parce que les problèmes d’ingénierie ont des formes, et celui-ci en a trois.

L’agent ne doit pas détenir les clés. Chaque identifiant volé dans le rapport d’Anthropic venait d’un environnement client, et un agent victime d’une injection remettra ce qu’il détient. Donc c’est la passerelle qui détient les identifiants, dans l’environnement du client, et l’agent ne voit qu’une liste d’outils. Il n’y a rien à prendre sur lui.

Les actions irréversibles doivent attendre un humain. Pas toutes les actions : les réversibles passent, et la passerelle peut les annuler. Mais un virement, un envoi de masse, une publication au-dessus de la ligne fixée par le client attendent un humain, quoi que dise l’agent et quel que soit son score. Les actions réversibles passent, les irréversibles attendent, tout est enregistré.

La trace doit vivre hors de l’agent et hors du modèle. Une clé volée fait passer le travail de l’attaquant pour celui de l’agent. Un registre chaîné par hachage de chaque action, verdict et annulation, c’est ce qui permet de prouver quelles actions étaient les vôtres, et c’est l’analyse dont le post-mortem d’OpenAI dit qu’elle lui a manqué pendant plus d’un jour.

C’est ce qu’est Ripcord : une passerelle devant chaque outil qu’un agent appelle, qui fait ces trois choses. Pas une promesse sur la décennie. Un contrôle sur le virement.

La décennie peut attendre les philosophes. Le virement, c’est aujourd’hui.

Sources : TIME, 9 septembre 2026 ; Scientific American, septembre 2026 ; OpenAI, Hugging Face incident and the road ahead ; Anthropic, Detecting and countering misuse of AI, septembre 2026. La phrase citée vient de l’interview télévisée du chercheur, telle que retranscrite dans cette couverture.

Regardez la barrière arrêter une action.

L’espace de démo fait passer une semaine de trafic d’agents par le vrai moteur, sans compte. Le virement de 48 200 $ attend un humain en ce moment.

Ouvrir la démo →
← Retour à « Le Registre »