MOTEUR D'INFÉRENCE CONFIDENTIEL · X0NE-INFER

Moteur d'inférence
confidentiel.
Confidential Inference Only.

Un moteur d'inférence qui ne tourne que dans une enclave attestée. Celui qui possède la machine ne voit ni votre modèle, ni vos prompts, ni les réponses.

porte d'attestation
enclaveaucune
preuveaucune
✗ refuséexit 64
cpu · intel tdxvérifié ✓
gpu · nvidia h100 ccvérifié ✓
clé du modèlelibérée
reçusigné, par réponse
● en serviceconfidential inference only

la séquence, illustrée · machine sans enclave → intel tdx + nvidia h100, mode confidentiel

définition

Qu'est-ce qu'un moteur d'inférence confidentiel ?

Un moteur d'inférence confidentiel exécute un modèle d'IA à l'intérieur d'une enclave matérielle : le processeur et le GPU chiffrent la mémoire pendant le calcul et prouvent, par attestation, que l'enclave est authentique. On parle aussi d'inférence confidentielle ou de confidential inference.

comment

Pas de preuve, pas d'inférence.

Uniquement en enclave

par construction

Il n'a pas d'autre mode. Sans preuve matérielle, aucun port ne s'ouvre, aucune clé n'est libérée.

La preuve d'abord

Intel TDX · NVIDIA H100

Le processeur et le GPU prouvent ce qu'ils sont, vérifiés en direct auprès d'Intel et de NVIDIA, avant que quoi que ce soit n'arrive.

Vous vérifiez

un reçu signé par réponse

Chaque réponse porte un reçu signé. Vous le vérifiez sur votre propre machine.

réel

Exécuté sur du vrai matériel.

Intel TDX avec un GPU NVIDIA H100 en mode Confidential Computing, le 20 août 2026. Écrit en Rust par x0ne, à Paris. English version.

écosystème

D'autres travaux publics sur l'inférence confidentielle.

questions fréquentes

Moteur d'inférence confidentiel : les questions.

Qu'est-ce qu'un moteur d'inférence confidentiel ?

C'est un serveur d'inférence qui exécute un modèle d'IA à l'intérieur d'une enclave matérielle (un TEE) et qui prouve cryptographiquement, par attestation, que cette enclave est authentique avant de recevoir le modèle ou les données. Le propriétaire de la machine ne peut lire ni les poids du modèle, ni les prompts, ni les réponses.

Que veut dire « ne sert qu'en confidentiel » ?

La plupart des services d'inférence confidentielle placent un moteur classique, comme vLLM, dans une machine virtuelle confidentielle : le même programme sait aussi servir hors enclave. x0ne-infer n'a pas ce mode. Sa porte d'attestation est un type du langage Rust : sans preuve, rien n'ouvre de port ni ne libère de clé, et sur une machine sans enclave le binaire refuse de démarrer. Il n'existe pas de contournement de développement.

Comment savoir que c'est réel ?

Il a été exécuté sur du vrai matériel le 20 août 2026 : une machine Intel TDX avec un GPU NVIDIA H100 en mode Confidential Computing chez un fournisseur cloud, 10 min 23 s de machine facturée, environ 0,5 $. L'attestation du processeur est vérifiée jusqu'à la racine d'Intel et auprès du service d'Intel, celle du GPU auprès du service de NVIDIA, et le client re-vérifie tout sur sa propre machine.

Qu'est-ce que cela ne prouve pas encore ?

Un verdict vérifié signifie qu'un matériel confidentiel authentique a répondu au défi de cette session. Il ne signifie pas encore que ce binaire précis s'exécute : aucune mesure de lancement n'est épinglée aujourd'hui. C'est le prochain jalon, avec les builds reproductibles.

x0ne-infer est-il open source ?

x0ne-infer est écrit en Rust par x0ne, à Paris. Sa publication en open source, sous licence Apache-2.0, est prévue ; le code n'est pas encore public. Accès anticipé : contact@x0ne.co.