Comment obtenir une preuve cryptographique que le modèle distant que j'ai appelé s'est exécuté comme spécifié ?
Opportunité
Les API d'IA en nuage renvoient des résultats sans aucune preuve vérifiable de la version du modèle exécutée, du niveau de quantisation utilisé, ni du prompt système ajouté en amont. L'informatique confidentielle sur GPU avec du matériel NVIDIA Hopper peut attester l'état du matériel, mais les preuves d'attestation n'atteignent jamais l'appelant de l'API et la chaîne de confiance se termine dans une infrastructure de certificats contrôlée par le fournisseur. Un article de juin 2026 propose des benchmarks de sécurité vérifiables basés sur des TEE, mais aucune API de production n'expose de reçu d'inférence par appel à l'appelant. Tout contexte adverse ou réglementé où l'identité du modèle est importante doit faire confiance à la parole du fournisseur.
Pourquoi c'est important
Sans reçu d'inférence vérifiable, toute affirmation de sécurité, de conformité et d'alignement portant sur une invocation de modèle distant repose uniquement sur la confiance accordée au fournisseur, ce qui n'est pas suffisant pour les déploiements réglementés ou les architectures d'agents autonomes.
Comment j'évalue l'opportunité
Le Score d'Opportunité est mon évaluation personnelle, pas une mesure : l'intensité de la douleur, sa fréquence et le peu de solutions qui existent aujourd'hui. Plus il est élevé, plus je pense que le problème vaut la peine d'être résolu.
L'intensité de la douleur qu'il provoque lorsqu'il se manifeste.
La fréquence à laquelle les gens y sont réellement confrontés.
Le peu de bons outils qui existent pour y remédier aujourd'hui.
D'autres problèmes qui méritent d'être résolus
Pourquoi chaque application IA m'oublie-t-elle dès que je ferme l'onglet ?
AIPourquoi apprendre un nouveau domaine est-il encore conditionné par le fait de savoir quoi demander ?
AIPourquoi un non-expert ne peut-il pas vérifier ce qu'une IA vient de lui dire ?
AIPourquoi teste-t-on les modèles sur des benchmarks mais les déploie-t-on à l'instinct ?
AIPourquoi les agents IA n'ont-ils aucun souvenir de leurs propres erreurs ?
AIPourquoi ne puis-je pas vérifier sur quoi un modèle a réellement été entraîné ?