Pourquoi ne puis-je pas mettre en pause un agent en cours d'exécution, corriger sa trajectoire et le faire reprendre proprement ?
Opportunité
Les tâches d'agents longues s'étendent sur des centaines d'appels d'outils et peuvent durer des heures, mais les seuls contrôles disponibles aujourd'hui sont de laisser la tâche se terminer ou de l'arrêter entièrement. Un utilisateur qui repère une erreur en cours d'exécution n'a aucun moyen d'injecter une correction, d'inspecter l'état accumulé ou de rediriger la tâche sans perdre toute progression antérieure ou fournir à l'agent un contexte qui le désynchronise de l'état du monde sur lequel il a agi. Un article arXiv d'avril 2026 constitue la première étude systématique de l'interruptibilité dans des environnements d'agents soumis à des contraintes environnementales et montre à quel point les agents actuels sont fragiles lorsque l'intention de l'utilisateur change en cours d'exécution. Les fournisseurs d'infrastructure ont lancé des environnements d'exécution durables fin 2025 et début 2026 qui gèrent la reprise après incident, mais l'interruption sémantique, la capacité de changer ce que l'agent tente d'accomplir plutôt que de simplement le redémarrer, reste à construire.
Pourquoi c'est important
L'interruptibilité sémantique est ce qui transforme une démo qui fonctionne une fois en un outil de production auquel un non-ingénieur peut faire confiance.
Comment j'évalue l'opportunité
Le Score d'Opportunité est mon évaluation personnelle, pas une mesure : l'intensité de la douleur, sa fréquence et le peu de solutions qui existent aujourd'hui. Plus il est élevé, plus je pense que le problème vaut la peine d'être résolu.
L'intensité de la douleur qu'il provoque lorsqu'il se manifeste.
La fréquence à laquelle les gens y sont réellement confrontés.
Le peu de bons outils qui existent pour y remédier aujourd'hui.
D'autres problèmes qui méritent d'être résolus
Pourquoi chaque application IA m'oublie-t-elle dès que je ferme l'onglet ?
AIPourquoi apprendre un nouveau domaine est-il encore conditionné par le fait de savoir quoi demander ?
AIPourquoi un non-expert ne peut-il pas vérifier ce qu'une IA vient de lui dire ?
AIPourquoi teste-t-on les modèles sur des benchmarks mais les déploie-t-on à l'instinct ?
AIPourquoi les agents IA n'ont-ils aucun souvenir de leurs propres erreurs ?
AIPourquoi ne puis-je pas vérifier sur quoi un modèle a réellement été entraîné ?