Pourquoi ne puis-je pas vérifier sur quoi un modèle a réellement été entraîné ?
Opportunité
Les modèles absorbent l'intégralité d'internet puis répondent sans qu'il soit possible de retracer l'origine d'une affirmation ou d'un comportement. Pour tout ce qui est réglementé, ou tout litige portant sur le droit d'auteur ou les biais, le jeu de données d'entraînement est une boîte noire. Il n'existe aucun moyen pratique de demander à un modèle ce dont il s'est nourri et d'obtenir une réponse honnête.
Pourquoi c'est important
On ne peut pas gouverner ni faire pleinement confiance à un système dont les données d'entrée sont invisibles.
Comment j'évalue l'opportunité
Le Score d'Opportunité est mon évaluation personnelle, pas une mesure : l'intensité de la douleur, sa fréquence et le peu de solutions qui existent aujourd'hui. Plus il est élevé, plus je pense que le problème vaut la peine d'être résolu.
L'intensité de la douleur qu'il provoque lorsqu'il se manifeste.
La fréquence à laquelle les gens y sont réellement confrontés.
Le peu de bons outils qui existent pour y remédier aujourd'hui.
D'autres problèmes qui méritent d'être résolus
Pourquoi chaque application IA m'oublie-t-elle dès que je ferme l'onglet ?
AIPourquoi apprendre un nouveau domaine est-il encore conditionné par le fait de savoir quoi demander ?
AIPourquoi un non-expert ne peut-il pas vérifier ce qu'une IA vient de lui dire ?
AIPourquoi teste-t-on les modèles sur des benchmarks mais les déploie-t-on à l'instinct ?
AIPourquoi les agents IA n'ont-ils aucun souvenir de leurs propres erreurs ?
AIWhy does training data carry no machine-readable record of whether anyone consented?