L’intelligence artificielle (IA) ne cesse de faire des vagues depuis sa création dans les années 1950. Après deux vagues de promesses et de déceptions, elle revient en force depuis 2012, sous une forme bien différente de ses débuts. Cette nouvelle IA, appelée « apprentissage profond » ou « deep learning », s’oppose radicalement au paradigme symbolique qui dominait auparavant. Elle repose sur des réseaux de neurones et des méthodes statistiques, plutôt que sur la logique et le raisonnement.
Le deep learning a révolutionné le domaine de l’IA en permettant de meilleures prédictions grâce à des volumes importants de données. Cependant, cette approche a un coût : elle est devenue si complexe qu’il est difficile de comprendre le cheminement entre la question et la réponse. Cette opacité constitue aujourd’hui le défi majeur des nouvelles techniques de l’intelligence artificielle.
Le Paradigme Symbolique et le Deep Learning
Le paradigme symbolique, qui a dominé les deux premières vagues de l’IA, visait à introduire des règles de raisonnement logiques dans les programmes informatiques. Toutefois, ces programmes ne pouvaient produire que des intelligences formelles, incapables de faire face à des situations imprévues.
En opposition à ce paradigme, le deep learning propose une conception radicalement différente de l’intelligence des machines. Il s’appuie sur des réseaux de neurones et des méthodes statistiques, permettant de traiter d’énormes jeux de données et de produire des prédictions statistiques de plus en plus précises.
Les Enjeux de l’Opacité de l’IA
Le deep learning ne raisonne pas à partir de règles, de symboles et de catégories, rendant le chemin entre la question et la réponse opaque. Cette opacité constitue un défi majeur, car ces techniques sont plus précises et subtiles que les modèles symboliques, mais elles abandonnent la vérifiabilité et une certaine intelligibilité des calculs.
De plus, les réseaux de neurones peuvent produire des résultats erronés sans que l’on puisse en comprendre les raisons. La question se pose alors de savoir dans quelles conditions et pour quel type d’usage nous pouvons accepter qu’un algorithme soit globalement plus performant, mais moins compréhensible.