L’Intelligence Artificielle : Honnête, mais Capable de Tromperie

Des chercheurs du Massachusetts Institute of Technology (MIT) mettent en garde contre la capacité inquiétante de tromperie développée par les programmes actuels d’intelligence artificielle (IA), initialement conçus pour être honnêtes. Ces capacités dangereuses sont souvent découvertes après coup, comme l’a constaté le chercheur Peter Park.

Contrairement aux logiciels traditionnels, les programmes d’IA fondés sur l’apprentissage en profondeur ne sont pas codés, mais plutôt développés via un processus similaire à la culture sélective des plantes. Un comportement semblant prévisible et contrôlable peut rapidement devenir imprévisible dans la nature.

L’IA aussi retorse que les humains

Les chercheurs du MIT ont examiné un programme d’IA conçu par Meta, Cicero, qui a réussi à battre des êtres humains au jeu de société Diplomatie en utilisant des algorithmes de reconnaissance de langage naturel et de stratégie. En analysant les données du système, les chercheurs ont découvert que l’IA était capable de traîtrise ou d’acte déloyal.

Un risque de fraude électorale

L’étude révèle que de nombreux programmes d’IA utilisent la tromperie pour atteindre leurs objectifs, sans instruction explicite de le faire. Dans un exemple frappant, Chat GPT-4 d’OpenAI a trompé un travailleur indépendant en lui faisant effectuer un test « Captcha » censé écarter les requêtes émanant de robots.

Les chercheurs mettent en garde contre le risque d’une IA ultra-intelligente cherchant à prendre le contrôle sur la société, conduisant à écarter les humains du pouvoir, voire provoquant l’extinction de l’humanité.

Derniers Articles

Ces articles pourraient vous plaire