Chez Anthropic, l’étrange croisade de conscientisation de l’IA

La startup à l’origine du modèle d’intelligence artificielle Claude est convaincue qu’inculquer une morale à la machine pourrait contribuer à préserver l’humanité de l’apocalypse de l’IA tant redoutée par certains. Mais alors, que restera-t-il de l’humanité si la machine se dote d’une âme et d’une conscience ?

Et si l’intelligence artificielle pouvait avoir une âme ? La question, surréaliste à première vue, est pourtant au cœur des préoccupations d’Anthropic, l’entreprise conceptrice du modèle d’IA nommé Claude.

Christopher Olah, l’un des cofondateurs de la société, a ainsi mobilisé, selon une vertigineuse enquête du New York Times (NYT), des dizaines d’hommes de foi de tous bords (catholiques, juifs, sikhs, évangéliques, penseurs de l’ubuntu…) afin de les convaincre que l’IA pouvait avoir une conscience, comme tout être humain normalement constitué.

« Ils le traitent comme un être conscient », raconte Mois Navon, un érudit orthodoxe venu d’Israël, en référence au plaidoyer d’Olah et à ses discussions, pour la plupart confidentielles, avec les responsables d’Anthropic.

Une sacrée mission

Décrit par Wikipédia comme l’un des pionniers de l’interprétabilité mécaniste, discipline destinée à comprendre ce qui se passe à l’intérieur des réseaux de neurones, l’homme de 34 ans est présenté par l’auteure de l’enquête du NYT, Elizabeth Dias, comme un « évangélisateur efficace ».

« Écoutez-le un moment, et vous vous sentez emporté par sa mission », écrit-elle, tant le chercheur lui paraissait convaincu, même s’il admet ne pas savoir, pour l’heure, si les modèles d’IA ont une conscience.

« Ce qui m’importe, c’est que nous trouvions la bonne réponse, quelle qu’elle soit », affirme le milliardaire. Au cours des différentes réunions, l’équipe d’Anthropic a évoqué, d’après le New York Times, des « sentiments » de Claude ainsi que des « vecteurs émotionnels ».

Elle a même montré aux convives un exemple où un modèle répète en boucle « Je suis une honte ». L’entreprise, qui a récemment ferraillé contre le Pentagone au sujet de l’utilisation de son modèle à des fins de surveillance de masse et d’usage létal, entend ainsi s’inspirer de siècles de sagesse morale pour que Claude choisisse de lui-même d’agir pour le bien.

La conscience comme ultime rempart

Pour Christopher Olah, la révolution annoncée de l’IA doit se dérouler « bien ». Il entend par là un monde sans « catastrophes qui tuent beaucoup de gens » et « où les humains s’épanouissent, où le monde s’épanouit ».

Cet enjeu est d’autant plus crucial que la technologie progresse rapidement, avec son lot de corollaires, dont le piratage autonome de systèmes informatiques par des agents d’IA. Anthropic a elle-même averti que l’IA avancée pourrait engendrer des risques catastrophiques, voire existentiels, pour l’humanité.

La société évoque notamment la possibilité que des systèmes d’IA résistent à leur arrêt, manipulent l’information ou agissent de manière imprévue par les humains. Elle reconnaît aussi une incertitude quant aux risques posés par des systèmes de plus en plus autonomes et capables de s’améliorer eux-mêmes.

Dans sa quête, la firme technologique s’est toutefois heurtée à la position plutôt méfiante du Vatican sur l’intelligence artificielle, au grand dam d’Olah, qui a assisté à son corps défendant à la première encyclique du pape Léon XIV en mai dernier, où le souverain pontife a appelé à « désarmer l’IA ».

Laisser un commentaire