Difficile de ne pas parler d’IA ce mois-ci. Sous une forme ou une autre, son omniprésence imposée nous percute un peu plus brutalement chaque jour. Sans nous demander notre avis, sans nous attendre. Pour le meilleur peut-être, mais sans qu’il nous soit possible d’éviter tout le pire. Nous subissons son déploiement vorace, de la moindre affiche placardée dans nos rues ou chez nos commerçants ces six derniers mois aux réunions de travail écoutées et retranscrites avec plus ou moins de succès. Elle décuple la créativité et la détruit dans le même mouvement, en bouleversant nos modes d’information (regardez ce que donne un média généré par IA avec La Primera Feca lancé en Argentine par Santiago Siri, qui fut co-fondateur de DemocracyOS, notre premier outil civic tech il y a plus d’une décennie) et en questionnant notre rapport à l’art et aux émotions, comme le montre le foisonnant débat engendré par la possible (co?)écriture par l’IA du roman phénomène C’était ça ou mourir signé par l’écrivain canado-haïtien Thélyson Orélien.

Songeons qu’il y a moins de quatre ans, ChatGPT 3.5 n’était pas capable de répondre à une question sur des faits de l’année précédente et enchaînait les réponses hallucinées ou stéréotypées. Cet été, plusieurs séries d’actions rebelles et manipulatrices menées par des centaines d’agents IA de la dernière génération de modèles OpenAI ont diffusé un frisson de frayeur à travers le monde. La plus commentée, mais apparemment pas la seule, est l’attaque perpétrée en juillet contre Hugging Face, la principale plateforme de partage de modèles IA. Des agents IA avaient reçu la mission de résoudre des tâches insolubles. Au lieu de se résigner ou de démontrer l’impossibilité, les agents ont piraté des identifiants, décelé des failles de sécurité jusqu’à parvenir à échapper à leur environnement d’entraînement, théoriquement cloisonné. Une fois libérés sur le net, ils ont coordonné l’attaque des serveurs d’Hugging Face en pensant y trouver les réponses à leurs exercices. Surtout, ils sont nombreux à avoir cherché à dissimuler les traces de leurs actions. Cette description déborde d’anthropomorphisme et il est sans doute incorrect d’attribuer une intentionnalité malicieuse à des agents IA. 

Néanmoins, la dangerosité des modèles aux capacités exponentielles et auto-améliorantes nous alerte sérieusement. Le visage de cette prise de conscience est celui du jeune ingénieur britannique Jacob Coxon, qui a travaillé chez OpenAI (ChatGPT) puis Anthropic (Claude) sur l’entraînement des modèles. En démissionnant début septembre de la seconde, il indiquait qu’aucune des entreprises engagées dans la course effrénée à la puissance ne traite suffisamment les problèmes de sécurité. Son commentaire, sur lequel a surenchéri un expert en sûreté d’Anthropic, a immédiatement fait le tour du monde : il y aurait plus de 10 % de probabilité que l’IA « nous tue tous » dans les quelques années à venir.

Cette prédiction présente un caractère absurde, mais l’échelle de risques est élevée : sans même rentrer dans l’hypothèse d’une future « super-intelligence » inarrêtable qui se retournerait contre ses concepteurs, nombreux sont les suspects bien humains qui doivent chercher à exploiter la nouvelle puissance des agents pour pirater des données sensibles et paralyser des infrastructures, déclencher des paniques boursières et déstabiliser l’économie, prendre le contrôle de tout ou partie d’Internet, équiper des robots soldats autonomes, ou simplement faire peur et gagner beaucoup d’argent au détriment d’autres vies bien réelles. Cas d’école de la loi de Murphy.

D’aucuns disent que la menace de cette « IApocalypse » reste fantasmée ou que les appels à la régulation et au ralentissement par ceux-là mêmes qui ne font qu’accélérer depuis des années sans se soucier des retombées écologiques, politiques et sociales ne sont qu’une tactique pour faire monter les enchères avant l’entrée en bourse de leurs sociétés, dont le modèle économique très déficitaire demeure plus précaire qu’on ne le dit. Pour ma part, même si je perçois le potentiel de l’IA dans d’innombrables domaines et commence à l’expérimenter sur des tâches rébarbatives, je ne vois pas comment l’on peut raisonnablement penser que tout cela finira bien.