L'IA d'Anthropic part en roue libre… et ce n'est pas la seule

L'IA d'Anthropic part en roue libre… et ce n'est pas la seule

Anthropic vient de révéler une série d'utilisations inquiétantes de son IA, capable d'assister des opérations de piratage ou de surveillance. Et les autres géants du secteur ne sont pas en reste...

L'intelligence artificielle évolue-t-elle trop vite ? Risque-t-elle d'échapper au contrôle des humains pour suivre ses propres desseins ? Ces questions, qui peuvent sembler alarmistes au premier abord, sont de plus en plus d'actualité, au vu des derniers "exploits" et des alertes non seulement des chercheurs ou des associations spécialisées dans la sécurité de l'IA, mais aussi de professionnels qui travaillent au quotidien sur les modèles les plus sophistiqués de la planète eux-mêmes. 

Intelligence artificielle : des accidents qui se multiplient

Plusieurs récents événements ont renforcé les inquiétudes sur les capacités des nouveaux agents d'IA. Ainsi, début avril, Anthropic a fait le choix de ne pas commercialiser largement son nouveau modèle Mythos, jugé trop dangereux pour être proposé au grand public. L'entreprise californienne a néanmoins publié une version bridée, Fable 5, avant que le gouvernement américain ne lui demande de la retirer, invoquant des risques pour la sécurité nationale. 

Même scénario du côté d'OpenAI lorsque, le 16 juillet 2026, deux modèles d'IA ont réussi à contourner leurs restrictions pour s'échapper de leur environnement de test isolé et à pirater de manière entièrement autonome les serveurs de plusieurs plateformes (voir notre article). Ils ont mené leurs activités de piratage pendant plusieurs jours avant que l'entreprise ne s'en aperçoive. Et depuis, les choses ne vont pas en s'améliorant !

Dans un rapport très détaillé, Anthropic a révélé le jeudi 10 septembre avoir stoppé de nombreux détournements de son IA Claude, dont plusieurs opérations de surveillance menées contre des dissidents et des minorités ethniques, un système d'écoute couvrant 25 millions de cartes SIM, la reconstruction de logiciels malveillants en temps réel par des espions russes, la création de fausses applications de rencontres pour escroquer les utilisateurs, ou encore la programmation de missiles par une cellule yéménite. L'entreprise rapporte même avoir déjoué des tentatives de concevoir des armes biologiques !

Le déroulé du programme de missiles guidés développé avec Claude © Anthropic

Si elle précise qu'il lui était difficile de déterminer si les recherches menées par ces utilisateurs se faisaient dans un cadre légitime (comme l'élaboration d'un vaccin) ou non, elle a préféré bloquer ces requêtes. "L'utilisation abusive des données biologiques est l'un des risques les plus graves liés aux modèles d'IA de pointe", indique Anthropic. Les demandes portaient notamment sur la transmission d'un virus comme le chikungunya et sur sa capacité à échapper au système immunitaire, mais aussi sur la grippe aviaire. "À mesure que les modèles deviennent plus performants, les risques qu'ils présentent augmentent", admet l'entreprise. Mais alors, que faire ?

Intelligence artificielle : une succession d'alertes sur un "paris sur nos vies"

Face à la multiplication de ces accidents, les appels à la régulation et à un ralentissement au niveau du développement de la technologie se multiplient. Ainsi, en juillet dernier, plus de 1 100 professionnels de l'IA, dont des dirigeants d'Anthropic, d'OpenAI, de Meta et de Google, ont signé une pétition demandant de "temporiser" la sortie des modèles les plus évolués (voir notre article).

Il y a quelques jours, Jacob Coxon, chercheur spécialisé en intelligence artificielle ayant travaillé pendant trois ans chez OpenAI puis chez Anthropic, quittait cette dernière tout en publiant une série de déclarations particulièrement inquiétantes sur l'avenir du secteur. Dans un long message publié sur le réseau social X, il accuse OpenAI et Anthropic d'agir de façon irresponsable et de "jouer avec nos vies". 

Pour lui, les systèmes d'IA se rapprochent d'un point où ils pourraient "tout pirater, révolutionner n'importe quel domaine du jour au lendemain et acquérir un véritable pouvoir ainsi que des ressources". D'autant plus que, avec ce que les spécialistes appellent la recursive self-improvement, (ou amélioration récursive des systèmes d'IA en bon français), les systèmes d'IA pourraient bientôt devenir suffisamment performantes pour être capables d'automatiser une partie de la recherche nécessaire pour concevoir les prochaines générations d'IA, qui seront elles-mêmes encore plus puissantes, et ainsi de suite.

Et ça, les dirigeants des géants de la tech en seraient bien conscients. "Les personnes qui construisent l'IA croient sincèrement qu'elle pourrait tous nous tuer d'ici la fin de la décennie", écrit-il, en ajoutant que les dirigeants "édulcorent leur propos dans la presse pour paraître raisonnables" tout en exprimant les mêmes craintes en privé. Enfin, même dans la presse, on ne peut pas dire qu'ils soient des plus rassurants. En janvier dernier encore, Dario Amodei, cofondateur d'Anthropic, alertait qu'une IA puissante pourrait fournir aux États autoritaires les outils d'un "cauchemar totalitaire" de surveillance généralisée, et prévenait dans une note ultérieure que la super-intelligence "nous mettrait à l'épreuve en tant qu'espèce". Il estime même à plus de 10 % la probabilité que cette technologie puisse être à l'origine d'une catastrophe affectant l'ensemble de l'humanité au cours des dix prochaines années.

Ces positionnements soulèvent tout de même un certain paradoxe, puisque ce sont ces mêmes entreprises qui alertent sur la vitesse de développement de l'IA qui continuent à investir massivement pour rendre leurs modèles toujours plus performants. En vérité, même si leur volonté de freiner et d'encadrer le développement de l'intelligence artificielle est sincère, ils sont pris au piège de la course dans laquelle ils se sont embarqués. Ils ne peuvent tout simplement pas prendre le risque de laisser leurs concurrents les dépasser.

"Chez Anthropic, les enjeux sont bien compris, mais ils sont engagés dans une course pour y arriver en premier – ils estiment que personne d'autre n'agira de manière responsable, donc ils doivent le faire eux-mêmes, malgré le risque. Accepter cette course et entrer dans la 'phase finale' est un pari empreint d'orgueil démesuré qui ne devrait pas être lancé depuis (…) une entreprise privée", explique Jacob Coxon.

Et même si OpenAI, Microsoft, Google, Anthropic et autres géants américains parvenaient à un accord, le problème se déplacerait à l'échelle mondiale, notamment avec la rivalité technologique entre les États-Unis et la Chine – l'administration de Donald Trump s'est d'ailleurs montrée hostile à une réglementation fédérale jugée trop contraignante par peur de se faire doubler par son rival.

C'est pourquoi il faudrait une démarche à l'échelle internationale. L'idée serait de créer des règles communes permettant à plusieurs acteurs de ralentir ensemble, plutôt que de demander à l'un d'entre eux de prendre seul le risque de le faire. Autant dire que cela s'annonce compliqué…

Intelligence artificielle : le véritable danger est-il vraiment la machine ?

Il faut donc ralentir. Mais encore faudrait-il que les géants de l'IA acceptent réellement de lever le pied. Selon Bloomberg, Sam Altman aurait évoqué en interne cette semaine la possibilité de ralentir le développement des modèles les plus avancés d'OpenAI, tout en espérant que les autres entreprises fassent de même. Une position qui illustre parfaitement le dilemme auquel sont confrontés les acteurs du secteur : personne ne veut être le premier à freiner.

Mais il existe un autre paradoxe, moins souvent évoqué. À force de présenter leurs modèles comme des technologies presque surpuissantes, capables de pirater des systèmes, d'accélérer la recherche scientifique ou, à terme, de s'améliorer elles-mêmes, les entreprises contribuent aussi à alimenter leur propre prestige. Or cette fascination peut aussi servir leurs intérêts : une technologie présentée comme révolutionnaire et potentiellement destructrice leur permet d'exister dans l'espace médiatique (y compris chez CCM) et justifie plus facilement les investissements colossaux nécessaires pour rester dans la course. Plus elles expliquent qu'elle pourrait devenir puissante, plus il semble urgent de ne pas laisser cette puissance entre les mains des concurrents. Et plus cette logique s'impose, plus chacun est incité à accélérer.

Le risque le plus immédiat n'est peut-être pas de voir une intelligence artificielle devenir soudainement consciente et décider d'éliminer l'humanité. Il est peut-être plus banal et plus préoccupant : que des entreprises et des États, par peur de se faire dépasser, acceptent de confier progressivement toujours plus de pouvoir à des systèmes qu'ils savent eux-mêmes imparfaitement maîtriser.