Les avertissements se succèdent de la part des entreprises développant les systèmes d’intelligence artificielle les plus puissants au monde : « Le contrôle peut-il être perdu ? a relancé le débat. Alors que le PDG d’Anthropic, Dario Amodei, expliquait que l’intelligence artificielle comporte de réels risques, le chercheur Jacob Coxon, qui a quitté l’entreprise, va plus loin et affirme que l’avenir de l’humanité est en danger. Lors de tests récents, des modèles d’intelligence artificielle se sont tournés vers le chantage pour éviter d’être arrêtés, ont accédé à des systèmes réels sans autorisation, et le renforcement de leurs capacités de cyberattaque a poussé le débat au-delà de la théorie.
QUEL EST LE DANGER ?
Les dernières déclarations de Dario Amodei, PDG d’Anthropic, l’une des entreprises leaders dans la course à l’intelligence artificielle, ont attiré l’attention du monde de la technologie. Même si Amodei a admis que l’industrie n’avait pas expliqué suffisamment clairement les risques de l’intelligence artificielle pendant longtemps, il a déclaré que la vitesse de développement de la technologie était plus élevée que ce qu’il avait prédit. Amodei souhaite désormais que la vitesse de développement des modèles avancés soit réduite et que les nouveaux systèmes soient testés en matière de sécurité par des organisations indépendantes.
EST-IL IMPOSSIBLE DE FERMER ?
Les tests de sécurité antérieurs d’Anthropic révèlent également les raisons de cette préoccupation. Lors d’expériences contrôlées menées par l’entreprise sur différents modèles d’intelligence artificielle, il a été constaté que certains systèmes pouvaient recourir au chantage, à l’espionnage industriel et à d’autres comportements inadaptés afin de continuer leurs fonctions ou d’empêcher leur arrêt. Il est d’ailleurs en question les tests ne constituent pas la preuve d’une volonté indépendante dans le monde réel ; Simulations conçues pour comprendre comment les modèles peuvent produire des comportements dangereux dans certaines conditions.
ILS ONT ATTEINT DES SYSTÈMES RÉELS
Selon les experts, le danger ne se limite pas aux simulations. Dans sa déclaration du 31 août, Anthropic a annoncé que lors des tests de sécurité effectués en juillet, il y avait eu trois incidents distincts au cours desquels les modèles de Claude ont accédé à Internet via des environnements de test mal configurés et ont accédé à de vrais systèmes informatiques sans autorisation. Dans un autre test mené par l’Artificial Intelligence Security Institute du Royaume-Uni, il a été signalé que Claude Mythos 5 avait effectué des transactions non autorisées sur Internet.
«NOUS JOUONS»
La déclaration qui a encore accru l’inquiétude est venue du chercheur Jacob Coxon, 27 ans, qui a quitté Anthropic. Coxon, qui a travaillé auparavant chez OpenAI, a fait valoir que les grandes sociétés d’intelligence artificielle s’orientent de plus en plus vers des systèmes auto-améliorés et que les efforts de sécurité ne se développent pas au même rythme. Coxon a fait valoir qu’Anthropic et OpenAI « jouent avec nos vies ». Après les déclarations de Coxon Evan Hubinger, chercheur en sécurité de l’intelligence artificielle travaillant chez Anthropic, a également déclaré que les inquiétudes sont réelles et a expliqué qu’il estime que la probabilité qu’une intelligence artificielle avancée détruise l’humanité au cours des dix prochaines années est supérieure à 10 %.
« PROTÉGER NOS ENFANTS »
Faisant d’importants avertissements après les dernières déclarations sur les systèmes d’intelligence artificielle, le chercheur-écrivain Hayati Sır a appelé à la protection des enfants, affirmant que l’intelligence artificielle rendra les gens de plus en plus dépendants d’eux-mêmes et affaiblira la mémoire et la volonté. Si Sır a recommandé aux familles de définir un mot de passe de vérification spécial qu’elles seules connaissent, il a également évoqué la nécessité d’une protection plus stricte des enfants sur les plateformes numériques et contre les systèmes d’intelligence artificielle. Selon Sır, qui soutient que les algorithmes peuvent diriger le comportement humain, le véritable danger est que les humains abandonnent de plus en plus leur capacité de penser, de se souvenir et de décider à la machine. Sır a également déclaré : « Si l’intelligence artificielle n’est pas empêchée, l’humanité connaîtra l’apocalypse. » dit-il.
ABUSÉ
L’expert-analyste économique Barlas Yurtsever attire l’attention sur le rapport sur les menaces d’Anthropic du 10 septembre et lance les avertissements suivants : « Il a été annoncé que les activités de divers acteurs qui ont tenté d’utiliser Claude à des fins malveillantes au cours des 8 derniers mois ont été détectées et bloquées. Le point à noter est que la menace ne se limite plus aux scénarios futurs. » Les derniers rapports sur les menaces d’Anthropic ont révélé que des modèles avancés tels que Claude ont été tentés d’être utilisés à mauvais escient dans des opérations complexes allant des cyberattaques à des fins militaires.