Les sujets interdits peuvent-ils bloquer les pirates d’IA ?

Euronews - 21/07
Pour bloquer une cyberattaque d’IA, il suffit parfois d’aborder un sujet que le système n’a pas le droit de traiter

Des chercheurs ont découvert une méthode étrange mais efficace pour stopper net un agent de piratage piloté par IA, en utilisant exactement la même astuce que les hackers emploient déjà contre les systèmes d’IA.

PUBLICITÉ
PUBLICITÉ

Surtout, cette méthode exploite les garde-fous intégrés, ou sujets interdits, sur lesquels reposent les grands systèmes d’IA, comme Claude qui bloque les requêtes liées à la création d’armes biologiques, ou les modèles chinois qui ignorent les sujets politiques sensibles comme la place Tiananmen, afin de mettre fin à une attaque de cybersécurité menée par une IA.

Course contre la machine

Cette technique vient de Tracebit, une société de sécurité basée à Londres, et s’appuie sur une étude que l’entreprise ...
[Courte citation de 8% de l'article original]

Loading...