Modérateurs laliche Posté(e) il y a 2 heures Modérateurs Share Posté(e) il y a 2 heures Les hackers piègent les intelligences artificielles en jouant sur leur architecture de traitement du langage et leur connexion aux données externes, pas en piratant le code source. Leur méthode, c’est surtout de manipuler les entrées (prompts) et d’empoisonner les données pour contourner les filtres de sécurité et pousser le modèle à révéler des infos ou à exécuter des commandes malveillantes. Techniques de manipulation des modèles Ceci est un contenu masqué, merci de Se connecter ou S’inscrire Citer Lien vers le commentaire Partager sur d’autres sites More sharing options...
Messages recommandés
Rejoindre la conversation
Vous pouvez publier maintenant et vous inscrire plus tard. Si vous avez un compte, connectez-vous maintenant pour publier avec votre compte.