Vue normale
-
WeLiveSecurity
-
Pourquoi les données de vos enfants représentent un risque durable d’usurpation d’identité ?
Quand on parle de cybersécurité et de sécurité numérique des enfants, le sujet est généralement abordé sous deux angles. Le premier concerne les contenus inappropriés ou dangereux, que la loi française cherche à mieux encadrer à travers la régulation des plateformes et les dispositifs de contrôle parental. Le second porte sur les effets psychologiques et sociaux d’un usage excessif des écrans. Pourtant, un risque majeur reste souvent sous-estimé.
-
Korben

-
JaiLIP - L'image piégée qui débride les IA qui voient
Md Jueal Mia et Hadi Amini, deux chercheurs de Florida International University , ont mis au point une méthode qu'ils ont baptisée JaiLIP qui permet de forger une image capable de contourner les garde-fous des LLM pour les jailbreaker. Pour cela, ils utilisent 2 techniques en simultanée. La première dit à l'image "reste identique à l'originale, qu'aucun humain ne voie la moindre différence" et la seconde dit "pousse le modèle à cracher la réponse interdite". Ainsi, en poussant ces 2 curseurs d'u
JaiLIP - L'image piégée qui débride les IA qui voient
Md Jueal Mia et Hadi Amini, deux chercheurs de Florida International University , ont mis au point une méthode qu'ils ont baptisée JaiLIP qui permet de forger une image capable de contourner les garde-fous des LLM pour les jailbreaker.
Pour cela, ils utilisent 2 techniques en simultanée. La première dit à l'image "reste identique à l'originale, qu'aucun humain ne voie la moindre différence" et la seconde dit "pousse le modèle à cracher la réponse interdite". Ainsi, en poussant ces 2 curseurs d'un coup, ils obtiennent une photo qui au premier abord a l'air normale mais qui fait dérailler les modèles IA.
Vous, vous repérez un chat, des contours, une scène et vous lui courez derrière pour lui faire des papouilles. L'IA, elle voit une grille de chiffres et des corrélations entre pixels. Du coup sa vie est nulle mais surtout, une retouche minuscule, totalement invisible à votre œil, suffit à déplacer ce qu'elle comprend de l'image.
Sur leurs tests, l'image trafiquée a quasiment doublé la part de réponses dangereuses par rapport à la même image laissée intacte, la toxicité étant mesurée avec des outils standards du domaine. Dans l'un de leurs exemples, ils ont trafiqué une image de signalisation routière qui a permis au modèle ensuite d'expliquer OKLM comment ignorer les règles de circulation et éviter les PV.
Les chercheurs ont testé l'attaque sur deux modèles vision-langage open source, BLIP-2 et MiniGPT-4. GPT-4V, Gemini et les autres gros modèles fermés, eux, n'ont pas été testés dans l'étude. Donc non, contrairement à ce que j'ai pu lire par ci et par là, ce n'est pas une faille prouvée dans ChatGPT ou peu importe l'assistant IA que vous utilisez tous les jours.
Et tromper une IA avec une image bricolée, ça existe depuis une bonne dizaine d'années. Mais la nouveauté de JaiLIP, c'est surtout sa recette d'optimisation. En jouant sur les deux pertes à la fois, l'image reste plus discrète à l'œil tout en se montrant un cran plus efficace que les bidouilles précédentes.
Et ce genre de détournement nous concerne tous parce que des modèles qui regardent des images, il y en a partout maintenant. Les agents IA qui bossent à partir de captures d'écran, les assistants à qui vous balancez vos photos, sans oublier la modération automatique qui trie les images avant publication. À cause de ça, l'image est dorénavant un canal d'attaque, exactement comme l'était déjà le texte...
On l'a vu avec le son inaudible qui pirate les assistants vocaux , on l'a vu avec les IA qu'on manipule sans qu'elles s'en aperçoivent , et c'est toujours la même logique qui revient. Ce n'est pas parce qu'en tant qu'humain, nous ne percevons rien, que l'IA elle n'est pas capable de capter le message 5/5.
Le cousin de cette attaque, côté perception, c'est par exemple le sticker qui trompe une voiture autonome . Et côté parade, nos chercheurs esquissent une piste légère : virer au hasard 10 à 30% des mots passés en entrée, histoire de casser l'attaque sans réentraîner le modèle.
Prometteur d'après eux, mais c'est pas encore une solution blindée. Pour le reste, leurs conseils tiennent du bon sens : Ne passez pas d'infos sensibles en image à un modèle, limitez qui peut envoyer des images à vos systèmes, et auditez sérieusement la sécurité avant de mettre un VLM en prod.
C'est pas le graal mais c'est mieux que rien. Bref méfiez vous des images que vous donnez à vos IA. On ne sait jamais.
Source : le papier JaiLIP sur arXiv
![]()
-
WeLiveSecurity
-
Mots de passe : quand “123456” suffit encore à accéder à un compte
Malgré les alertes, les mots de passe les plus simples restent massivement utilisés.
Mots de passe : quand “123456” suffit encore à accéder à un compte
-
WeLiveSecurity
-
Coupe du monde de football 2026 : de faux sites de la FIFA ciblent les supporters à la recherche de billets et de produits dérivés
Méfiez-vous des faux sites liés à la Coupe du Monde qui imitent les plateformes officielles de vente de billets et de merchandising afin de vous dérober de l’argent mais aussi des données personnelles.
Coupe du monde de football 2026 : de faux sites de la FIFA ciblent les supporters à la recherche de billets et de produits dérivés
-
WeLiveSecurity
-
CTRL + S : Cybermenaces : Dans les coulisses des grands événements cyber : ce qui inquiète vraiment les entreprises
En 2026, les risque cyber ne cessent d’évoluer, propulsés par le détournement de l’intelligence artificielle à des fins criminelles.
CTRL + S : Cybermenaces : Dans les coulisses des grands événements cyber : ce qui inquiète vraiment les entreprises
-
WeLiveSecurity
-
Brainrot : pourquoi les enfants parlent-ils tous ce langage venu du web ?
Le « brainrot » envahit la cour de récré virtuelle comme réelle. Comment s’y retrouver en tant que parent ?
Brainrot : pourquoi les enfants parlent-ils tous ce langage venu du web ?
-
WeLiveSecurity
-
CTRL + S : Cybermenaces : comment convaincre sa direction d’augmenter le budget sécurité ?
Selon une étude Proton, 1 PME sur 4 serait touchée par une cyberattaque malgré des investissements. Mais ceux-ci sont-ils vraiment suffisants ?
CTRL + S : Cybermenaces : comment convaincre sa direction d’augmenter le budget sécurité ?
-
WeLiveSecurity
-
Fuites de données : et si cette alerte était une arnaque ?
Ignorer une véritable notification de violation de données comporte des risques, mais se laisser piéger par une fausse alerte pourrait s'avérer bien pire. Réfléchissez avant de cliquer.
Fuites de données : et si cette alerte était une arnaque ?
-
WeLiveSecurity
-
CTRL + S : Hacking éthique : où est la ligne ? Du bug bounty à la divulgation responsable
Un épisode utile et qui saura, une fois de plus, vous convaincre que la cybersécurité impacte toutes les strates de l’entreprise.
CTRL + S : Hacking éthique : où est la ligne ? Du bug bounty à la divulgation responsable
-
WeLiveSecurity
-
Votre compte a été piraté ? Agissez rapidement avec ces conseils de nos experts
C’est votre capacité à réagir vite et bien qui peut faire toute la différence lors du piratage d’un compte en ligne.
Votre compte a été piraté ? Agissez rapidement avec ces conseils de nos experts
-
WeLiveSecurity
-
Votre gestionnaire de mots de passe est-il vraiment sécurisé ?
Découvrez comment les cybercriminels essaient de forcer votre coffre-fort numérique et comment protéger vos identifiants et précieux mots de passe.
Votre gestionnaire de mots de passe est-il vraiment sécurisé ?
-
WeLiveSecurity
-
CTRL + S : Cybersécurité managée : est-ce que le MDR vaut vraiment le coup ?
Le MDR : le monde de la cybersécurité n’a presque plus que cet acronyme à la bouche. Mais de quoi s’agit-il exactement et pourquoi ces services gérés sont-ils autant plébiscités par les entreprises en 2026 ?
CTRL + S : Cybersécurité managée : est-ce que le MDR vaut vraiment le coup ?
-
WeLiveSecurity
-
CTRL + S : La plus grande faille de votre cybersécurité ? Votre messagerie.
En entreprise, tous les collaborateurs ou presque possèdent une adresse de messagerie. Et c’est probablement pour cela que celle-ci est le départ de la plupart des attaques cyber !
CTRL + S : La plus grande faille de votre cybersécurité ? Votre messagerie.
-
WeLiveSecurity
-
CTRL + S : "Être chercheur en cybermenaces, ce n'est pas ce que vous pensez !"
A mesure que les menaces cyber s’intensifient, dopées à l’IA, les défis liés aux métiers de la cybersécurité se complexifient également, entre déficit de talent et épuisement professionnel. Pourtant, les carrières dans ce secteur sont en plein essor et promettent des missions passionnantes, à l’instar de notre invité.
CTRL + S : "Être chercheur en cybermenaces, ce n'est pas ce que vous pensez !"
-
WeLiveSecurity
-
Les mauvaises habitudes ont la peau dure : en 2025, les mots de passe les plus utilisés restent désespérément prévisibles
Une fois encore, les chiffres mettent en lumière une réalité peu rassurante : le réflexe de choisir des mots de passe extrêmement faciles à pirater demeure très répandu
Les mauvaises habitudes ont la peau dure : en 2025, les mots de passe les plus utilisés restent désespérément prévisibles
-
WeLiveSecurity
-
CTRL + S : EDR, MDR, XDR… On en parle beaucoup, mais à quoi ça sert vraiment ?
MDR, APT, NIS2, EDR, RGPD, SIEM, XDR... Les acronymes en cybersécurité sont légion. Et si on en débunkait simplement au moins 3, tout de suite, en vous expliquant pourquoi ils vous seront utiles dès maintenant ?
CTRL + S : EDR, MDR, XDR… On en parle beaucoup, mais à quoi ça sert vraiment ?
-
WeLiveSecurity
-
CTRL + S : Cyberattaque : se préparer, réagir, reconstruire
Pour les entreprises, il n’est plus questions de savoir si une attaque va survenir, mais plutôt quand.
CTRL + S : Cyberattaque : se préparer, réagir, reconstruire
-
WeLiveSecurity
-
CTRL + S : votre nouveau rendez-vous podcast cybersécurité !
CTRL + S, notre podcast inédit dédié à la cybersécurité en France pour les pros est enfin disponible sur toutes les plateformes d'écoute !
CTRL + S : votre nouveau rendez-vous podcast cybersécurité !
-
WeLiveSecurity
-
Credential stuffing : qu’est-ce que c’est et comment se protéger ?
Réutiliser ses mots de passe peut sembler anodin… jusqu’à ce qu’une seule fuite permette d’accéder à plusieurs de vos comptes.
Credential stuffing : qu’est-ce que c’est et comment se protéger ?
-
WeLiveSecurity
-
Roblox Executors : Tout est amusant jusqu’à ce que quelqu’un se fasse pirater
Cet article vous explique ce que sont ces outils, qu’on appelle aussi exécuteurs de scripts, triches ou hacks.