Aller au contenu
FileTinker

Comment supprimer l’arrière-plan d’une image gratuitement, sans l’envoyer sur un serveur.

Par l’équipe FileTinker7 min de lecture

La plupart des outils en ligne qui permettent de supprimer l’arrière-plan des photos fonctionnent de la même manière : vous téléchargez votre photo sur un serveur, une IA la traite, puis vous téléchargez le résultat. C’est acceptable pour créer un mème, mais moins idéal pour une photo d’identité, un portrait ou une photo de vos enfants. Il existe désormais une option véritablement différente : exécuter l’IA directement dans votre navigateur, de sorte que la photo ne quitte jamais votre appareil. Ce guide explique comment cela fonctionne, y compris le téléchargement du modèle, qui peut susciter la méfiance la première fois que les utilisateurs le voient, ainsi que les types de photos pour lesquels il fonctionne bien et la manière de retoucher les bords où l’IA se trompe.

Que signifie réellement l'expression « pas d'envoi » ?

Lorsqu’un outil affirme qu’il supprime l’arrière-plan sans nécessiter de téléchargement, cette affirmation peut être vérifiée. Toutes les opérations qui affectent vos pixels – le décodage de la photo, l’exécution de l’IA, l’assemblage du fichier PNG final – se déroulent dans l’onglet de votre navigateur, sur votre propre matériel. Ouvrez l’inspecteur réseau de votre navigateur pendant l’exécution de l’outil, et vous constaterez que des données sont transmises (la page et le modèle d’IA), mais qu’aucune donnée de votre image n’est envoyée. L’outil de suppression d’arrière-plan de FileTinker fonctionne exactement de cette manière : la photo est lue localement, traitée localement et le résultat est généré localement.

Cela est important pour des raisons évidentes de confidentialité – photos de profil, photos d’identité, photos de famille – mais aussi pour des raisons pratiques. Il n’y a pas de file d’attente de téléchargement, pas besoin d’attendre que le serveur d’une autre personne soit disponible, et aucune copie de votre image n’est stockée dans le cloud en attendant d’être supprimée « après une heure ». L’inconvénient est que c’est votre appareil qui effectue le travail, ce qui explique pourquoi la première exécution implique un téléchargement dont nous parlerons dans un instant.

Comment l’IA isole un sujet de son arrière-plan.

L’élément central de cet outil est un réseau neuronal appelé MODNet, un modèle de « matting ». Le « matting » se distingue de la segmentation, qui est une technique plus rudimentaire. Un modèle de segmentation répond par oui ou par non pour chaque pixel : s’agit-il du sujet ou de l’arrière-plan ? Le « matting », quant à lui, estime l’opacité : chaque pixel reçoit une valeur allant de 0 (arrière-plan pur) à 255 (sujet pur), avec toutes les valeurs intermédiaires possibles. Cette plage de valeurs intermédiaires est précisément l’intérêt de la technique. Les mèches de cheveux, les bords flous d’un pull en laine et les contours légèrement estompés ne sont ni à 100 % du sujet, ni à 100 % de l’arrière-plan ; ce sont des mélanges semi-transparents, et un « matte » peut les représenter.

Le résultat du modèle est appelé « masque alpha », et l’outil l’applique de la manière la plus littérale possible : la valeur du masque de chaque pixel est copiée dans le canal alpha (transparence) d’un fichier PNG. Un pixel dont le modèle a attribué une valeur de 255 reste complètement opaque, une valeur de 0 devient complètement transparente, et une valeur de 128 devient semi-transparente, ce qui permet à ce qui se trouve derrière de transparaître. C’est pourquoi un bon masque s’intègre naturellement dans un nouvel arrière-plan, au lieu de ressembler à un autocollant découpé aux ciseaux.

Pour exécuter un réseau neuronal dans un navigateur, l’outil utilise transformers.js, la bibliothèque d’apprentissage automatique en JavaScript de Hugging Face. Il privilégie WebGPU (votre matériel graphique) lorsque le navigateur le prend en charge, et utilise WebAssembly sur le processeur lorsque ce n’est pas le cas. Les deux produisent le même résultat, mais WebGPU est plus rapide.

Téléchargement du modèle : votre image reste en place, c’est le modèle qui vient à vous.

La première fois que vous utilisez l’outil, vous verrez une barre de progression intitulée « Téléchargement du modèle d’IA ». C’est cet élément qui peut susciter des interrogations, il est donc important de préciser ce qui est téléchargé et où. Votre image, elle, n’est envoyée nulle part. Ce qui est téléchargé, ce sont les données du modèle MODNet, soit environ cinq à vingt-cinq mégaoctets de données numériques, en fonction de votre appareil, et qui proviennent du CDN public de Hugging Face pour être transférées vers votre navigateur. Le transfert de données est unidirectionnel, et c’est le modèle qui est téléchargé, et non votre photo.

Il s’agit également d’un coût unique. Votre navigateur met en cache les données téléchargées, de sorte que lors des visites ultérieures, la plupart du temps d’attente est supprimé, et au cours d’une même session, le modèle chargé est réutilisé pour chaque image que vous traitez : supprimez l’arrière-plan d’une deuxième photo et le processus démarre immédiatement. Lors de la première utilisation, prévoyez un court temps d’attente pendant que le pourcentage augmente. Pour chaque utilisation suivante, seul le temps de traitement est nécessaire.

Quelles images fonctionnent le mieux (honnêtement : les gens)

L’indication fournie dans l’outil concernant le téléchargement indique que « le résultat est optimal sur les portraits », et il ne s’agit pas d’une simple affirmation pour faire bonne impression, mais d’une conséquence directe du modèle. MODNet a été conçu comme un modèle de détourage pour portraits : il a été développé et entraîné pour séparer les personnes de l’arrière-plan. Il produit les meilleurs résultats sur les portraits, les selfies et les photos de profil. Lorsqu’il est appliqué à des objets quelconques (produits, animaux de compagnie, meubles, aliments), il fonctionne toujours, mais les résultats sont moins précis, car on lui demande de fonctionner en dehors de son domaine de spécialisation. Ne vous attendez pas à obtenir des détourages parfaits, dignes d’un studio, pour une photo de produit ou pour des cheveux complexes sur un arrière-plan chargé.

Pourquoi utiliser un modèle spécialisé pour les portraits plutôt qu’un modèle généraliste ? La question des licences. MODNet est sous licence Apache 2.0, ce qui le rend sûr à utiliser pour n’importe quel usage, y compris à des fins commerciales. Certains des modèles plus généraux pour la suppression d’arrière-plan restreignent l’utilisation commerciale. FileTinker a délibérément fait ce choix : un modèle que vous pouvez utiliser légalement pour les photos de profil de votre entreprise est préférable à un modèle plus performant sur le plan technique, mais dont l’utilisation est limitée.

Dans la zone de confort du modèle, certaines photos lui facilitent davantage la tâche que d’autres :

  • Fort contraste entre le sujet et l’arrière-plan : une personne se démarque sur un mur uni, alors qu’elle se fondrait dans la foule.
  • Un éclairage uniforme, sans ombres profondes qui masqueraient les contours du sujet.
  • Un point à retenir : les bords nets sont plus faciles à masquer que les bords flous.
  • Il vaut mieux se concentrer sur un sujet principal plutôt que sur plusieurs personnes se chevauchant.
  • Les cheveux qui se détachent sur un fond de couleur similaire ou sur un fond chargé sont les plus difficiles à retoucher : prévoyez de devoir y apporter des corrections.

Pour corriger les imperfections et les contours irréguliers, utilisez les outils de suppression et de restauration.

Aucun modèle de détourage n’est parfait, et l’outil ne prétend donc pas que la première passe de l’IA est définitive. Après le traitement, l’élément détouré apparaît sur un motif à damier, qui est la méthode standard pour indiquer la transparence, et l’aperçu devient une zone de travail modifiable. Vous pouvez directement manipuler l’image à l’aide de l’un des deux pinceaux : le pinceau « Effacer » permet de supprimer les restes d’arrière-plan que le modèle a manqués, et le pinceau « Restaurer » permet de repeindre les parties du sujet qui ont été supprimées par erreur, comme une main, le bord d’une épaule ou une mèche de cheveux.

Le pinceau est rond, avec des bords doux : il est très efficace au centre, puis s’estompe progressivement jusqu’à disparaître sur les bords, ce qui permet aux traits de se fondre dans le contour existant au lieu de créer des cercles marqués. Sa taille est réglable, de 6 à 120 pixels : utilisez une taille importante pour effacer une grande zone de ciel restante, ou une taille réduite pour tracer le contour d’une mâchoire. Un bouton « Réinitialiser » permet de supprimer tous les traits et de revenir à la texture de base générée par l’IA, ce qui vous permet d’expérimenter sans risque.

L’outil « Restore » fonctionne grâce à un détail qu’il est important de comprendre. Dans une image PNG transparente, un pixel totalement transparent perd ses informations de couleur ; il ne reste plus rien à restaurer. L’outil contourne ce problème en conservant une copie intacte des pixels de votre photo originale dans la mémoire, en parallèle avec le masque modifiable. La restauration ne se base pas sur des suppositions concernant les couleurs ; elle révèle les pixels réels qui étaient présents depuis le début. Cela n’est possible que parce que la modification a lieu au même endroit où se trouve encore l’image originale : votre navigateur.

Ce que vous téléchargez et comment l’utiliser.

Le résultat est un fichier PNG dont les dimensions en pixels sont exactement celles de l’image d’origine, avec l’opacité intégrée dans son canal alpha. Le fichier est enregistré sous le nom de votre fichier, avec le suffixe « -no-bg.png ». Le format PNG est le plus approprié, car c’est le format le plus largement pris en charge et qui offre une transparence complète sur 8 bits. Conservez le fichier au format PNG tant que vous travaillez dessus : si vous le convertissez en JPG, la transparence sera perdue, car le format JPG ne dispose pas de canal alpha et les convertisseurs aplatissent les zones transparentes en une couleur unie, généralement blanche, ce qui vous ramène au point de départ.

En ce qui concerne les fichiers d’entrée, l’outil accepte les formats JPG, PNG, WebP et d’autres encore, notamment les photos HEIC prises avec l’iPhone et les fichiers TIFF, qu’il convertit en interne avant qu’ils ne soient utilisés par le modèle. Une fois que vous avez isolé l’élément souhaité, l’étape suivante consiste généralement à l’adapter à un usage spécifique : vous pouvez le recadrer en forme carrée ou circulaire pour l’utiliser comme photo de profil (l’outil de recadrage d’images de FileTinker le fait également directement dans le navigateur), ou le placer sur un nouvel arrière-plan dans n’importe quel éditeur qui prend en charge les calques. Jusqu’à présent, toutes les opérations se sont déroulées sur votre appareil ; il est donc conseillé de conserver les modifications suivantes sur cet appareil.

Questions fréquentes

Ma photo est-elle envoyée quelque part lorsque je supprime son arrière-plan ?

Non. L’outil « Supprimer l’arrière-plan » de FileTinker exécute le modèle d’IA directement dans votre navigateur à l’aide de WebGPU ou de WebAssembly. Votre image est décodée, traitée et réencodée localement sur votre appareil. Seul le modèle d’IA est téléchargé ; votre photo n’est jamais envoyée à un serveur.

Pourquoi l’outil télécharge-t-il d’abord un modèle d’IA ?

Le réseau neuronal qui permet de séparer le sujet de l’arrière-plan (MODNet) doit être installé sur votre appareil pour pouvoir y être utilisé. Lors de la première utilisation, l’outil télécharge les paramètres du modèle – environ 5 à 25 Mo, selon votre appareil – à partir du CDN public de Hugging Face, affiche une barre de progression, et votre navigateur les met en cache afin que les utilisations ultérieures ne nécessitent pas d’attente. Votre photo ne fait jamais partie de ce transfert.

Pourquoi l’effacement de l’arrière-plan est-il plus efficace sur les photos de personnes?

Cet outil utilise MODNet, un modèle de détourage conçu et entraîné spécifiquement pour les portraits. Sur les personnes, il produit des découpes nettes aux contours adoucis ; sur les produits, les animaux et autres objets, il fonctionne toujours, mais avec moins de précision. Il a été choisi en raison de sa licence Apache 2.0, qui garantit que les résultats peuvent être utilisés à des fins commerciales, contrairement à certains modèles plus généraux de suppression d’arrière-plan.

Quel est le format de l’image découpée, et conserve-t-elle la résolution d’origine ?

Vous obtiendrez une image PNG avec les mêmes dimensions en pixels que l’image d’origine, et l’arrière-plan supprimé sera enregistré sous forme de transparence réelle dans le canal alpha. Conservez-la au format PNG pendant que vous la modifiez : la convertir au format JPG détruira la transparence, car le format JPG ne possède pas de canal alpha et les zones transparentes seront remplacées par une couleur unie, généralement blanche.

Est-ce que je peux corriger les erreurs commises par l’IA ?

Oui. Une fois le traitement effectué, l’aperçu devient une zone de travail modifiable dotée de deux outils : « Effacer » permet de supprimer les éléments d’arrière-plan restants, et « Restaurer » permet de repeindre les parties du sujet qui ont été coupées par erreur. L’outil est doté de bords adoucis et sa taille est réglable, allant de 6 à 120 pixels. Un bouton « Réinitialiser » permet de revenir à la découpe originale effectuée par l’IA à tout moment.

Est-ce que cela fonctionnera sur les photos de produits ?

Il tentera de le faire, et des prises de vue simples avec un fort contraste entre le sujet et l'arrière-plan peuvent donner des résultats utilisables, mais attendez-vous à des bords plus rugueux que sur un portrait, car le modèle est réglé pour les personnes. Prévoyez de passer une minute avec les pinceaux Effacer et Restaurer, et ne vous attendez pas à des résultats parfaits de studio pour des produits complexes ou des détails fins.