Como remover o fundo de uma imagem gratuitamente, sem precisar enviá-la.
Pela equipe FileTinker7 min de leitura
A maioria dos removedores de fundo online funciona da mesma maneira: você carrega sua foto para um servidor, uma IA a processa ali e você baixa o resultado. Isso pode ser adequado para um meme, mas não tanto para uma foto de passaporte, um retrato ou uma foto de seus filhos. Agora, existe uma opção genuinamente diferente: executar a IA dentro do seu navegador, para que a foto nunca saia do seu dispositivo. Este guia explica como isso funciona — incluindo o download do modelo, que pode gerar desconfiança na primeira vez que as pessoas o veem —, quais fotos ele processa bem e como corrigir as imperfeições nas bordas que a IA pode cometer.
O que significa, na prática, a opção "não permitir envio".
Quando uma ferramenta afirma remover o fundo de uma imagem sem precisar que o usuário a envie, essa afirmação pode ser verificada. Tudo o que interage com os pixels da imagem — a decodificação da foto, a execução da inteligência artificial e a criação do arquivo PNG final — acontece na aba do navegador, no próprio hardware do usuário. Abra o inspetor de rede do navegador enquanto a ferramenta estiver em execução e você verá os dados sendo transferidos (a página e o modelo de IA), mas nenhuma parte da imagem sendo enviada. A ferramenta Remove Background do FileTinker funciona exatamente dessa maneira: a foto é lida localmente, processada localmente e o resultado é gerado localmente.
Isso é importante por motivos óbvios de privacidade — fotos de rosto, fotos de documentos de identificação, fotos de família —, mas também por motivos práticos. Não há fila de upload, não é preciso esperar que o servidor de outra pessoa processe os dados e não há uma cópia da sua imagem armazenada na nuvem, aguardando para ser excluída “após uma hora”. A desvantagem é que o seu dispositivo faz todo o trabalho, e é por isso que a primeira execução envolve um download, que abordaremos em breve.
Como a IA separa um objeto do seu plano de fundo
O núcleo da ferramenta é uma rede neural chamada MODNet, um modelo de recorte de imagem. O recorte de imagem difere de sua versão mais básica, a segmentação. Um modelo de segmentação responde a uma pergunta do tipo sim ou não para cada pixel: objeto ou fundo. O recorte de imagem, em vez disso, estima a opacidade: cada pixel recebe um valor de 0 (fundo puro) a 255 (objeto puro), com todos os valores intermediários permitidos. Essa faixa intermediária é o ponto principal. Mechas de cabelo, bordas de suéteres com aspecto felpudo e contornos ligeiramente borrados não são 100% objeto ou 100% fundo — são misturas semitransparentes, e um recorte de imagem pode representar isso.
A saída do modelo é chamada de máscara alfa, e a ferramenta a aplica da forma mais literal possível: o valor da máscara de cada pixel é copiado para o canal alfa (transparência) de um arquivo PNG. Um pixel que o modelo avaliou com 255 permanece totalmente opaco, um valor de 0 se torna totalmente transparente e um valor de 128 se torna semi-transparente, permitindo que qualquer elemento que você coloque atrás dele fique visível. É por isso que uma boa máscara se integra naturalmente a um novo fundo, em vez de parecer um adesivo recortado com tesoura.
Para executar uma rede neural em um navegador, a ferramenta utiliza a biblioteca transformers.js, uma biblioteca de aprendizado de máquina em JavaScript da Hugging Face. Ela prefere usar o WebGPU — o hardware gráfico do seu dispositivo — quando o navegador o suporta, e, caso contrário, recorre ao WebAssembly na CPU. Ambos produzem o mesmo resultado; o WebGPU é apenas mais rápido.
Baixe o modelo: sua imagem permanece no lugar, o modelo é enviado para você.
Na primeira vez que você usar a ferramenta, verá uma barra de progresso com a legenda “Fazendo download do modelo de IA”. É essa parte que pode gerar desconfiança, por isso é importante ser preciso sobre o que está sendo transferido e para onde. Sua imagem não está sendo enviada. O que está sendo baixado são os dados do modelo MODNet — aproximadamente de cinco a vinte e cinco megabytes de dados numéricos, dependendo do seu dispositivo — provenientes do CDN público da Hugging Face e enviados para o seu navegador. O tráfego é unidirecional, e o que está sendo transferido é o modelo, não a sua foto.
Além disso, é um custo único. O navegador armazena em cache os dados baixados, de modo que, em visitas posteriores, a maior parte do tempo de espera é eliminada, e, em uma única sessão, o modelo carregado é reutilizado para cada imagem que você processa — remova o fundo de uma segunda foto e o processo será iniciado imediatamente. Na primeira execução, espere um curto período de tempo enquanto a porcentagem aumenta. Em todas as execuções subsequentes, apenas o tempo de processamento será necessário.
Que imagens funcionam melhor (sinceramente: pessoas)?
A dica de uso da ferramenta diz: "funciona melhor em pessoas", e isso não é apenas uma demonstração de modéstia – é uma consequência direta do modelo. O MODNet foi desenvolvido como um modelo de recorte de retrato: projetado e treinado para separar pessoas do fundo. Em retratos, selfies e fotos no estilo de foto de perfil, ele produz os recortes mais precisos. Em objetos arbitrários – produtos, animais de estimação, móveis, alimentos –, ele ainda funciona, mas os resultados são menos precisos, porque está sendo solicitado a trabalhar fora de sua área de especialização. Não espere recortes perfeitos de uma foto de produto ou de cabelos complexos em um fundo movimentado.
Por que usar um modelo especializado em pessoas em vez de um modelo de uso geral? Questões de licenciamento. O MODNet possui licença Apache-2.0, o que o torna seguro para uso em qualquer contexto, incluindo trabalhos comerciais. Alguns dos modelos mais amplos de remoção de fundo restringem o uso comercial. A FileTinker fez essa escolha de forma consciente: um modelo que você pode usar legalmente para as fotos de perfil da sua empresa é melhor do que um modelo tecnicamente mais abrangente que você não pode usar.
Dentro da faixa de conforto do modelo, algumas fotos ainda facilitam mais o trabalho do que outras:
- Forte contraste entre o objeto principal e o fundo — uma pessoa em frente a uma parede lisa se destaca mais do que uma pessoa em meio a uma multidão.
- Iluminação uniforme, sem sombras profundas que obscureçam o contorno do objeto.
- Um assunto em foco: bordas nítidas são muito mais fáceis de recortar com precisão do que bordas borradas.
- Um único assunto principal, em vez de várias pessoas sobrepostas.
- Fotografar cabelos em um fundo de cor semelhante ou em um ambiente desordenado é o cenário mais desafiador — prepare-se para fazer ajustes na imagem.
Corrigindo imperfeições e áreas irregulares com as ferramentas de borracha e de restauração
Nenhum modelo de recorte é perfeito, portanto, a ferramenta não pretende que a primeira etapa da IA seja a versão final. Após o processamento, o recorte aparece sobre um padrão quadriculado — a forma padrão de indicar transparência — e a pré-visualização se transforma em uma tela editável. Você pode arrastar diretamente sobre a imagem usando um dos dois pincéis: o pincel "Apagar" remove o restante do fundo que o modelo não conseguiu eliminar, e o pincel "Restaurar" repinta as partes do objeto que foram removidas incorretamente — uma mão, a borda de um ombro, uma parte do cabelo.
O pincel é redondo e tem bordas suaves — com intensidade máxima no centro, que diminui gradualmente até desaparecer na extremidade —, de modo que os traços se misturam à borda existente, em vez de criar círculos marcados. Seu tamanho pode ser ajustado de 6 a 120 pixels: use um tamanho maior para limpar uma grande área do céu que sobrou e um tamanho menor para traçar ao longo da linha da mandíbula. Um botão de "Redefinir" apaga todos os seus traços e retorna à imagem original gerada pela IA, para que você possa experimentar sem riscos.
O pincel “Restaurar” funciona devido a um detalhe importante que vale a pena entender. Em uma imagem PNG transparente, um pixel totalmente transparente perde suas informações de cor — não há mais nada que possa ser recuperado. A ferramenta contorna esse problema mantendo uma cópia inalterada dos pixels da foto original na memória, juntamente com a máscara editável. A restauração não tenta adivinhar as cores; ela revela os pixels reais que sempre estiveram ali. Isso só é possível porque a edição ocorre no mesmo local onde a imagem original ainda existe: o seu navegador.
O que você baixa e o que fazer com isso
O resultado é um arquivo PNG com as mesmas dimensões em pixels da imagem original, com a informação de opacidade (matte) gravada em seu canal alfa, salvo com o nome do arquivo original seguido de "-no-bg.png". O formato PNG é o mais adequado porque é o formato mais amplamente compatível e oferece transparência total de 8 bits. Mantenha o arquivo no formato PNG enquanto você ainda estiver trabalhando nele: se você o converter para JPG, a transparência será perdida, pois o JPG não possui canal alfa e os conversores achatam as áreas transparentes, transformando-as em uma cor sólida, geralmente branca, o que o fará retornar ao ponto de partida.
No que diz respeito à entrada de dados, a ferramenta aceita arquivos JPG, PNG, WebP e outros, incluindo fotos HEIC de iPhone e arquivos TIFF, que são convertidos internamente antes de serem processados pelo modelo. Depois de obter o recorte desejado, o próximo passo é adaptá-lo a um determinado uso: recorte-o em formato quadrado ou circular para usá-lo como foto de perfil — a ferramenta de recorte de imagens do FileTinker também faz isso diretamente no navegador — ou insira-o em um novo plano de fundo em qualquer editor que suporte camadas. Até agora, tudo tem sido feito no seu dispositivo; vale a pena manter as edições subsequentes também nesse local.