Saltar al contenido
FileTinker

Cómo eliminar el fondo de una imagen de forma gratuita sin tener que subirla.

Por el equipo de FileTinker7 min de lectura

La mayoría de las herramientas en línea para eliminar el fondo de las imágenes funcionan de la misma manera: subes tu foto a un servidor, una inteligencia artificial la procesa allí y luego descargas el resultado. Esto puede ser aceptable para un meme, pero no tanto para una foto de pasaporte, un retrato o una foto de tus hijos. Ahora existe una opción realmente diferente: ejecutar la inteligencia artificial dentro de tu navegador, de modo que la foto nunca salga de tu dispositivo. Esta guía explica cómo funciona, incluido el proceso de descarga del modelo, que puede generar desconfianza la primera vez que se ve, qué tipos de fotos procesa bien y cómo corregir los errores que pueda cometer la inteligencia artificial al definir los bordes.

¿Qué significa realmente la opción «no subir»?

Cuando una herramienta afirma que elimina el fondo de una imagen sin necesidad de subirla, esta afirmación puede verificarse. Todo lo que toca los píxeles de la imagen —la decodificación de la foto, la ejecución de la inteligencia artificial y el ensamblaje del archivo PNG final— se realiza en tu pestaña del navegador, en tu propio hardware. Abre el inspector de red de tu navegador mientras la herramienta está en funcionamiento y verás fluir los datos (la página y el modelo de inteligencia artificial), pero no verás que se envíe ninguna parte de tu imagen. La herramienta de eliminación de fondos de FileTinker funciona exactamente de esta manera: la foto se lee localmente, se procesa localmente y el resultado se genera localmente.

Esto es importante por razones obvias de privacidad (fotografías de rostro, fotos de identificación, fotos familiares), pero también por razones prácticas. No hay una cola de carga, no hay que esperar a que se libere el servidor de otra persona y no hay una copia de su imagen almacenada en la nube esperando a ser eliminada «después de una hora». La desventaja es que su dispositivo realiza el trabajo, por lo que la primera vez que se ejecuta el programa implica una descarga, que abordaremos en breve.

¿Cómo hace la IA para separar un objeto de su fondo?

El núcleo de la herramienta es una red neuronal llamada MODNet, un modelo de «matting». El «matting» se diferencia de su técnica más básica, la segmentación. Un modelo de segmentación responde con un sí o un no para cada píxel: objeto o fondo. En cambio, el «matting» estima la opacidad: a cada píxel se le asigna un valor de 0 (fondo puro) a 255 (objeto puro), y se permite cualquier valor intermedio. Ese rango intermedio es precisamente lo importante. Mechones de pelo, bordes difusos de un jersey y contornos ligeramente borrosos no son 100 % objeto ni 100 % fondo; son mezclas semitransparentes, y un «matte» puede representarlas.

El resultado del modelo se denomina «máscara alfa» y la herramienta la aplica de la manera más literal posible: el valor de la máscara de cada píxel se copia en el canal alfa (de transparencia) de un archivo PNG. Un píxel que el modelo califica con 255 permanece completamente opaco, un 0 se vuelve completamente transparente y un 128 se vuelve semitransparente, lo que permite que se vea lo que se coloque detrás de él. Por este motivo, una buena máscara se integra de forma natural en un nuevo fondo, en lugar de parecer un adhesivo recortado con tijeras.

Para poder ejecutar una red neuronal en un navegador, la herramienta utiliza transformers.js, la biblioteca de aprendizaje automático en JavaScript de Hugging Face. Prefiere WebGPU (el hardware de procesamiento de gráficos) cuando el navegador lo admite, y recurre a WebAssembly en la CPU cuando no es así. Ambas opciones producen el mismo resultado, pero WebGPU es más rápida.

Descarga el modelo: tu imagen se queda donde está, el modelo viene a ti.

La primera vez que utilice la herramienta, verá una barra de progreso con el rótulo «Descargando el modelo de IA». Esta es la parte que genera desconfianza, por lo que es importante ser preciso sobre lo que se está descargando y dónde. Su imagen no se está subiendo. Lo que se descarga son los datos del modelo MODNet, que representan entre cinco y veinticinco megabytes, dependiendo de su dispositivo, y que se descargan desde el CDN público de Hugging Face hasta su navegador. El flujo de datos es unidireccional y se trata del modelo, no de su foto.

Además, se trata de un costo único. Su navegador guarda en caché los datos descargados, por lo que en las visitas posteriores se reduce considerablemente el tiempo de espera y, durante una misma sesión, el modelo cargado se reutiliza para cada imagen que procese; por ejemplo, si elimina el fondo de una segunda foto, el proceso comenzará inmediatamente. En la primera ejecución, espere un breve tiempo mientras avanza el porcentaje. En todas las ejecuciones posteriores, solo tendrá que esperar el tiempo de procesamiento.

¿Qué tipo de imágenes funcionan mejor (para ser sincero: imágenes de personas)?

La instrucción que aparece en la herramienta al subir una imagen indica que «funciona mejor con personas», y esto no es una muestra de modestia, sino una consecuencia directa del modelo. MODNet se creó como un modelo de segmentación de retratos: se diseñó y entrenó para separar a las personas del fondo. En retratos, selfies y fotografías de estilo «foto de perfil», produce los resultados más precisos. Si se aplica a objetos aleatorios (productos, mascotas, muebles, alimentos), sigue funcionando, pero los resultados son menos precisos, ya que se le está pidiendo que trabaje fuera de su ámbito de especialización. No espere obtener recortes perfectos de una fotografía de producto o de un cabello complejo sobre un fondo con muchos elementos.

¿Por qué utilizar un modelo especializado en personas en lugar de un modelo de uso general? La licencia. MODNet tiene licencia Apache-2.0, lo que permite su uso seguro para cualquier propósito, incluido el trabajo comercial. Algunos de los modelos más amplios para eliminar fondos restringen su uso comercial. FileTinker tomó esa decisión deliberadamente: un modelo que se puede utilizar legalmente para las fotografías de perfil de su empresa es mejor que un modelo técnicamente más amplio que no se puede utilizar.

Dentro del rango de condiciones óptimas para el modelo, algunas fotos facilitan más su tarea que otras:

  • Un marcado contraste entre el sujeto y el fondo: una persona frente a una pared lisa es más impactante que una persona en medio de una multitud.
  • Una iluminación uniforme, sin sombras marcadas que oculten el contorno del sujeto.
  • Un tema en foco: los bordes nítidos son más fáciles de matizar que los borrosos.
  • Es mejor centrarse en un tema principal en lugar de tratar de abarcar a varias personas a la vez.
  • Cuando el cabello se fotografía sobre un fondo de color similar o con muchos elementos, es el caso más difícil; por lo tanto, es probable que sea necesario retocar la imagen.

Para corregir los bordes irregulares, utiliza las herramientas de borrado y restauración.

Ningún modelo de recorte es perfecto, por lo que la herramienta no pretende que el primer resultado de la IA sea definitivo. Después del procesamiento, el recorte aparece sobre un patrón de tablero de ajedrez, que es la forma estándar de mostrar la transparencia, y la vista previa se convierte en un lienzo editable. Se puede interactuar directamente con la imagen utilizando uno de los dos pinceles: Borrar elimina el fondo residual que el modelo no pudo eliminar, y Restaurar vuelve a pintar las partes del sujeto que se eliminaron incorrectamente, como una mano, el borde de un hombro o una sección del cabello.

El pincel es redondo y tiene bordes suaves: su intensidad es máxima en el centro y disminuye gradualmente hacia el borde, de modo que las pinceladas se integran en el borde existente en lugar de crear círculos marcados. Su tamaño es ajustable, desde 6 hasta 120 píxeles: puede usarlo grande para eliminar una gran zona de cielo que haya quedado sin pintar o pequeño para trazar el contorno de la mandíbula. Un botón de «Restablecer» elimina todas las pinceladas y vuelve a la imagen original generada por la IA, lo que le permite experimentar sin riesgo.

La herramienta «Restaurar» funciona gracias a un detalle importante que vale la pena comprender. En una imagen PNG transparente, un píxel completamente transparente pierde su información de color; ya no queda nada que se pueda recuperar. La herramienta soluciona este problema manteniendo una copia intacta de los píxeles de la foto original en la memoria, junto con la máscara editable. Al restaurar, no se adivinan los colores; en cambio, se revelan los píxeles reales que siempre estuvieron presentes. Esto solo es posible porque la edición se realiza en el mismo lugar donde aún existe la imagen original: en su navegador.

Qué descargas y qué puedes hacer con ello.

El resultado es un archivo PNG con las mismas dimensiones en píxeles que el original, con el efecto mate aplicado en su canal alfa, guardado con el nombre del archivo original y añadiendo «-no-bg.png» al final. PNG es el formato adecuado porque es el más utilizado y ofrece una transparencia completa de 8 bits. Mantenga el archivo en formato PNG mientras siga trabajando con él: si lo convierte a JPG, la transparencia se perderá, ya que JPG no tiene canal alfa y los convertidores aplanan las áreas transparentes sobre un color sólido, generalmente blanco, lo que le devolverá al punto de partida.

En cuanto a los archivos de entrada, la herramienta acepta formatos como JPG, PNG, WebP y otros, incluidos los archivos HEIC de iPhone y los archivos TIFF, que convierte internamente antes de que el modelo los procese. Una vez que hayas realizado el recorte, el siguiente paso habitual es adaptarlo a un propósito específico: recórtalo en forma cuadrada o circular para usarlo como foto de perfil (la herramienta de recorte de imágenes de FileTinker también lo hace directamente en el navegador) o insértalo en un nuevo fondo en cualquier editor que admita capas. Hasta ahora, todo se ha realizado en tu dispositivo; por lo tanto, es recomendable que también realices las ediciones posteriores allí.

Preguntas frecuentes

¿Se guarda mi foto cuando elimino el fondo?

No. La herramienta «Eliminar fondo» de FileTinker ejecuta el modelo de inteligencia artificial dentro de tu navegador, utilizando WebGPU o WebAssembly. Tu imagen se decodifica, procesa y vuelve a codificar localmente en tu dispositivo. Lo único que se descarga es el propio modelo de inteligencia artificial; tu foto nunca se envía a un servidor.

¿Por qué la herramienta descarga primero un modelo de inteligencia artificial?

La red neuronal que separa el sujeto del fondo (MODNet) debe estar instalada en tu dispositivo para que pueda funcionar en él. La primera vez que se utiliza, la herramienta descarga los parámetros del modelo (aproximadamente entre 5 y 25 MB, según el dispositivo) desde el CDN público de Hugging Face, muestra una barra de progreso y tu navegador los guarda en la memoria caché para que las ejecuciones posteriores no tengan que esperar a que se descarguen. Tu foto nunca forma parte de esa transferencia.

¿Por qué la eliminación del fondo funciona mejor en las fotografías de personas?

Esta herramienta utiliza MODNet, un modelo de segmentación diseñado y entrenado específicamente para retratos. En las imágenes de personas, genera recortes limpios con bordes suaves; en las imágenes de productos, mascotas y otros objetos, también funciona, pero con menor precisión. Se eligió porque su licencia Apache 2.0 garantiza que los resultados se puedan utilizar de forma segura con fines comerciales, a diferencia de algunos modelos más generales de eliminación de fondos.

¿Qué formato tiene el recorte y conserva la resolución original?

Obtendrás un archivo PNG con las mismas dimensiones en píxeles que la imagen original, y el fondo eliminado se guardará como transparencia real en el canal alfa. Mantén el archivo en formato PNG mientras trabajas con él: convertirlo a JPG destruye la transparencia, ya que el formato JPG no tiene canal alfa y las áreas transparentes se rellenan con un color sólido, generalmente blanco.

¿Puedo corregir las áreas en las que la IA se equivocó?

Sí. Tras el procesamiento, la vista previa se convierte en un lienzo editable con dos pinceles: «Borrar» elimina los restos del fondo y «Restaurar» vuelve a pintar las partes del objeto que se recortaron incorrectamente. El pincel tiene bordes difuminados y se puede ajustar de 6 a 120 píxeles, y un botón de «Restablecer» permite volver al recorte original realizado por la IA en cualquier momento.

¿Funcionará con las fotos de los productos?

Lo intentará, y las tomas sencillas con un fuerte contraste entre el sujeto y el fondo pueden resultar aceptables, pero espere que los bordes sean menos definidos que en un retrato, ya que el modelo está optimizado para fotografiar personas. Tenga en cuenta que necesitará dedicar un minuto a utilizar las herramientas de borrado y restauración, y no espere obtener resultados perfectos como los de un estudio fotográfico con productos complejos o detalles minuciosos.