跳到主要內容
FileTinker

如何在不將圖片上傳的情況下,免費移除圖片背景?

由 FileTinker 團隊撰寫閱讀時間 7 分鐘

大多數線上背景移除工具的運作方式都相同:您將照片上傳到伺服器,人工智慧會在伺服器上處理照片,然後您下載處理後的結果。對於製作網路迷因來說,這種方式還算不錯;但如果用於製作護照照片、個人頭像或孩子們的照片,效果可能就差強人意了。現在,有一個截然不同的選擇:將人工智慧程式碼直接在您的瀏覽器中執行,這樣照片就不會離開您的裝置。本指南將解釋其運作方式——包括模型下載的過程,這可能會讓使用者在第一次看到時感到有些疑慮——以及它擅長處理哪些照片,以及如何修正人工智慧處理不佳的邊緣部分。

「不允許上傳」實際上是什麼意思?

當某個工具宣稱它可以移除背景,而無需上傳圖片時,這項宣稱是可以驗證的。所有與您的像素相關的操作——解碼照片、執行人工智慧演算法、組裝最終的 PNG 檔案——都發生在您的瀏覽器分頁中,並使用您自己的硬體。在該工具執行時,開啟您瀏覽器的網路檢測工具,您會看到資料向下傳輸(包括網頁和人工智慧模型),但沒有任何您的圖片資料向上傳輸。FileTinker 的「移除背景」工具就是以這種方式運作:照片會在本地讀取、在本地處理,並且結果也會在本地產生。

這點很重要,原因在於明顯的隱私考量——例如人像照、身分證照片、家庭照片等等,同時也涉及實用性。它沒有上傳佇列,也不需要等待其他人的伺服器,而且您的圖片不會儲存在雲端空間中,等待「一小時後」被刪除。不過,這表示您的裝置需要執行相關作業,這也是為什麼第一次執行時需要下載,我們稍後會詳細說明。

人工智慧如何將主體與背景分開?

這個工具的核心是一個名為 MODNet 的神經網路,它是一種遮罩模型。遮罩與其較為粗糙的表親——分割模型有所不同。分割模型會針對每個像素回答一個「是」或「否」的問題:是前景還是背景。而遮罩模型則會估算不透明度:每個像素都會獲得一個從 0(純背景)到 255(純前景)的值,中間的數值都是允許的。這個中間範圍就是重點所在。例如,飄逸的頭髮、毛茸茸的毛衣邊緣,以及稍微模糊的輪廓,並非 100% 的前景或 100% 的背景——它們是半透明的混合物,而遮罩模型可以呈現這種效果。

模型輸出的結果稱為「Alpha遮罩」,該工具會以最直接的方式應用它:每個像素的遮罩值都會複製到 PNG 圖像的 Alpha(透明度)通道中。模型評分為 255 的像素會保持完全不透明,評分為 0 的像素會變成完全透明,評分為 128 的像素則會變成半透明,讓您放置在其後方的任何內容都能透顯出來。這就是為什麼好的遮罩可以自然地與新的背景合成,而不是看起來像用剪刀剪下來的貼紙。

為了讓神經網路能在瀏覽器中運作,這個工具使用了 transformers.js,這是 Hugging Face 的 JavaScript 機器學習函式庫。如果瀏覽器支援,它會優先使用 WebGPU(您的圖形硬體);如果瀏覽器不支援,則會改用 CPU 上的 WebAssembly。兩者都能產生相同的結果,只是 WebGPU 的速度更快。

模型下載:您的圖片原地不動,模型主動向您靠近。

首次使用此工具時,您會看到標示為「正在下載 AI 模型」的進度列。這部分常讓人產生疑慮,因此有必要精確說明資料的流向:您的影像並未上傳。下載的是 MODNet 模型的權重,大小約為 5 至 25 MB,具體取決於您的裝置,這些資料來自 Hugging Face 的公共 CDN,直接傳輸至您的瀏覽器。流量為單向傳輸,且傳輸的是模型本身,而非您的照片。

這也是一次性的費用。您的瀏覽器會快取下載的權重,因此之後的瀏覽時,大部分的等待時間都會被省略,而且在單次使用期間,已載入的模型會被重複用於處理您提供的每一張圖片——例如,從第二張照片中移除背景,系統就會立即開始處理。第一次執行時,您可能會需要等待一小段時間,直到進度百分比達到 100%。之後每次執行,只需要處理時間即可。

哪些圖片效果最好(老實說:是人物照)

該工具上的提示訊息寫著「最適合用於人物」,這並非謙虛之詞,而是模型本身的直接結果。MODNet 是一款專為人物圖像分割而設計的模型:它經過設計和訓練,旨在將人物從背景中分離出來。在人物照片、自拍照和個人檔案照片等圖像中,它能產生最精確的分割效果。即使是對於其他隨意的物體——例如產品、寵物、家具、食物——它仍然可以運作,但結果的精確度會降低,因為它被要求處理超出其專長範圍的任務。請不要期望它能完美地將產品照片或複雜髮型從雜亂的背景中精準地分離出來。

為什麼要使用專為人物設計的模型,而不是通用型模型?原因在於授權。MODNet 採用 Apache-2.0 授權,這表示您可以安全地將其用於任何用途,包括商業用途。有些更廣泛的背景移除模型會限制商業用途。FileTinker 明確地做出了這樣的選擇:一個您可以合法用於公司頭像的模型,勝過一個技術上更廣泛,但您無法合法使用的模型。

在模型的舒適範圍內,有些照片仍然比其他照片更容易讓模型處理:

  • 主體與背景之間形成強烈對比——在素牆前的一個人,勝過在人群中的一個人。
  • 光線均勻,沒有深邃的陰影遮蔽物體的輪廓。
  • 重點在於:清晰的邊緣比模糊的邊緣更容易進行去背處理。
  • 一個主要主體,而不是多個相互重疊的人物。
  • 在與頭髮顏色相近或雜亂的背景中處理頭髮是最困難的情況,因此請預留時間進行修飾。

使用「橡皮擦」和「修復」畫筆來修飾粗糙的邊緣。

沒有任何模型都能完美地進行物件遮罩,因此這款工具不會假裝 AI 的第一次處理就是最終結果。處理完畢後,遮罩後的物件會顯示在一種棋盤圖案上——這是顯示透明度的標準方式——並且預覽會變成一個可編輯的畫布。您可以直接在圖像上使用兩種畫筆中的一種進行操作:橡皮擦會刪除模型遺漏的剩餘背景,而「還原」畫筆則會重新塗抹模型錯誤移除的主體部分——例如一隻手、肩膀的邊緣或一撮頭髮。

畫筆的形狀是圓形的,邊緣柔軟——中心部分筆觸強勁,向外逐漸變淡,直至邊緣消失——因此,筆觸會與現有的邊緣融合,而不是留下明顯的圓形痕跡。畫筆的大小可以調整,從 6 像素到 120 像素不等:使用較大的畫筆可以快速清除大片剩餘的天空區域,使用較小的畫筆則可以精細地描繪輪廓線。一個「重置」按鈕可以清除所有筆觸,並將畫面恢復到 AI 原始的平滑狀態,讓您可以無後顧之憂地進行實驗。

修復」畫筆之所以能正常運作,是因為其中有一個值得了解的細節。在透明的 PNG 圖像中,完全透明的像素會失去其色彩資訊——因此,沒有任何東西可以恢復。這個工具透過在記憶體中保留原始照片像素的未經修改副本,以及可編輯的遮罩,來巧妙地繞過這個問題。修復功能並不會猜測色彩,而是會顯示原本就存在的真實像素。之所以能夠做到這一點,是因為編輯操作發生在原始圖像仍然存在的地方:您的瀏覽器中。

您下載了什麼,以及如何使用它。

結果會產生一張 PNG 格式的圖片,其像素尺寸與原始圖片完全相同,並且將半透明效果寫入其 Alpha 通道中。檔案會以原始檔案名稱加上「-no-bg.png」的字尾來儲存。PNG 格式是最佳選擇,因為它是目前支援度最高的格式,且具備完整的 8 位元透明度。在您還在編輯圖片時,請將檔案保持為 PNG 格式:如果將其轉換為 JPG 格式,透明度就會消失,因為 JPG 格式沒有 Alpha 通道,轉換器會將透明區域合併為單一的實心顏色,通常是白色,這會讓您回到原始狀態。

在輸入方面,這款工具接受 JPG、PNG、WebP 等多種格式,包括 iPhone 的 HEIC 照片和 TIFF 檔案,它會在模型處理這些檔案之前,先在內部將它們轉換為相容格式。一旦您完成了影像的裁切,接下來的步驟通常是將其應用於特定用途:您可以將其裁切成方形或圓形,以用於個人資料圖片——FileTinker 的「裁切影像」工具也可以在瀏覽器中完成這項操作——或者將其放置在任何支援圖層的編輯器中的新背景上。到目前為止,所有操作都在您的裝置上進行;因此,將後續的編輯也保留在裝置上是有意義的。

常見問題

我移除照片的背景時,照片會不會同時上傳?

FileTinker 的「移除背景」工具會在您的瀏覽器中使用 WebGPU 或 WebAssembly 執行人工智慧模型。您的圖片會在您的裝置上進行本地解碼、處理和重新編碼。唯一下載的內容是人工智慧模型本身;您的照片永遠不會傳送到伺服器。

這個工具為什麼會先下載人工智慧模型?

為了讓程式在本機上執行,您必須先安裝用於將主體與背景分離的神經網路(MODNet)。首次使用時,該工具會從 Hugging Face 的公共 CDN 下載模型權重(大小約為 5–25 MB,具體取決於您的裝置),並顯示進度條。您的瀏覽器會將這些權重快取起來,以便後續執行時無需再次下載。您的照片永遠不會包含在這些資料的傳輸中。

為什麼背景移除技術在處理人物照片時效果最好?

這個工具採用了 MODNet,這是一種專為人像設計和訓練的遮罩模型。當應用於人物時,它可以產生乾淨、邊緣柔和的圖像;當應用於產品、寵物和其他物體時,它仍然有效,但精確度會降低。之所以選擇它,是因為它的 Apache-2.0 授權條款使其產生的結果可以安全地用於商業用途,這與某些更廣泛的背景移除模型不同。

裁剪後的圖片是什麼格式?它會保留我原始圖片的解析度嗎?

您會得到一張與原始圖片具有相同像素尺寸的 PNG 格式圖片,其中已移除的背景會以真正的透明度儲存在 Alpha 通道中。在處理圖片時,請將其保留為 PNG 格式:轉換為 JPG 格式會破壞透明度,因為 JPG 格式沒有 Alpha 通道,透明區域會被合併為單一的實心顏色,通常是白色。

我可以修改人工智慧(AI)判斷錯誤的部分嗎?

是的。經過處理後,預覽畫面會變成一個可編輯的畫布,其中包含兩種畫筆:橡皮擦可以移除剩餘的背景,而修復畫筆則可以重新塗抹先前被錯誤切割掉的主體部分。畫筆的邊緣柔軟,且可調整大小,範圍從 6 到 120 像素,此外,一個「重置」編輯按鈕可以隨時將畫面恢復到 AI 最初的切割狀態。

這個功能可以用在產品照片上嗎?

它會盡力而為,而且如果使用簡單的拍攝技巧,並確保主體與背景之間有強烈的對比,或許就能拍出可用的照片,但請預期照片的邊緣會比人像照更粗糙,因為這款工具是針對人物進行優化的。請預留一分鐘的時間來使用「消除」和「還原」畫筆,並且不要期望它能為複雜的產品或精細的細節提供完美的工作室級效果。