在你自己裝置上執行的AI特效
運算吃重的變換都放在這裡:把主體從背景裡切出來,把小圖放大而不糊掉,以及用來遮住人臉、車牌與帳號的模糊與馬賽克。去背與放大跑的是真正的神經網路,而且是透過WebAssembly與WebGL在你的機器上跑,不是在伺服器上。當處理的是護照掃描件或尚未發表的產品照時,這一點就是全部的重點。模型第一次使用會下載一次權重並快取,之後離線也能運作。
常見問題
不上傳照片,背景是怎麼去掉的?
分割模型本身會被下載到你的瀏覽器並在那裡執行。影像在記憶體中送進模型,模型回傳它判定為前景的遮罩,再套用這個遮罩產生透明PNG。照片不會前往任何地方。這也是為什麼第一次執行要花幾秒下載模型,之後就很快。
放大功能真的是AI,還是只是內插?
是真正的超解析度網路,不是雙三次拉伸。它學過邊緣、髮絲與紋理在更高解析度下的樣子,會重建出合理的細節,而不是在既有像素之間做平滑。它無法憑空生出從未拍到的資訊,所以被大幅壓縮的縮圖會變好,但不會變成一張清晰的照片。
遮住人臉用模糊還是馬賽克比較好?
馬賽克比較安全。高斯模糊是可逆的數學運算,在周邊資訊足夠時,輕度模糊有可能被部分還原。馬賽克則是把像素按區塊取平均直接丟棄。涉及敏感內容時,請用較大區塊的馬賽克,或使用會自動偵測人臉的專用打碼工具。
為什麼第一次執行比後來慢?
因為模型權重必須先下載一次,依工具不同是數十MB。瀏覽器會快取它們,所以第二次以及之後都能立刻開始,沒有連線也能運作。之後的處理時間取決於你的CPU或GPU,以及影像的尺寸。
結果可以商業使用嗎?
可以。工具不會加上浮水印,也不主張對你的成果擁有權利。你對原圖能做的事,對編輯後的版本一樣能做。因為沒有帳號,也就沒有任何資訊把輸出與你連結起來。