谷歌推出了 StyleDrop,這是一種新型神經網絡,能夠模仿和轉移任何視覺風格到後續生成中。這項創新技術由 Muse 的快速文本到圖像模型提供支持,使用戶能夠輕鬆生成忠實體現特定風格的圖像,捕捉其細微差別和複雜性。

信用:Midjourney / Chaffro#6204

StyleDrop 允許用戶選擇具有所需視覺風格的原始圖像,並將其無縫轉移到新圖像中,同時保留所選風格的所有獨特特徵。該應用程序可以處理完全不同的圖像。例如,用戶可以使用兒童畫作爲基礎,生成風格化的標誌或角色。

基於 Muse 的先進生成視覺變換器,StyleDrop 使用用戶反饋、生成圖像和 Clip Score 的組合進行訓練。該神經網絡經過微調,訓練參數的數量極小,不到總模型參數的 1%。通過迭代訓練,StyleDrop 不斷提升生成圖像的質量,確保在幾分鐘內獲得令人印象深刻的結果。

StyleDrop 的多功能性使其成爲尋求開發獨特視覺風格的品牌不可或缺的工具。通過 StyleDrop,品牌可以高效地在其首選風格中原型化創意,使其成爲創意團隊和設計師的寶貴資產。

信用:styledrop.github.io

對 StyleDrop 在樣式調整文本到圖像模型中的性能進行的廣泛研究展示了其優於其他方法的優勢,包括 DreamBooth、Imagen 上的文本反轉和穩定擴散。StyleDrop 始終優於這些方法,提供與用戶指定風格緊密貼合的高質量圖像。

用戶提供的基於文本的提示在 StyleDrop 的圖像生成過程中起着至關重要的作用。通過在訓練和生成時將自然語言風格描述符(例如,“以融化的金色 3D 渲染風格”或“以抽象的彩虹色流動煙霧波浪設計”)附加到內容描述符,StyleDrop 精確捕捉所需風格。

信用:styledrop.github.io

此外,StyleDrop 爲用戶提供了使用自己的品牌資產訓練神經網絡的機會,從而實現其獨特視覺身份的無縫集成。通過在訓練和生成時將自然語言風格描述符附加到內容描述符,品牌可以迅速原型化自己獨特風格的創意。

使用 StyleDrop 的生成過程極其高效,最多隻需三分鐘。這個快速的週轉時間使用戶能夠迅速探索許多創意可能性並嘗試不同風格。

信用:styledrop.github.io

雖然 StyleDrop 展示了品牌發展的巨大潛力,但值得注意的是,該應用程序尚未向公衆發佈。谷歌團隊正在積極解決版權問題,並努力確保法律合規,以實現順利和安全的發佈。

信用:styledrop.github.io

這個神經網絡幫助品牌和個人釋放他們的創造力,並在競爭日益激烈的數字環境中創造吸引人的視覺身份,輕鬆再現任何視覺風格。品牌現在擁有一款無價的工具,可以利用 StyleDrop 創建自己的視覺故事情節,並且可以毫不費力地做到這一點,精確度無與倫比。

閱讀更多關於 AI 的內容:

  • Midjourney 和 Dall-E 藝術家風格示例:130 種著名的 AI 繪畫技術

  • GPT-4 與 GPT-3:新模型有什麼可提供的?

  • VToonify:用於生成藝術肖像視頻的實時 AI 模型

文章《StyleDrop:谷歌的神經網絡重現任何視覺風格》首次發表於 Metaverse Post。