《DLOW:Domain Flow for Adaptation and Generalization》论文解析

原創

超屌的温jay

2020-06-27 17:40

今天说的这篇文章，也是用来解决迁移学习问题的。迁移学习要解决一个什么问题呢？就是要把模型在source域（源域）学习到的知识，用到target域（目标域）里。

DLOW这篇文章主要提出了两点：1、可以把source域的数据迁移成中间域，中间域也就是介于source和target之间的域。 2、训练的时候如果有多个target域的话，DLOW可以生成网络没有见过的数据风格。

那么接下来介绍一下算法原理：

1、CycleGAN

作为本算法的基础，cycleGAN至关重要。具体的介绍请看我另一篇博客：

https://blog.csdn.net/wenqiwenqi123/article/details/105123491

在这里复习一下，cycleGAN主要由两个loss组成：

其中xs代表源域数据，xt代表目标域数据。Gst为source到target的生成器，Dt为判别目标域真实数据和生成数据的判别器。反之相同。

2、定义中间域

设中间域为M（z），z为[0,1]的一个变量，跟与source和target的联系有关。换句话说，z=0的时候，M（z）就是source，当z=1的时候，M（z）就是target。

如下图所示，其实从S到T的路径有许多，但是我们希望我们能找到一条最近的路（贴着地平线过去的那条，红线）。

因此我们得到了如下公式：

其中dist为某种距离表示，在本算法中使用了公式一的距离（cycleGAN）。

因此把3公式化简一下，得到了loss函数：

3、DLOW模型

综上，我们现在有了Source域的数据，和Z=[0,1]，Gst的目的是得到中间域而不再是得到Target域。

因此有

Adversarial Loss：GAN肯定会有对抗损失。这里定义判别器Ds（x）是区分M（z）和S，而Dt（x）是区分M（z）和T。因此对抗损失可以写为：

用上面的损失来代入dist的话，则得到：

Image Cycle Consistency Loss：cycleGAN的循环一致损失：

其中Gts是从target到M的生成器：

总损失：

实现：

整个网络架构如下所示：

z和S一起作为输入输进生成器Gst，对z作反卷积得到（1,16,1,1）的向量，同时对z进行采样：。

这样的话，z会在一开始的时候趋向于较小，随着训练逐渐加大，这样可以更稳定。

提升域自适应模型：

作者做了一个实验，可以提升域自适应算法的能力。

原本的source域的数据为S，那么作者用DLOW这套算法，把z从[0,1]中均匀采样，用生成器GST生成了新的数据集S~。

因此在S~中，数据分布从S到T都有，再用S~数据集作为域自适应算法的训练数据，可以有效提升效果。

至于此处把Ladv赋予了一个权值，根号1-z，是因为对于每一个样本来说，如果z比较大的话，说明这个样本更接近target域，因此对抗损失的权值需要降低。

风格生成：

大部分的风格迁移算法，都只能一对一地进行迁移。也就是说在训练完后，就只能迁移到那个风格了。

但是DLOW可以生成训练数据里没有见过的风格。假设有K个目标域，则z拓展成一个k维的向量[z1,z2,...,zk]，所有z值加起来等于1。因此我们需要优化的目标变成了：

可以比较容易地修改网络结构得到这个。

4、实验部分

实验部分作者做了俩实验，一个是刚刚说的用生成的中间域数据训练domain adaptation的模型，得到更好的结果。一个是风格迁移得到新风格unseen in the training data。

先说实验一，做了一个语义分割的task，从GTA5迁移到Cityscapes。结果如下：

实验二，作者用了真实照片迁移到油画风格的task。用了莫奈、梵高等不同的target domain。

因此z变成了[z1,z2,z3,z4]，其中z1+z2+z3+z4=1

训练的时候每五步分别用：[1,0,0,0], [0,1,0,0], [0,0,1,0], [0,0,0,1] ,均匀随机取样。得到了不错的结果。

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

5月21日相聚上海张江！与文心大模型一起共建大模型产业应用生态圈

5月21日，文心中國行將走進上海，在張江科學會堂舉行。屆時，政府、企業與高校的相關專家和業界同仁將現場分享生成式人工智能與大模型最新進展，主要圍繞大模型技術如何賦能產業級應用創新展開探討，還有百度風投從投資視角帶來的觀點，讓參會者全方位瞭解

2024-05-17 00:28:21

网络爬虫安全：90后小伙，用软件非法搬运他人原创视频被判刑

央視《今日說法》欄目近日報道了一名程序員開發非法視頻搬運軟件獲利超700多萬，最終獲刑的案例。國內某知名短視頻平臺報警稱，有人在網絡上售賣一款視頻搬運軟件，使用軟件的人可以繞過平臺的審覈機制，一鍵“搬運”竊取他人作品非法轉載投稿。警方調查

2024-05-16 00:19:26

探索大语言模型：理解Self Attention| 京东物流技术团队

一、背景知識在ChatGPT引發全球關注之後，學習和運用大型語言模型迅速成爲了熱門趨勢。作爲程序員，我們不僅要理解其表象，更要探究其背後的原理。究竟是什麼使得ChatGPT能夠實現如此卓越的問答性能？自注意力機制的巧妙融入無疑是關鍵因素

2024-05-14 23:57:26

GPU 硬件指标说明

流處理器：也叫渲染管、着色器。畫面都是由一個又一個像素點組成的，而流處理器就負責這些像素點的渲染工作； RT核心：光追核心，用作於光線追蹤效果； CUDA 核心和Tensor 核心：CUDA Core和Tensor Core，爲G

2024-05-13 22:35:43

舌尖上的AI：人工智能技术正在被“端上”餐桌

來源 | 人民數字FINTECH 責編 | 晉兆雨頭圖 | CSDN 下載自視覺中國 #人工智能技術正在被“端上”餐桌四方食事，不過一碗人間煙火。人工智能作爲一門新的技術科學，正在被人間煙火氣“端”上餐桌。人工智能“洗手”

2024-05-13 21:17:25

攻击者正在利用AI，对保险公司发起大规模欺诈

保險欺詐一直是保險行業面臨的重要挑戰之一，尤其隨着技術的進步，欺詐者也在不斷更新其手段，利用AI技術，包括生成式模型、機器學習和數據分析工具等欺騙保險公司，而AI技術的應用正成爲他們的新工具，使其犯罪行爲更加隱蔽和複雜，挑戰保險行業的防欺詐

2024-05-10 00:55:17

AIGC在京东广告创意的技术应用

一、前言電商廣告圖片不僅能夠抓住消費者的眼球，還可以傳遞品牌核心價值和故事，建立起與消費者之間的情感聯繫。然而現有的廣告圖片大多依賴人工製作，存在效率和成本的限制。儘管最近AIGC技術取得了卓越的進展，但其在廣告圖片的應

京東雲開發者

2024-05-08 23:24:18

AI绘图新选择：Fooocus工具发布，小显存助力大模型运行

隨着人工智能技術的飛速發展，AI繪圖工具已經成爲了衆多創作者們的得力助手。它們能夠基於深度學習算法，快速生成高質量的圖像，爲設計、藝術等領域注入了新的活力。然而，傳統的AI繪圖工具往往對硬件要求較高，使得許多擁有較低配置設備的用戶望而卻步。

2024-05-07 23:30:10

GLM国产大模型训练加速：高效性能与成本优化的实践

隨着人工智能技術的不斷進步，大模型的訓練成爲了推動深度學習領域發展的重要力量。然而，傳統的訓練方式往往面臨着性能瓶頸和高昂的成本問題，這使得許多研究者和開發者望而卻步。爲了解決這一難題，我們探索了使用OneFlow框架對GLM國產大模型進行

2024-05-07 23:30:09

LoRA微调语言大模型的实用技巧

一、引言隨着深度學習技術的快速發展，語言大模型在自然語言處理領域取得了顯著的進展。然而，傳統的微調方法通常需要大量的計算資源和時間，對於實際應用來說並不友好。爲了解決這個問題，LoRA微調技術應運而生。LoRA（Low-Rank Adap

2024-04-28 11:30:13

京东广告研发——效率为王：广告统一检索平台实践

1、系統概述實踐證明，將互聯網流量變現的在線廣告是互聯網最成功的商業模式，而電商場景是在線廣告的核心場景。京東服務中國數億的用戶和大量的商家，商品池海量。平臺在兼顧用戶體驗、平臺、廣告主收益的前提推送商品具有挑戰性。京東廣告檢索平臺

2024-04-25 23:17:47

Stable Diffusion中的embedding

Stable Diffusion中的embedding 嵌入，也稱爲文本反轉，是在 Stable Diffusion 中控制圖像樣式的另一種方法。在這篇文章中，我們將學習什麼是嵌入，在哪裏可以找到它們，以及如何使用它們。什麼是嵌入embe

2024-04-25 21:31:13

大模型区域落地再加速！百度“文心中国行”西部首站落地成都锦江

4 月 24 日，“文心中國行”西部地區首站落地成都錦江。成都市錦江區白鷺灣新經濟總部功能區、錦江區投資促進局與百度飛槳攜手合作，打造成都人工智能的新產業、新模式、新業態。來自成都政產學研各界的領導、專家、企業嘉賓，共同探討如何降低 AI

2024-04-25 11:41:53

文心中国行走进成都！4 月 24 日一起把握大模型时代的产业新机遇

4 月 24 日，文心中國行將走進成都。屆時，政府、企業與高校的相關專家和業界同仁將現場分享生成式人工智能與大模型最新進展，從人工智能政策解讀、大模型技術，到產業創新應用的實踐案例，讓參會者全方位瞭解大模型時期的發展與創新機遇。大會還特別

2024-04-23 11:41:07

文心大模型“你说我画”：PaddleHub与PaddleSpeech的协同实践

在人工智能領域中，自然語言處理和計算機視覺是兩個非常活躍的研究方向。隨着深度學習技術的發展，這兩個領域之間的交叉融合產生了許多令人興奮的應用場景。其中，“你說我畫”就是這樣一個結合自然語言處理和計算機視覺技術的創新應用。 “你說我畫”的核心

2024-04-22 11:29:20

24小時熱門文章

最新文章

最新評論文章