卷积神经网络

原創

2020-03-28 23:46

神经元

神经网络由大量的神经元相互连接而成。每个神经元接受线性组合的输入后，再将其放在非线性的激活函数中计算后输出。每两个神经元连接线上的值代表加权值，称之为权重。 不同的权重和激活函数 ，就会导致神经元有不同的输出。神经网络的每个神经元如下所示。
一开始为了简单，人们把激活函数定义成一个线性函数，比如一个简单的线性激活函数是g(z)=z。后来实际应用中发现，线性激活函数太过局限，于是人们引入了非线性激活函数。
常用的非线性激活函数有sigmoid、tanh、relu等，前两者比较常见于全连接层，后者relu常见于卷积层。sigmoid的函数表达式如下。
sigmoid函数g(z)的图形表示如下。
也就是说，sigmoid函数的功能是相当于把一个实数压缩至0到1之间。当z是非常大的正数时，g(z)会趋近于1，而z是非常小的负数时，g(z)会趋近于0。压缩至0到1的用处是可以把激活函数看作一种分类的概率，比如激活函数的输出为0.9的话便可以解释为90%的概率为正样本。

神经网络

将单个神经元组织在一起，便形成了神经网络。下图便是一个三层神经网络结构，图中最左边的层称之为输入层，最右边的层称之为输出层，中间的叫隐藏层。

输入层，接受大量非线形输入信息的层，输入的信息称为输入向量。
输出层，形成输出结果的层。输出的信息称为输出向量。
隐藏层，输入层和输出层之间的各个层。

每一层都可能由单个或多个神经元组成，每一层的输出将会作为下一层的输入数据。
此外，输入层和隐藏层都存在一个偏置单元，所以上图中也增加了偏置项x0和a0。针对上图，有如下公式。

卷积神经网络

卷积神经网络层次结构如下。

最左边是输入层，对数据做一些处理，比如去均值、归一化等等。CNN只对训练集做去均值这一步。
中间有CONV，即卷积计算层；RELU，即激励层，激励层使用的ReLU是激活函数的一种；POOL，即池化层，取区域平均值或最大值。
最右边是FC，即全连接层

对图像中不同窗口内的数据和滤波矩阵做内积的操作就是所谓的卷积操作，也是卷积神经网络的名字来源。非严格意义上来讲，下图中红框框起来的部分便可以理解为一个滤波器，即带着一组固定权重的神经元。多个滤波器叠加便成了卷积层。
在下图对应的计算过程中，输入是一定大小的数据，它和滤波器做内积后等到新的二维数据。不同的滤波器会得到不同的输出数据。如果想提取图像的不同特征，则用不同的滤波器，提取想要的关于图像的特定信息，比如颜色深浅或轮廓。
在CNN中，滤波器对局部输入数据进行卷积计算。每计算完一个数据窗口内的局部数据后，数据窗口不断平移滑动，直到计算完所有数据。这个过程中，有以下几个参数。

深度：神经元个数，即滤波器个数，决定输出的厚度。
步长：决定滑动多少步可以到边缘。
填充值：在外围边缘补充的0的圈数，方便从初始位置以步长为单位可以刚好滑倒末尾位置。

每次滤波器都是针对某一局部的数据窗口进行卷积，这就是所谓的CNN中的局部感知机制。与此同时，数据窗口滑动，导致输入在变化，但中间滤波器的权重是固定不变的，这个权重不变即所谓的CNN中的权重共享机制。
在实际梯度下降中，sigmoid容易饱和，造成终止梯度传递，且没有0中心化。可以使用另外一个激活函数：ReLU。ReLU的优点是收敛快，求梯度简单。它对于输入的负值，输出全为0，对于正值，原样输出。
池化层可以将一幅大的图像缩小，同时又保留其中的重要信息。通常情况下，池化都是2乘以2大小，比如对于最大池化来说，就是取输入图像中2乘以2大小的块中的最大值，作为结果的像素值，相当于将原始图像缩小了4倍。同理，对于平均池化来说，就是取2*2大小块的平均值作为结果的像素值。

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

Stable Diffusion中的embedding

Stable Diffusion中的embedding 嵌入，也稱爲文本反轉，是在 Stable Diffusion 中控制圖像樣式的另一種方法。在這篇文章中，我們將學習什麼是嵌入，在哪裏可以找到它們，以及如何使用它們。什麼是嵌入embe

2024-04-25 21:31:13

打开神经网络的黑箱子

卷積神經網絡每個卷積核提取不同的特徵。每個卷積覈對輸入進行卷積，生成一個feature map，這個feature map即體現了該卷積核從輸入中提取的特徵，不同的feature map顯示了圖像中不同的特徵。淺層卷積核提取：邊緣、顏

2024-05-06 00:41:39

京东广告研发 —— 京东推荐广告排序机制演化

1、序言：廣告排序機制的前世今生 1.1、簡介：廣告排序機制在線廣告是國內外各大互聯網公司的重要收入來源之一，而在線廣告與傳統廣告最大的區別就在於其超大規模的實時競價環境：數以萬計的廣告主在一天內可以參與億級別的流量競拍。在這複雜的實

2024-04-24 23:17:14

03-为啥大模型LLM还没能完全替代你？

1 不具備記憶能力的它是零狀態的，我們平常在使用一些大模型產品，尤其在使用他們的API的時候，我們會發現那你和它對話，尤其是多輪對話的時候，經過一些輪次後，這些記憶就消失了，因爲它也記不住那麼多。 2 上下文窗口的限制大模型對其inpu

2024-04-23 01:07:00

轻松复现一张AI图片

輕鬆復現一張AI圖片現在有一個非常漂亮的AI圖片，你是不是想知道他是怎麼生成的？今天我會交給大家三種方法，學會了，什麼圖都可以手到擒來了。需要的軟件在本教程中，我們將使用AUTOMATIC1111 stable diffusio

2024-04-22 21:30:45

01-大语言模型发展

AI大模型的相關的一些基礎知識，一些背景和基礎知識。多模型強應用AI 2.0時代應用開發者的機會。 0 大綱 AI產業的拆解和常見名詞應用級開發者，在目前這樣一個大背景下的一個職業上面的一些機會實戰部分的，做這個agent，即所謂智

2024-04-22 01:12:50

AI从入门到入门之手写数字识别模型java方式Dense全连接神经网络实现

前言：授人以魚不如授人以漁.先學會用，在學原理，在學創造，可能一輩子用不到這種能力，但是不能不具備這種能力。這篇文章主要是介紹算法入門Helloword之手寫圖片識別模型java中如何實現以及部分解釋。目前大家對於人工智能-機器學習-神經網

2024-04-19 23:17:21

LoRA微调语言大模型的实用技巧

一、引言隨着深度學習技術的快速發展，語言大模型在自然語言處理領域取得了顯著的進展。然而，傳統的微調方法通常需要大量的計算資源和時間，對於實際應用來說並不友好。爲了解決這個問題，LoRA微調技術應運而生。LoRA（Low-Rank Adap

2024-04-28 11:30:13

京东广告研发——效率为王：广告统一检索平台实践

1、系統概述實踐證明，將互聯網流量變現的在線廣告是互聯網最成功的商業模式，而電商場景是在線廣告的核心場景。京東服務中國數億的用戶和大量的商家，商品池海量。平臺在兼顧用戶體驗、平臺、廣告主收益的前提推送商品具有挑戰性。京東廣告檢索平臺

2024-04-25 23:17:47

大模型区域落地再加速！百度“文心中国行”西部首站落地成都锦江

4 月 24 日，“文心中國行”西部地區首站落地成都錦江。成都市錦江區白鷺灣新經濟總部功能區、錦江區投資促進局與百度飛槳攜手合作，打造成都人工智能的新產業、新模式、新業態。來自成都政產學研各界的領導、專家、企業嘉賓，共同探討如何降低 AI

2024-04-25 11:41:53

文心中国行走进成都！4 月 24 日一起把握大模型时代的产业新机遇

4 月 24 日，文心中國行將走進成都。屆時，政府、企業與高校的相關專家和業界同仁將現場分享生成式人工智能與大模型最新進展，從人工智能政策解讀、大模型技術，到產業創新應用的實踐案例，讓參會者全方位瞭解大模型時期的發展與創新機遇。大會還特別

2024-04-23 11:41:07

文心大模型“你说我画”：PaddleHub与PaddleSpeech的协同实践

在人工智能領域中，自然語言處理和計算機視覺是兩個非常活躍的研究方向。隨着深度學習技術的發展，這兩個領域之間的交叉融合產生了許多令人興奮的應用場景。其中，“你說我畫”就是這樣一個結合自然語言處理和計算機視覺技術的創新應用。 “你說我畫”的核心

2024-04-22 11:29:20

探索时间序列大模型：TimeGPT的魅力与实践

在數據科學的各個領域中，時間序列分析一直扮演着重要角色。無論是預測股票價格、氣候變化，還是分析醫療數據，時間序列模型都發揮着不可或缺的作用。然而，傳統的時間序列分析方法在處理複雜數據時常常面臨諸多挑戰，如數據稀疏性、非線性關係等。爲了應對這

2024-04-22 11:29:17

京东广告研发——AIGC在京东广告创意的技术应用

一、前言電商廣告圖片不僅能夠抓住消費者的眼球，還可以傳遞品牌核心價值和故事，建立起與消費者之間的情感聯繫。然而現有的廣告圖片大多依賴人工製作，存在效率和成本的限制。儘管最近AIGC技術取得了卓越的進展，但其在廣告圖片的應用還存在缺乏

2024-04-22 11:16:30

Create 2024 分论坛：百度大模型安全解决方案护航开发者一起创造未来

4月16日，百度Create AI開發者大會在深圳國際會展中心（寶安）舉行，大會以“創造未來”爲主題，匯聚了當前科技和產業革命中的開發者先鋒力量。自去年3月16日發佈知識增強大語言模型文心一言以來，百度不斷推動文心大模型的升級迭代，每一次版

2024-04-19 21:33:25

24小時熱門文章

最新文章

最新評論文章