機器學習之——神經網絡模型

原創

郭了个治浩

2020-06-23 10:29

之前我們瞭解了神經網絡模型(Nerual Network)，這一次，我們來具體討論一下神經網絡模型的表達。

我們知道，神經網絡模型是許多邏輯單元(Logistics Unit)按照不同的層級組織起來的網絡，每一層的輸出變量作爲下一層的輸入變量。如下圖，是一個三層的神經網絡，第一層爲輸入層(Input Layer)，最後一層爲輸出層(Output Layer)，中間的一層爲隱藏層(Hidden Layer)。我們爲每一層都增加一個偏倚單位(Bias Unit)：

下面呢，我們引入一些標記法來幫助我們描述模型：

對於上面的圖示的模型，激活單元和輸出分別表達爲：

到目前，我們討論的只是將特徵矩陣中的一行（也就是一個訓練實例）餵給了神經網絡，事實上我們需要將整個訓練集都餵給我們的神經網絡算法來學習模型。

正向傳播(Forward Propagation)

相對於使用循環來進行編碼，利用向量化的方法會使得計算更爲簡單快捷。

我們就使用上面的神經網絡爲例，試着計算第二層的值：

我們令：

則：

計算之後添加：

則計算輸出的值爲：

我們令：

則：

這只是針對訓練集中一個訓練實例所進行的計算。如果我們要對整個訓練集進行計算，我們需要將訓練集特徵矩陣進行轉置，使得同一個實例的特徵都在同一列裏，即：

對神經網絡的一些理解

從本質上講，神經網絡能夠通過學習得出其自身的一系列特徵。在之前我們討論過的普通的邏輯迴歸(Logistic Regression)中，我們被限制爲使用數據中的原始特徵x1,x2,...,xn，我們雖然可以使用一些二項式項來組合這些特徵，但是我們仍然受到這些原始特徵的限制。在神經網絡中，原始特徵只是輸入層，像我們上面的那個三層神經網絡的例子中，第三層，也就是輸出層，做出的預測利用的是第二層的特徵，而非輸入層中的原始特徵，我們可以認爲第二層中的特徵是神經網絡通過學習之後，自己得出的一系列用於預測輸出變量的新特徵。

神經網絡的一些示例：二元邏輯運算符(Binary Logical Operators)

當輸入的特徵爲布爾值（0或1）時，我們可以使用一個單一的激活層可以作爲二元邏輯運算符，爲了表示不同的運算符，我們只需要選擇不同的權重即可。

如下圖，神經元（三個權重分別爲-30，20，20）可以被視爲作用同邏輯與(AND)：

下面的神經元（三個權重分別爲-10，20，20）可以被視爲作用同邏輯或(OR)：

下圖的神經元（兩個權重分別爲10，-20）可以被視爲作用同邏輯非(NOT)：

我們可以利用神經元來組合成更爲複雜的神經網絡以實現更加複雜的運算。例如，我們要實現XNOR功能（輸入的值必須一樣，都爲1或都爲0），即 XNOR = (X1 AND X2) OR ((NOT X1)AND(NOT X2))。

首先，構造一個能夠表達(NOT X1)AND(NOT X2)部分的神經元：

然後將表示AND的神經元和表示(NOT X1)AND(NOT X2)的神經元，以及表示OR的神經元進行組合：

這樣，我們就得到了一個能夠實現XNOR運算符功能的神經網絡了。

多類分類

假設，我們要訓練一個神經網絡算法來識別路人、汽車、摩托車和卡車，在輸出層，我們應該有4個不同的值。例如，第一個值爲1或0用來預測是否是行人，第二個值用來判斷是否是汽車等等。

下圖表示，該假設的神經網絡的一種可能結構：

神經網絡算法的輸出結果，爲四種情況可能情形之一：

綜上，我們深入探討了一下神經網絡模型的表達、二元邏輯運算符等神經網絡的內容，下一次我們討論神經網絡學習的問題。

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

2024年DataOps趨勢預測：AI不會取代數據工程師

APM digest收集了多位行業專家對DataOps在2024的發展形勢及對IT和業務的影響的預測，這些技術最高管理者，包括Confluent技術戰略負責人Andrew Sellers的深刻洞見可能與你的感覺一致嗎？快來探討一下。數據可

2024-04-30 11:49:29

數字化轉型新篇章：企業通往智能化的新範式

早在十多年前，一些具有前瞻視野的企業以實現“數字化”爲目標啓動轉型實踐。但時至今日，可以說尚無幾家企業能夠在真正意義上實現“數字化”。在實現“數字化”的征途上，人們發現，努力愈進，彷彿終點愈遠。究其原因，還在於轉型一直落後於技術邊界的拓展

2024-04-29 21:22:20

Stable Diffusion中的embedding

Stable Diffusion中的embedding 嵌入，也稱爲文本反轉，是在 Stable Diffusion 中控制圖像樣式的另一種方法。在這篇文章中，我們將學習什麼是嵌入，在哪裏可以找到它們，以及如何使用它們。什麼是嵌入embe

2024-04-25 21:31:13

AI從入門到入門之手寫數字識別模型java方式Dense全連接神經網絡實現

前言：授人以魚不如授人以漁.先學會用，在學原理，在學創造，可能一輩子用不到這種能力，但是不能不具備這種能力。這篇文章主要是介紹算法入門Helloword之手寫圖片識別模型java中如何實現以及部分解釋。目前大家對於人工智能-機器學習-神經網

2024-04-19 23:17:21

Pinecone: 大模型時代的智能索引與搜索解決方案

隨着人工智能技術的飛速發展，大模型（Large Models）已成爲衆多領域的重要工具。無論是自然語言處理、圖像識別還是其他複雜任務，大模型都展現出了強大的性能。然而，隨着模型規模的不斷擴大，數據量的激增，如何有效地管理、索引和搜索這些模型

2024-04-19 11:29:43

軟件測試從自動化到智能化，大模型開始加入

隨着科技的飛速發展，軟件行業也在不斷地演進和創新。作爲軟件行業的關鍵環節之一，軟件測試行業也在經歷着前所未有的變革。從最初的手動測試，到自動化測試，再到如今的智能化測試，軟件測試行業正在經歷一場深刻的技術革命。在這場革命中，Testin雲測

2024-04-19 00:53:25

裁員了！別錯過2024年大數據工程師必備的10項技能

在當今快速發展的世界中，數據被視爲新的石油。隨着對數據驅動洞察的日益依賴，大數據工程師的角色比以往任何時候都更爲關鍵。這些專業人員在管理和優化組織內的數據操作中扮演着至關重要的角色。在本文中，我們將探索2024年大數據工程師必須具備的十

2024-04-16 11:00:53

DevOps已死？2024年的DevOps將如何發展

隨着我們進入2024年，DevOps也隨之發生變化。新興的技術、變化的需求和發展的方法正在重新定義有效實施DevOps實踐。 IDC預測顯示，未來五年，支持DevOps實踐的產品市場繼續保持健康且快速增長，2022年-2027年的複合年增長

2024-04-08 12:51:44

從模型到部署，教你如何用Python構建機器學習API服務

本文分享自華爲雲社區《Python構建機器學習API服務從模型到部署的完整指南》，作者：檸檬味擁抱。在當今數據驅動的世界中，機器學習模型在解決各種問題中扮演着重要角色。然而，將這些模型應用到實際問題中並與其他系統集成，往往需要構建API

2024-04-08 10:33:17

測試左移已經開始影響DevOps的發展？

在軟件開發的早期，該過程通常是開發人員編寫代碼，再將其交給質量保證（QA）進行測試。這種瀑布開發方法可能會導致質量問題和延遲，因爲問題是在週期後期發現的。一、瞭解DevOps和測試左移 DevOps是Development和Operati

2024-04-07 12:48:37

黑盒Prompt優化：提升大模型反饋效果的新思路

隨着人工智能技術的快速發展，大模型在各種應用場景中發揮着越來越重要的作用。然而，如何提升大模型的反饋效果，使其更加準確、高效地爲用戶提供服務，一直是研究者和開發者關注的焦點。本文提出了一種新的思路——黑盒Prompt優化，旨在通過改進輸入提

2024-03-29 00:01:17

分佈式數據庫技術的演進和發展方向

這些年大家都在談分佈式數據庫，各大企業也紛紛開始做數據庫的分佈式改造。那麼，所謂的分佈式數據庫到底是什麼？採用什麼架構？優勢在哪？爲什麼越來越多企業選擇它？分佈式數據庫技術會向什麼方向發展？帶着這些疑問，一探究竟吧！參與文末的話題互動

2024-03-26 11:34:43

利用RAG技術打破大模型幻覺

隨着人工智能技術的不斷進步，大模型在各個領域中發揮着越來越重要的作用。然而，大模型幻覺問題一直是制約其進一步發展的瓶頸。爲了解決這一問題，研究者們不斷探索新的技術和方法。近年來，一種名爲RAG（檢索增強生成）的技術備受關注，它通過結合知識圖

2024-03-21 00:28:34

與 NVIDIA 再次合作、深度參與 GTC，Zilliz 與全球頂尖開發者共迎 AI 變革時刻！

Zilliz 與全球的頂尖開發者齊聚 GTC 2024。近日，備受關注的 NVIDIA GTC 2024 已拉開序幕，來自世界各地的頂尖 AI 開發者齊聚美國加州聖何塞會議中心，共同探索行業未來。作爲去年被 NVIDIA CEO 黃仁

2024-03-19 21:26:53

多模態+大模型會帶來哪些“化學反應”？

導語：沒人懷疑，2024 年，AI 依然將是科技界的主角。上個月，OpenAI 推出了可以生成 60 秒高清視頻的視頻生成模型 Sora，掀起了對多模態模型的進一輪討論。多模態大模型技術的最新進展如何？這一波新技術，對於行業和消費者的體驗會

2024-03-15 13:45:01

24小時熱門文章

最新文章

最新評論文章