十大機器學習算法之支持向量機（一）

原創

小小菜鸟一只

2020-06-21 00:43

1、隨便說點

這個系列就是想要記述一下自己學習機器學習算法的一個心路歷程的對算法的認識，如果有幫助到更多人（還是小開心的~~~~）,如果有錯誤的話歡迎各路大神積極的跟我聯繫修正錯誤，免的誤導大家。

2、正題

2.1、課前知識

SVM是一種監督式學習方法。對於線性不可分的情況，支持向量機通過使用非線性映射把向量映射到一個更高維的空間裏，基於機構風險最小化理論，在這個空間裏建立有一個分割超平面，使得學習期得到全局最優化，並且在整個樣本空間的期望風險以某個概率滿足一定上界。在分開數據的超平面兩邊建有兩個相互平行的超平面。分割超平面使得兩個平行的超平面的距離最大化。這個距離越大，分類器的總體誤差就會越小，分類效果越好。

2.2、帶領大家再看一遍logistic迴歸

Logistic迴歸的目的是從特徵學習出一個０／１分類模型，而這個模型是將特徵的線性組合作爲自變量，由於自變量的取值是負無窮到正無窮。因此，使用logistic函數將自變量映射到（0，1）上，映射後的值被認爲是屬於y=1的概率。
形式化表示：
假設函數：

其中x是n維的特徵向量，函數g就是logistic函數。
函數g（x）的圖像是：

可以看到，無窮被映射到了（0，1）上。而假設函數就是特徵屬於y=1的概率。

當新來一個特徵時候，我們只需要求出如果大於0.5，則特徵就是屬於y=1的類，反之，則是屬於y=0的類。
回過頭來再看一遍，我們會發現，只與有關，>0，那麼>0.5，g（z）只不過是用來映射的函數，真正的決定特徵是屬於哪一個類別的還是。可以看出當趨近於正無窮的時候，特徵值是接近於1的，反之則是接近於-1。我們訓練模型的目的就是希望訓練數據中y=1的特徵>>0，而y=0的特徵遠遠小於0。Logistic迴歸的目的就是要學習得到這個θ，使得正例的特徵遠遠大於0，負例的特徵遠遠小於0，而且是要在所有的實例上達到這個訓練目的。

2.3形式化表示

在SVM中使用的標籤是-1和1，替換的是logistic迴歸中的0和1 （其實標籤數據都是無所謂多少的，只是爲了更好的區分而已）。θ替換成了w和b。以前，其中=1的。我們現在把替換爲b，其他的θ替換爲w，替換後爲：可以進一步簡化爲，同時。也就是說最終y由y=0和y=1變爲y=-1和y=1，只是這些標記數據變化之外。其他都沒有什麼區別。現在的假設函數爲：。上一小節我們說過只需要考慮的正負問題，不用關心函數g(z)的大小變化，因此這裏我們將g(z)做一個簡化處理，把他簡單的映射到-1和1上。映射關係如下所示：
、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、

2.4函數間隔和幾何間隔

我跟你們分享一下我理解的函數間隔和幾何間隔。函數間隔顧名思義由函數出發計算出來的間隔，就是我們數學上學習到的計算點到平面的距離；幾何間隔就是計算的點到平面的距離除以係數。接下來聽我慢慢道來。

函數間隔

概念：點到超平面的距離。給定一個訓練樣本，x是特徵，y是標籤，i標示第i個樣本。
定義函數間隔如下：

超平面（w，b）關於訓練樣本集中所有樣本點的函數間隔的最小值就是超平面關於訓練樣本集的函數間隔：

我們能夠想象的到。當=1的時候，在我們的g(z)中，是大於等於0的，此時的函數間隔實際上就是。爲了使函數間隔最大（也就是確定樣本是正例還是反例的確信度最大化），當=1時，應該是一個極大數（是一個絕對值極大的數）。因此，函數間隔代表了我們認爲特徵是正例還是反例的置信度。
但是，這樣定義的函數間隔是有問題的，我們爲了使最大化，我們可以試着同時按照比例增大w和b的值（比如2w，2b）則這個時候的函數間隔變爲原來的2倍，但是超平面並沒有發生變化，所以，這個函數間隔是由BUG存在的，只是使用這一個來定義遠遠不夠，這個時候就要我們的幾何間隔出面了。

幾何間隔

先看一張圖

對於圖中A點，其垂直投影到超平面的對應點爲B，w是垂直於超平面的一個向量，r爲樣本點A到超平面的距離，此時有單位向量爲，所以B點的座標爲（利用幾何知識計算），帶入到超平面=0得到：

進一步得到：

r就是點到超平面的距離。爲了求得r的絕對值，令r乘上對應的類別y，即可得出幾何間隔。R=yr
由此可以看出，及時同時增大w和b的倍數，幾何間隔的大小是不會改變的。當||w||=1時，幾何間隔即爲函數間隔。
從上面的定義中我們可以看出來，幾何間隔和函數間隔之間的區別就在於||w||，幾何間隔就等於函數間隔除以||w||。函數間隔實際上就是f(x)，只是認爲定義的間隔度量，而幾何間隔f(x)/||w||纔是直觀上的點到超平面的距離。

2.5最優間隔分類器

在前面我們說過，我們的目標就是尋找到一個超平面，這個超平面使得離這個超平面的距離是越大越好，達到最大就是我們想要的效果。（就是我們所說的使得所有的點都必須遠離超平面，如果最近的都遠離了，那麼其他的點肯定也都是遠離的），我們現在所關心的就是要儘量使得離得最近的點到超平面的距離最大。畫個圖比較明瞭************************（好醜的圖,不忍直視)
就是圖中A點和B點離超平面的距離最大化。
形式化表示爲：

這裏||w||=1規約w，使得求得的是幾何間隔而不是函數間隔。
到現在爲止，我們已經把模型定義出來了，如果我們已經求得w和b，那麼對於新到來的一個x，我們只需要代入到公式當中，就可以對他進行分類，這個就成爲最優間隔分類器。我們現在的問題就是怎麼去把w和b求出來。
由於||w||=1不是凸函數，我們把這個進行處理，考慮到我們前面2.4節中講到的幾何間隔和函數間隔的關係，，我們把上面等式重新換個方式寫出來：

這個時候其實我們求得的最大值還是幾何間隔，只不過此時的w不需要再受到||w||=1的約束。但是這個時候目標函數並不是凸函數，沒有現成的算法求最優，所以我們還是要修改，前面說到，同時擴大w和b的倍數，對結果並沒有什麼影響，但是我們還是要求出一組w和b的值，因此，我們需要對函數間隔做一些限制，以保證我們的解是唯一的。我們爲了簡單，取函數間隔爲1，也即是距離超平面最近的點的距離定義爲：1/||w||。由於求1/||w||的最大值，就相當於求的最小值，因此，改寫之後的結果爲：

這個就比較讓我們滿意了，只有線性約束，而且這還是一個典型的二次規劃問題（目標函數是自變量的二次函數）。代入現有的優化軟件求解即可。
、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、、
總算把前面一些知識算是說完了，有啥新增的我會在更新，下面一篇就要好好的步入正題中的正題，我們的核心————SVM。

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

Stable Diffusion中的embedding

Stable Diffusion中的embedding 嵌入，也稱爲文本反轉，是在 Stable Diffusion 中控制圖像樣式的另一種方法。在這篇文章中，我們將學習什麼是嵌入，在哪裏可以找到它們，以及如何使用它們。什麼是嵌入embe

2024-04-25 21:31:13

AI從入門到入門之手寫數字識別模型java方式Dense全連接神經網絡實現

前言：授人以魚不如授人以漁.先學會用，在學原理，在學創造，可能一輩子用不到這種能力，但是不能不具備這種能力。這篇文章主要是介紹算法入門Helloword之手寫圖片識別模型java中如何實現以及部分解釋。目前大家對於人工智能-機器學習-神經網

2024-04-19 23:17:21

Pinecone: 大模型時代的智能索引與搜索解決方案

隨着人工智能技術的飛速發展，大模型（Large Models）已成爲衆多領域的重要工具。無論是自然語言處理、圖像識別還是其他複雜任務，大模型都展現出了強大的性能。然而，隨着模型規模的不斷擴大，數據量的激增，如何有效地管理、索引和搜索這些模型

2024-04-19 11:29:43

軟件測試從自動化到智能化，大模型開始加入

隨着科技的飛速發展，軟件行業也在不斷地演進和創新。作爲軟件行業的關鍵環節之一，軟件測試行業也在經歷着前所未有的變革。從最初的手動測試，到自動化測試，再到如今的智能化測試，軟件測試行業正在經歷一場深刻的技術革命。在這場革命中，Testin雲測

2024-04-19 00:53:25

裁員了！別錯過2024年大數據工程師必備的10項技能

在當今快速發展的世界中，數據被視爲新的石油。隨着對數據驅動洞察的日益依賴，大數據工程師的角色比以往任何時候都更爲關鍵。這些專業人員在管理和優化組織內的數據操作中扮演着至關重要的角色。在本文中，我們將探索2024年大數據工程師必須具備的十

2024-04-16 11:00:53

DevOps已死？2024年的DevOps將如何發展

隨着我們進入2024年，DevOps也隨之發生變化。新興的技術、變化的需求和發展的方法正在重新定義有效實施DevOps實踐。 IDC預測顯示，未來五年，支持DevOps實踐的產品市場繼續保持健康且快速增長，2022年-2027年的複合年增長

2024-04-08 12:51:44

從模型到部署，教你如何用Python構建機器學習API服務

本文分享自華爲雲社區《Python構建機器學習API服務從模型到部署的完整指南》，作者：檸檬味擁抱。在當今數據驅動的世界中，機器學習模型在解決各種問題中扮演着重要角色。然而，將這些模型應用到實際問題中並與其他系統集成，往往需要構建API

2024-04-08 10:33:17

測試左移已經開始影響DevOps的發展？

在軟件開發的早期，該過程通常是開發人員編寫代碼，再將其交給質量保證（QA）進行測試。這種瀑布開發方法可能會導致質量問題和延遲，因爲問題是在週期後期發現的。一、瞭解DevOps和測試左移 DevOps是Development和Operati

2024-04-07 12:48:37

黑盒Prompt優化：提升大模型反饋效果的新思路

隨着人工智能技術的快速發展，大模型在各種應用場景中發揮着越來越重要的作用。然而，如何提升大模型的反饋效果，使其更加準確、高效地爲用戶提供服務，一直是研究者和開發者關注的焦點。本文提出了一種新的思路——黑盒Prompt優化，旨在通過改進輸入提

2024-03-29 00:01:17

分佈式數據庫技術的演進和發展方向

這些年大家都在談分佈式數據庫，各大企業也紛紛開始做數據庫的分佈式改造。那麼，所謂的分佈式數據庫到底是什麼？採用什麼架構？優勢在哪？爲什麼越來越多企業選擇它？分佈式數據庫技術會向什麼方向發展？帶着這些疑問，一探究竟吧！參與文末的話題互動

2024-03-26 11:34:43

利用RAG技術打破大模型幻覺

隨着人工智能技術的不斷進步，大模型在各個領域中發揮着越來越重要的作用。然而，大模型幻覺問題一直是制約其進一步發展的瓶頸。爲了解決這一問題，研究者們不斷探索新的技術和方法。近年來，一種名爲RAG（檢索增強生成）的技術備受關注，它通過結合知識圖

2024-03-21 00:28:34

與 NVIDIA 再次合作、深度參與 GTC，Zilliz 與全球頂尖開發者共迎 AI 變革時刻！

Zilliz 與全球的頂尖開發者齊聚 GTC 2024。近日，備受關注的 NVIDIA GTC 2024 已拉開序幕，來自世界各地的頂尖 AI 開發者齊聚美國加州聖何塞會議中心，共同探索行業未來。作爲去年被 NVIDIA CEO 黃仁

2024-03-19 21:26:53

多模態+大模型會帶來哪些“化學反應”？

導語：沒人懷疑，2024 年，AI 依然將是科技界的主角。上個月，OpenAI 推出了可以生成 60 秒高清視頻的視頻生成模型 Sora，掀起了對多模態模型的進一輪討論。多模態大模型技術的最新進展如何？這一波新技術，對於行業和消費者的體驗會

2024-03-15 13:45:01

婦女節：打開 AI 視界，成就“她力量”

根據國內招聘平臺獵聘發佈的《2024 女性人才數據洞察報告》，從 2023 年 3 月到 2024 年 2 月，女性在 AIGC 領域的求職人次同比增長了 190.49%。隨着人工智能時代的降臨，女性正以前所未有的姿態，在技術的助力下，蛻變

2024-03-09 01:06:57

AI安全白皮書 | “深度僞造”產業鏈調查以及四類防禦措施

以下內容，摘編自頂象防禦雲業務安全情報中心正在製作的《“深度僞造”視頻識別與防禦白皮書》，對“深度僞造”感興趣的網友，可前往頂象留言，在該白皮書完成後，會爲您免費寄送一份電子版。 “深度僞造”就是創建高度逼真的虛假視頻或虛假錄音，然

2024-03-08 00:45:22

24小時熱門文章

最新文章

最新評論文章