【目標檢測】Faster RCNN學習筆記

原創

2020-07-03 07:01

背景

R-CNN計算成本很高，但是各種推薦中共享卷積，成本已經大大降低，然而其訓練過程和測試依然非常慢
R-CNN方法端到端地對CNN進行訓練，將推薦區域分類爲目標類別或背景；R-CNN主要作爲分類器，並不能預測目標邊界，其準確度取決於區域推薦模塊的性能
在OverFeat方法中，訓練一個全連接層來預測假定單個目標定位任務的邊界框座標，然後將全連接層變成卷積層，用於檢測多個類別的目標
MultiBox方法從網絡中生成區域推薦，網絡最後的全連接層同時預測多個類別不相關的邊界框，並推廣到OverFeat的“單邊界框”方式
SPPNet和Fast R-CNN等研究已經大大降低了檢測網絡的運行時間，但是推薦區域的計算成了一個瓶頸
多尺度預測有兩種流行的方法。第一種方法是基於圖像/特徵金字塔，例如DPM。這種方法通常是有用的，但是非常耗時；第二種方法是在特徵映射上使用多尺度（和/或長寬比）的滑動窗口

Faster R-CNN的貢獻

在Fast R-CNN的基礎上，提出了RPN區域推薦網絡

目標推薦方法

基於超像素分組（如選擇性搜索、CPMC）
基於滑動窗口（如窗口中的目標、EdgeBoxes）
目標推薦方法被採用與外部模塊，且獨立於檢測器
Faster R-CNN創新性的提出了RPN方法

Faster R-CNN

由兩個模塊組成。第一個模塊是推薦區域的深度全卷積網絡，第二個模塊是使用推薦區域的Fast R-CNN檢測器
RPN，區域推薦網絡。以任意大小的圖像作爲輸入，輸出一組矩形的目標推薦，每個推薦都有一個目標得分
Anchors，錨點。在每個滑動窗口位置，同時預測多個區域推薦，每個位置可能推薦的最大數目表示爲k，所以在reg層中有4k個輸出，用於編碼k個邊界框的座標，cls層輸出2k個分數，用於估計目標是或不是的可能性，如上圖的中間所見
基於錨點方法建立錨點金字塔上，更具成本效益。方法參照多尺度和長寬比的錨盒來分類和迴歸邊界框

訓練RPN

RPN可以通過反向傳播和隨機梯度下降（SGD）進行端對端訓練,遵循“以圖像爲中心”的採樣策略來訓練這個網絡
在圖像中隨機採樣256個錨點，計算一個小批量數據的損失函數，其中採樣的正錨點和負錨點的比率可達1:1
從標準方差爲0.01的零均值高斯分佈中提取權重來隨機初始化所有新層，所有其他層（即共享卷積層）通過預訓練的ImageNet分類模型來初始化，調整ZF網絡的所有層，以及VGG網絡的conv3_1及其之上的層以節省內存。對於60k的小批量數據，使用0.001的學習率，對於PASCAL VOC數據集中的下一個20k小批量數據，使用0.0001。使用0.9的動量和0.0005的重量衰減

訓練共享特徵的網絡

對於檢測網絡，採用Fast R-CNN
獨立訓練的RPN和Fast R-CNN將以不同的方式修改卷積層
需要開發出一種允許在兩個網絡之間共享卷積層的技術，即訓練共享特徵的網絡：
(一）交替訓練（二）近似聯合訓練（三）非近似的聯合訓練

參考：
論文翻譯：https://blog.csdn.net/Quincuntial/article/details/79132251
其它：https://blog.csdn.net/liuxiaoheng1992/article/details/81843363
https://blog.csdn.net/qq_41375609/article/details/94749596

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

5月21日相聚上海張江！與文心大模型一起共建大模型產業應用生態圈

5月21日，文心中國行將走進上海，在張江科學會堂舉行。屆時，政府、企業與高校的相關專家和業界同仁將現場分享生成式人工智能與大模型最新進展，主要圍繞大模型技術如何賦能產業級應用創新展開探討，還有百度風投從投資視角帶來的觀點，讓參會者全方位瞭解

2024-05-17 00:28:21

網絡爬蟲安全：90後小夥，用軟件非法搬運他人原創視頻被判刑

央視《今日說法》欄目近日報道了一名程序員開發非法視頻搬運軟件獲利超700多萬，最終獲刑的案例。國內某知名短視頻平臺報警稱，有人在網絡上售賣一款視頻搬運軟件，使用軟件的人可以繞過平臺的審覈機制，一鍵“搬運”竊取他人作品非法轉載投稿。警方調查

2024-05-16 00:19:26

探索大語言模型：理解Self Attention| 京東物流技術團隊

一、背景知識在ChatGPT引發全球關注之後，學習和運用大型語言模型迅速成爲了熱門趨勢。作爲程序員，我們不僅要理解其表象，更要探究其背後的原理。究竟是什麼使得ChatGPT能夠實現如此卓越的問答性能？自注意力機制的巧妙融入無疑是關鍵因素

2024-05-14 23:57:26

GPU 硬件指標說明

流處理器：也叫渲染管、着色器。畫面都是由一個又一個像素點組成的，而流處理器就負責這些像素點的渲染工作； RT核心：光追核心，用作於光線追蹤效果； CUDA 核心和Tensor 核心：CUDA Core和Tensor Core，爲G

2024-05-13 22:35:43

舌尖上的AI：人工智能技術正在被“端上”餐桌

來源 | 人民數字FINTECH 責編 | 晉兆雨頭圖 | CSDN 下載自視覺中國 #人工智能技術正在被“端上”餐桌四方食事，不過一碗人間煙火。人工智能作爲一門新的技術科學，正在被人間煙火氣“端”上餐桌。人工智能“洗手”

2024-05-13 21:17:25

攻擊者正在利用AI，對保險公司發起大規模欺詐

保險欺詐一直是保險行業面臨的重要挑戰之一，尤其隨着技術的進步，欺詐者也在不斷更新其手段，利用AI技術，包括生成式模型、機器學習和數據分析工具等欺騙保險公司，而AI技術的應用正成爲他們的新工具，使其犯罪行爲更加隱蔽和複雜，挑戰保險行業的防欺詐

2024-05-10 00:55:17

AIGC在京東廣告創意的技術應用

一、前言電商廣告圖片不僅能夠抓住消費者的眼球，還可以傳遞品牌核心價值和故事，建立起與消費者之間的情感聯繫。然而現有的廣告圖片大多依賴人工製作，存在效率和成本的限制。儘管最近AIGC技術取得了卓越的進展，但其在廣告圖片的應

京東雲開發者

2024-05-08 23:24:18

AI繪圖新選擇：Fooocus工具發佈，小顯存助力大模型運行

隨着人工智能技術的飛速發展，AI繪圖工具已經成爲了衆多創作者們的得力助手。它們能夠基於深度學習算法，快速生成高質量的圖像，爲設計、藝術等領域注入了新的活力。然而，傳統的AI繪圖工具往往對硬件要求較高，使得許多擁有較低配置設備的用戶望而卻步。

2024-05-07 23:30:10

GLM國產大模型訓練加速：高效性能與成本優化的實踐

隨着人工智能技術的不斷進步，大模型的訓練成爲了推動深度學習領域發展的重要力量。然而，傳統的訓練方式往往面臨着性能瓶頸和高昂的成本問題，這使得許多研究者和開發者望而卻步。爲了解決這一難題，我們探索了使用OneFlow框架對GLM國產大模型進行

2024-05-07 23:30:09

LoRA微調語言大模型的實用技巧

一、引言隨着深度學習技術的快速發展，語言大模型在自然語言處理領域取得了顯著的進展。然而，傳統的微調方法通常需要大量的計算資源和時間，對於實際應用來說並不友好。爲了解決這個問題，LoRA微調技術應運而生。LoRA（Low-Rank Adap

2024-04-28 11:30:13

京東廣告研發——效率爲王：廣告統一檢索平臺實踐

1、系統概述實踐證明，將互聯網流量變現的在線廣告是互聯網最成功的商業模式，而電商場景是在線廣告的核心場景。京東服務中國數億的用戶和大量的商家，商品池海量。平臺在兼顧用戶體驗、平臺、廣告主收益的前提推送商品具有挑戰性。京東廣告檢索平臺

2024-04-25 23:17:47

Stable Diffusion中的embedding

Stable Diffusion中的embedding 嵌入，也稱爲文本反轉，是在 Stable Diffusion 中控制圖像樣式的另一種方法。在這篇文章中，我們將學習什麼是嵌入，在哪裏可以找到它們，以及如何使用它們。什麼是嵌入embe

2024-04-25 21:31:13

大模型區域落地再加速！百度“文心中國行”西部首站落地成都錦江

4 月 24 日，“文心中國行”西部地區首站落地成都錦江。成都市錦江區白鷺灣新經濟總部功能區、錦江區投資促進局與百度飛槳攜手合作，打造成都人工智能的新產業、新模式、新業態。來自成都政產學研各界的領導、專家、企業嘉賓，共同探討如何降低 AI

2024-04-25 11:41:53

文心中國行走進成都！4 月 24 日一起把握大模型時代的產業新機遇

4 月 24 日，文心中國行將走進成都。屆時，政府、企業與高校的相關專家和業界同仁將現場分享生成式人工智能與大模型最新進展，從人工智能政策解讀、大模型技術，到產業創新應用的實踐案例，讓參會者全方位瞭解大模型時期的發展與創新機遇。大會還特別

2024-04-23 11:41:07

文心大模型“你說我畫”：PaddleHub與PaddleSpeech的協同實踐

在人工智能領域中，自然語言處理和計算機視覺是兩個非常活躍的研究方向。隨着深度學習技術的發展，這兩個領域之間的交叉融合產生了許多令人興奮的應用場景。其中，“你說我畫”就是這樣一個結合自然語言處理和計算機視覺技術的創新應用。 “你說我畫”的核心

2024-04-22 11:29:20

24小時熱門文章

最新文章

最新評論文章