91欧美超碰AV自拍|国产成年人性爱视频免费看|亚洲 日韩 欧美一厂二区入|人人看人人爽人人操aV|丝袜美腿视频一区二区在线看|人人操人人爽人人爱|婷婷五月天超碰|97色色欧美亚州A√|另类A√无码精品一级av|欧美特级日韩特级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

調試神經(jīng)網(wǎng)絡的實用tips請查收

智能感知與物聯(lián)網(wǎng)技術研究所 ? 來源:機器之心 ? 作者:機器之心 ? 2021-06-15 14:12 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

神經(jīng)網(wǎng)絡的 debug 過程著實不容易,這里是一些有所幫助的 tips。基于神經(jīng)網(wǎng)絡的項目瓶頸通常并非對網(wǎng)絡的實現(xiàn)。有時候,在編寫了所有代碼并嘗試了一大堆超參數(shù)配置之后,網(wǎng)絡就是無法正常工作。尤其是面對著數(shù)百萬的參數(shù), 任何一個小變動都有可能前功盡棄。

在面對各種各樣的問題后,有人總結了一些幫助調試神經(jīng)網(wǎng)絡的實用 tips,希望能夠減少大家調試神經(jīng)網(wǎng)絡的成本。

檢查梯度問題

有時梯度是引發(fā)問題的原因。下面是幾種與梯度相關的調試方法:

數(shù)值計算每個權重的梯度。這通常被稱為「梯度檢查」,有助于確保正確計算梯度,其中一種方法是使用有限差分。

比較每個權重的大小和梯度的大小。要確保大小的比率是合理的。如果梯度大小遠小于權重大小,網(wǎng)絡將花費很長時間進行訓練。如果梯度大小與權重大小大致相同或更大,網(wǎng)絡將非常不穩(wěn)定,可能根本不會訓練。

檢查梯度爆炸或消失。如果梯度變?yōu)?0 或 nan/infinity,則可以確定網(wǎng)絡沒有被正確訓練。需要首先弄清楚為什么會發(fā)生爆炸 / 消失梯度,是否步數(shù)太大。一旦弄清楚梯度爆炸 / 消失的原因,就有各種解決方案來解決這個問題,例如添加殘差連接以更好地傳播梯度或簡單地使用較小的網(wǎng)絡。

激活函數(shù)也會導致梯度爆炸 / 消失。如果 sigmoid 激活函數(shù)的輸入太大,梯度將非常接近 0。隨著時間的推移檢查激活函數(shù)的輸入,然后確保這些輸入不會導致梯度始終為 0 或很大。

檢查訓練過程

經(jīng)常檢查網(wǎng)絡的訓練進度可以節(jié)省時間。以訓練貪吃蛇游戲為例,不是訓練網(wǎng)絡好幾天,然后再檢查網(wǎng)絡是否學到了什么,而是每十分鐘用當前學到的權重運行游戲。幾個小時后,如果我們注意到每次都在做同樣的事情并且獲得零獎勵,就知道可能有問題了,而這節(jié)省了幾天的訓練時間。

不要依賴定量輸出

如果只查看定量輸出,我們可能會錯過有用的調試信息。例如,在訓練語音翻譯網(wǎng)絡時,比起只檢查評估函數(shù)是否在減少,更重要的是閱讀翻譯后的語音以確保它有意義;當訓練一個用于圖像識別的網(wǎng)絡時,一定要確保手動檢查網(wǎng)絡提供的標簽。

不應該依賴定量輸出的原因有兩個:首先,評估函數(shù)中可能存在錯誤。如果只查看錯誤評估函數(shù)輸出的數(shù)字,可能需要數(shù)周時間才能意識到出現(xiàn)問題。其次,在神經(jīng)網(wǎng)絡輸出中可能存在無法定量顯示的錯誤模式。我們可能會意識到某個特定單詞總是被錯誤翻譯,或者在左上象限的圖像識別網(wǎng)絡總是錯誤的。這些觀察結果反過來可以幫助找到數(shù)據(jù)處理部分的代碼 bug,否則這些 bug 將被忽視。

嘗試小數(shù)據(jù)集

確定代碼是否存在 bug 或數(shù)據(jù)是否難以訓練的另一種方法是首先擬合較小的數(shù)據(jù)集,比如將數(shù)據(jù)集中 100000 個訓練示例修剪成只有 100 個甚至 1 個訓練示例。如果在一個訓練示例的情況下,網(wǎng)絡仍然有很高的測試錯誤,不能夠非常好地擬合數(shù)據(jù),那么幾乎可以肯定網(wǎng)絡代碼有問題。

嘗試更簡單的網(wǎng)絡

如果全尺寸網(wǎng)絡在訓練時遇到問題,可以嘗試使用層數(shù)較少的較小網(wǎng)絡,這樣可以更快地訓練。如果較小的網(wǎng)絡在全尺寸網(wǎng)絡失敗的情況下成功了,則表明全尺寸模型的網(wǎng)絡架構過于復雜。如果簡單網(wǎng)絡和全尺寸網(wǎng)絡都失敗,則代碼中可能存在 bug。

試著使用框架

如果沒有使用機器學習框架編寫神經(jīng)網(wǎng)絡的代碼,那么可以通過在機器學習框架中編寫相同的網(wǎng)絡架構來檢查問題何在。然后將打印語句放入非框架版本和框架版本中逐層比較輸出,直到找到打印語句出現(xiàn)差異的位置,即錯誤所在。如果在反向傳播期間發(fā)生錯誤,則可以從最后一層開始逐層打印權重的漸變,直到找到差異。但是此方法僅適用于網(wǎng)絡的第一次迭代,因為由于第一次迭代輸出的差異,第二次及以后的迭代將具有不同的起點。

責任編輯:lq6

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權轉載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報投訴

原文標題:神經(jīng)網(wǎng)絡debug太難了,這里有六個實用技巧

文章出處:【微信號:tyutcsplab,微信公眾號:智能感知與物聯(lián)網(wǎng)技術研究所】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    神經(jīng)網(wǎng)絡的初步認識

    日常生活中的智能應用都離不開深度學習,而深度學習則依賴于神經(jīng)網(wǎng)絡的實現(xiàn)。什么是神經(jīng)網(wǎng)絡?神經(jīng)網(wǎng)絡的核心思想是模仿生物神經(jīng)系統(tǒng)的結構,特別是大腦中神經(jīng)
    的頭像 發(fā)表于 12-17 15:05 ?339次閱讀
    <b class='flag-5'>神經(jīng)網(wǎng)絡</b>的初步認識

    自動駕駛中常提的卷積神經(jīng)網(wǎng)絡是個啥?

    在自動駕駛領域,經(jīng)常會聽到卷積神經(jīng)網(wǎng)絡技術。卷積神經(jīng)網(wǎng)絡,簡稱為CNN,是一種專門用來處理網(wǎng)格狀數(shù)據(jù)(比如圖像)的深度學習模型。CNN在圖像處理中尤其常見,因為圖像本身就可以看作是由像素排列成的二維網(wǎng)格。
    的頭像 發(fā)表于 11-19 18:15 ?2093次閱讀
    自動駕駛中常提的卷積<b class='flag-5'>神經(jīng)網(wǎng)絡</b>是個啥?

    CNN卷積神經(jīng)網(wǎng)絡設計原理及在MCU200T上仿真測試

    數(shù)的提出很大程度的解決了BP算法在優(yōu)化深層神經(jīng)網(wǎng)絡時的梯度耗散問題。當x&gt;0 時,梯度恒為1,無梯度耗散問題,收斂快;當x&lt;0 時,該層的輸出為0。 CNN
    發(fā)表于 10-29 07:49

    NMSIS神經(jīng)網(wǎng)絡庫使用介紹

    NMSIS NN 軟件庫是一組高效的神經(jīng)網(wǎng)絡內核,旨在最大限度地提高 Nuclei N 處理器內核上的神經(jīng)網(wǎng)絡的性能并最??大限度地減少其內存占用。 該庫分為多個功能,每個功能涵蓋特定類別
    發(fā)表于 10-29 06:08

    在Ubuntu20.04系統(tǒng)中訓練神經(jīng)網(wǎng)絡模型的一些經(jīng)驗

    本帖欲分享在Ubuntu20.04系統(tǒng)中訓練神經(jīng)網(wǎng)絡模型的一些經(jīng)驗。我們采用jupyter notebook作為開發(fā)IDE,以TensorFlow2為訓練框架,目標是訓練一個手寫數(shù)字識別的神經(jīng)網(wǎng)絡
    發(fā)表于 10-22 07:03

    CICC2033神經(jīng)網(wǎng)絡部署相關操作

    在完成神經(jīng)網(wǎng)絡量化后,需要將神經(jīng)網(wǎng)絡部署到硬件加速器上。首先需要將所有權重數(shù)據(jù)以及輸入數(shù)據(jù)導入到存儲器內。 在仿真環(huán)境下,可將其存于一個文件,并在 Verilog 代碼中通過 readmemh 函數(shù)
    發(fā)表于 10-20 08:00

    液態(tài)神經(jīng)網(wǎng)絡(LNN):時間連續(xù)性與動態(tài)適應性的神經(jīng)網(wǎng)絡

    1.算法簡介液態(tài)神經(jīng)網(wǎng)絡(LiquidNeuralNetworks,LNN)是一種新型的神經(jīng)網(wǎng)絡架構,其設計理念借鑒自生物神經(jīng)系統(tǒng),特別是秀麗隱桿線蟲的神經(jīng)結構,盡管這種微生物的
    的頭像 發(fā)表于 09-28 10:03 ?1256次閱讀
    液態(tài)<b class='flag-5'>神經(jīng)網(wǎng)絡</b>(LNN):時間連續(xù)性與動態(tài)適應性的<b class='flag-5'>神經(jīng)網(wǎng)絡</b>

    神經(jīng)網(wǎng)絡的并行計算與加速技術

    隨著人工智能技術的飛速發(fā)展,神經(jīng)網(wǎng)絡在眾多領域展現(xiàn)出了巨大的潛力和廣泛的應用前景。然而,神經(jīng)網(wǎng)絡模型的復雜度和規(guī)模也在不斷增加,這使得傳統(tǒng)的串行計算方式面臨著巨大的挑戰(zhàn),如計算速度慢、訓練時間長等
    的頭像 發(fā)表于 09-17 13:31 ?1145次閱讀
    <b class='flag-5'>神經(jīng)網(wǎng)絡</b>的并行計算與加速技術

    基于神經(jīng)網(wǎng)絡的數(shù)字預失真模型解決方案

    在基于神經(jīng)網(wǎng)絡的數(shù)字預失真(DPD)模型中,使用不同的激活函數(shù)對整個系統(tǒng)性能和能效有何影響?
    的頭像 發(fā)表于 08-29 14:01 ?3482次閱讀

    無刷電機小波神經(jīng)網(wǎng)絡轉子位置檢測方法的研究

    摘要:論文通過對無刷電機數(shù)學模型的推導,得出轉角:與三相相電壓之間存在映射關系,因此構建了一個以三相相電壓為輸人,轉角為輸出的小波神經(jīng)網(wǎng)絡來實現(xiàn)轉角預測,并采用改進遺傳算法來訓練網(wǎng)絡結構與參數(shù),借助
    發(fā)表于 06-25 13:06

    神經(jīng)網(wǎng)絡專家系統(tǒng)在電機故障診斷中的應用

    的診斷誤差。仿真結果驗證了該算法的有效性。 純分享帖,需要者可點擊附件免費獲取完整資料~~~*附件:神經(jīng)網(wǎng)絡專家系統(tǒng)在電機故障診斷中的應用.pdf【免責聲明】本文系網(wǎng)絡轉載,版權歸原作者所有。本文所用視頻、圖片、文字如涉及作品版權問題,
    發(fā)表于 06-16 22:09

    神經(jīng)網(wǎng)絡RAS在異步電機轉速估計中的仿真研究

    ,在一定程度上擴展了轉速估計范圍。 純分享帖,需要者可點擊附件免費獲取完整資料~~~*附件:神經(jīng)網(wǎng)絡RAS在異步電機轉速估計中的仿真研究.pdf【免責聲明】本文系網(wǎng)絡轉載,版權歸原作者所有。本文所用視頻、圖片、文字如涉及作品版權問題,
    發(fā)表于 06-16 21:54

    基于FPGA搭建神經(jīng)網(wǎng)絡的步驟解析

    本文的目的是在一個神經(jīng)網(wǎng)絡已經(jīng)通過python或者MATLAB訓練好的神經(jīng)網(wǎng)絡模型,將訓練好的模型的權重和偏置文件以TXT文件格式導出,然后通過python程序將txt文件轉化為coe文件,(coe
    的頭像 發(fā)表于 06-03 15:51 ?1253次閱讀
    基于FPGA搭建<b class='flag-5'>神經(jīng)網(wǎng)絡</b>的步驟解析

    面向未來量子通信與大物理研究線上研討會QA筆記查收

    4月8日及10日,《面向未來量子通信與大物理研究》線上研討會圓滿結束。感謝大家的觀看與支持!查收研討會筆記!
    的頭像 發(fā)表于 04-21 11:42 ?664次閱讀
    面向未來量子通信與大物理研究線上研討會QA筆記<b class='flag-5'>請</b><b class='flag-5'>查收</b>!

    NVIDIA實現(xiàn)神經(jīng)網(wǎng)絡渲染技術的突破性增強功能

    近日,NVIDIA 宣布了 NVIDIA RTX 神經(jīng)網(wǎng)絡渲染技術的突破性增強功能。NVIDIA 與微軟合作,將在 4 月的 Microsoft DirectX 預覽版中增加神經(jīng)網(wǎng)絡著色技術,讓開
    的頭像 發(fā)表于 04-07 11:33 ?1207次閱讀