2015在线精品自偷自拍无码,国产激情电影综合在线看

你的位置：首頁 > 測試測量 > 正文

六種方法解決LSTM循環(huán)神經(jīng)網(wǎng)絡(luò)中的超長序列問題

發(fā)布時(shí)間：2017-06-27 來源：Jason Brownlee 責(zé)任編輯：wenwei

【導(dǎo)讀】長短期記憶（LSTM）循環(huán)神經(jīng)網(wǎng)絡(luò)可以學(xué)習(xí)和記憶長段序列的輸入。如果你的問題對(duì)于每個(gè)輸入都有一個(gè)輸出（如時(shí)間序列預(yù)測和文本翻譯任務(wù)），那么 LSTM 可以運(yùn)行得很好。但 LSTM 在面臨超長輸入序列——單個(gè)或少量輸出的情形時(shí)就會(huì)遇到困難了。這種問題通常被稱為序列標(biāo)記，或序列分類。

其中的一些例子包括：

包含數(shù)千個(gè)單詞的文本內(nèi)容情緒分類（自然語言處理）。

分類數(shù)千個(gè)時(shí)間步長的腦電圖數(shù)據(jù)（醫(yī)療領(lǐng)域）。

分類數(shù)千個(gè) DNA 堿基對(duì)的編碼/非編碼基因序列（基因信息學(xué)）。

當(dāng)使用循環(huán)神經(jīng)網(wǎng)絡(luò)（如 LSTM）時(shí)，這些所謂的序列分類任務(wù)需要特殊處理。在這篇文章中，你將發(fā)現(xiàn) 6 種處理長序列的方法。

1. 原封不動(dòng)

原封不動(dòng)地訓(xùn)練/輸入，這或許會(huì)導(dǎo)致訓(xùn)練時(shí)間大大增長。另外，嘗試在很長的序列里進(jìn)行反向傳播可能會(huì)導(dǎo)致梯度消失，反過來會(huì)削弱模型的可靠性。在大型 LSTM 模型中，步長通常會(huì)被限制在 250-500 之間。

2. 截?cái)嘈蛄?/strong>

處理非常長的序列時(shí)，最直觀的方式就是截?cái)嗨鼈?。這可以通過在開始或結(jié)束輸入序列時(shí)選擇性地刪除一些時(shí)間步來完成。這種方式通過失去部分?jǐn)?shù)據(jù)的代價(jià)來讓序列縮短到可以控制的長度，而風(fēng)險(xiǎn)也顯而易見：部分對(duì)于準(zhǔn)確預(yù)測有利的數(shù)據(jù)可能會(huì)在這個(gè)過程中丟失。

3. 總結(jié)序列

在某些領(lǐng)域中，我們可以嘗試總結(jié)輸入序列的內(nèi)容。例如，在輸入序列為文字的時(shí)候，我們可以刪除所有低于指定字頻的文字。我們也可以僅保留整個(gè)訓(xùn)練數(shù)據(jù)集中超過某個(gè)指定值的文字?？偨Y(jié)可以使得系統(tǒng)專注于相關(guān)性最高的問題，同時(shí)縮短了輸入序列的長度。

4. 隨機(jī)取樣

相對(duì)更不系統(tǒng)的總結(jié)序列方式就是隨機(jī)取樣了。我們可以在序列中隨機(jī)選擇時(shí)間步長并刪除它們，從而將序列縮短至指定長度。我們也可以指定總長的選擇隨機(jī)連續(xù)子序列，從而兼顧重疊或非重疊內(nèi)容。

在缺乏系統(tǒng)縮短序列長度的方式時(shí)，這種方法可以奏效。這種方法也可以用于數(shù)據(jù)擴(kuò)充，創(chuàng)造很多可能不同的輸入序列。當(dāng)可用的數(shù)據(jù)有限時(shí)，這種方法可以提升模型的魯棒性。

5. 時(shí)間截?cái)嗟姆聪騻鞑?/strong>

除基于整個(gè)序列更新模型的方法之外，我們還可以在最后的數(shù)個(gè)時(shí)間步中估計(jì)梯度。這種方法被稱為「時(shí)間截?cái)嗟姆聪騻鞑ィ═BPTT）」。它可以顯著加速循環(huán)神經(jīng)網(wǎng)絡(luò)（如 LSTM）長序列學(xué)習(xí)的過程。

這將允許所有輸入并執(zhí)行的序列向前傳遞，但僅有最后數(shù)十或數(shù)百時(shí)間步會(huì)被估計(jì)梯度，并用于權(quán)重更新。一些最新的 LSTM 應(yīng)用允許我們指定用于更新的時(shí)間步數(shù)，分離出一部分輸入序列以供使用。例如：

Theano 中的「truncate_gradient」參數(shù)：deeplearning

6. 使用編碼器-解碼器架構(gòu)

你可以使用自編碼器來讓長序列表示為新長度，然后解碼網(wǎng)絡(luò)將編碼表示解釋為所需輸出。這可以是讓無監(jiān)督自編碼器成為序列上的預(yù)處理傳遞者，或近期用于神經(jīng)語言翻譯的編碼器-解碼器 LSTM 網(wǎng)絡(luò)。

當(dāng)然，目前機(jī)器學(xué)習(xí)系統(tǒng)從超長序列中學(xué)習(xí)或許仍然非常困難，但通過復(fù)雜的架構(gòu)和以上一種或幾種方法的結(jié)合，我們是可以找到辦法解決這些問題的。

其他瘋狂的想法

這里還有一些未被充分驗(yàn)證過的想法可供參考。

將輸入序列拆分為多個(gè)固定長度的子序列，并構(gòu)建一種模型，將每個(gè)子序列作為單獨(dú)的特征（例如并行輸入序列）進(jìn)行訓(xùn)練。

雙向 LSTM，其中每個(gè) LSTM 單元對(duì)的一部分處理輸入序列的一半，在輸出至層外時(shí)組合。這種方法可以將序列分為兩塊或多塊處理。

我們還可以探索序列感知編碼方法、投影法甚至哈希算法來將時(shí)間步的數(shù)量減少到指定長度。

推薦閱讀：

筆記本電腦的LVDS圖形切換

智能手機(jī)鍵盤控制器的一種實(shí)現(xiàn)方法

高性能射頻調(diào)制器促成多載波通信發(fā)送器設(shè)計(jì)

被動(dòng)元件持續(xù)缺貨原因何在？

數(shù)字接收機(jī)中高性能ADC和射頻器件的動(dòng)態(tài)性能要求

要采購編碼器么，點(diǎn)這里了解一下價(jià)格!

上一篇：單片機(jī)和PLD有何聯(lián)系與區(qū)別，盤點(diǎn)PLD入門知識(shí)點(diǎn)

下一篇：一文讀懂三極管的符號(hào)、分類及如何判斷極性

特別推薦

AMTS 2025展位預(yù)訂正式開啟——體驗(yàn)科技驅(qū)動(dòng)的未來汽車世界，共迎AMTS 20周年！
貿(mào)澤電子攜手安森美和Würth Elektronik推出新一代太陽能和儲(chǔ)能解決方案
功率器件熱設(shè)計(jì)基礎(chǔ)（六）——瞬態(tài)熱測量
貿(mào)澤開售Nordic Semiconductor nRF9151-DK開發(fā)套件
TDK推出用于可穿戴設(shè)備的薄膜功率電感器
日清紡微電子GNSS兩款新的射頻低噪聲放大器 (LNA) 進(jìn)入量產(chǎn)
中微半導(dǎo)推出高性價(jià)比觸控 MCU-CMS79FT72xB系列

技術(shù)文章更多>>

意法半導(dǎo)體推出首款超低功耗生物傳感器，成為眾多新型應(yīng)用的核心所在

是否存在有關(guān) PCB 走線電感的經(jīng)驗(yàn)法則？

智能電池傳感器的兩大關(guān)鍵部件: 車規(guī)級(jí)分流器以及匹配的評(píng)估板

功率器件熱設(shè)計(jì)基礎(chǔ)（八）——利用瞬態(tài)熱阻計(jì)算二極管浪涌電流

AHTE 2025展位預(yù)訂正式開啟——促進(jìn)新技術(shù)新理念應(yīng)用，共探多行業(yè)柔性解決方案

技術(shù)白皮書下載更多>>

車規(guī)與基于V2X的車輛協(xié)同主動(dòng)避撞技術(shù)展望

數(shù)字隔離助力新能源汽車安全隔離的新挑戰(zhàn)

汽車模塊拋負(fù)載的解決方案

車用連接器的安全創(chuàng)新應(yīng)用

Melexis Actuators Business Unit

Position / Current Sensors - Triaxis Hall

熱門搜索

生產(chǎn)測試聲表諧振器聲傳感器濕度傳感器石英機(jī)械表石英石危害時(shí)間繼電器時(shí)鐘IC 世強(qiáng)電訊示波器視頻IC 視頻監(jiān)控收發(fā)器手機(jī)開發(fā) 受話器數(shù)字家庭數(shù)字家庭數(shù)字鎖相環(huán) 雙向可控硅水泥電阻絲印設(shè)備伺服電機(jī) 速度傳感器鎖相環(huán) 胎壓監(jiān)測太陽能太陽能電池泰科源鉭電容碳膜電位器

六種方法解決LSTM循環(huán)神經(jīng)網(wǎng)絡(luò)中的超長序列問題

友情鏈接(QQ：317243736)