(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)

(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)

ID:18178801

大?。?69.50 KB

頁(yè)數(shù):6頁(yè)

時(shí)間:2018-09-15

(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)_第1頁(yè)
(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)_第2頁(yè)
(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)_第3頁(yè)
(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)_第4頁(yè)
(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)_第5頁(yè)
資源描述:

《(免費(fèi))基于dsp和fpga的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)》由會(huì)員上傳分享,免費(fèi)在線閱讀,更多相關(guān)內(nèi)容在教育資源-天天文庫(kù)。

1、基于DSP和FPGA的機(jī)器人聲控系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)1引言????????機(jī)器人聽覺(jué)系統(tǒng)主要是對(duì)人的聲音進(jìn)行語(yǔ)音識(shí)別并做出判斷,然后輸出相應(yīng)的動(dòng)作指令控制頭部和手臂的動(dòng)作,傳統(tǒng)的機(jī)器人聽覺(jué)系統(tǒng)一般是以PC機(jī)為平臺(tái)對(duì)機(jī)器人進(jìn)行控制,其特點(diǎn)是用一臺(tái)計(jì)算機(jī)作為機(jī)器人的信息處理核心通過(guò)接口電路對(duì)機(jī)器人進(jìn)行控制,雖然處理能力比較強(qiáng)大,語(yǔ)音庫(kù)比較完備,系統(tǒng)更新以及功能拓展比較容易,但是比較笨重,不利于機(jī)器人的小型化和復(fù)雜條件下進(jìn)行工作,此外功耗大、成本高。????本次設(shè)計(jì)采用了性價(jià)比較高的數(shù)字信號(hào)處理芯片TMS320VC5509作為語(yǔ)音識(shí)別處理器,具

2、有較快的處理速度,使機(jī)器人在脫機(jī)狀態(tài)下,獨(dú)立完成復(fù)雜的語(yǔ)音信號(hào)處理和動(dòng)作指令控制,F(xiàn)PGA系統(tǒng)的開發(fā)降低了時(shí)序控制電路和邏輯電路在PCB板所占的面積[1],使機(jī)器人的"大腦"的語(yǔ)音處理部分微型化、低功耗。一個(gè)體積小、低功耗、高速度能完成特定范圍語(yǔ)音識(shí)別和動(dòng)作指令的機(jī)器人系統(tǒng)的研制具有很大的實(shí)際意義。2系統(tǒng)硬件總體設(shè)計(jì)?????系統(tǒng)的硬件功能是實(shí)現(xiàn)語(yǔ)音指令的采集和步進(jìn)電機(jī)的驅(qū)動(dòng)控制,為系統(tǒng)軟件提供開發(fā)和調(diào)試平臺(tái)。如圖1所示。????系統(tǒng)硬件分為語(yǔ)音信號(hào)的采集和播放,基于DSP的語(yǔ)音識(shí)別,F(xiàn)PGA動(dòng)作指令控制、步進(jìn)電機(jī)及其驅(qū)動(dòng)、DSP外

3、接閃存芯片,JTAG口仿真調(diào)試和鍵盤控制幾個(gè)部分。工作流程是麥克風(fēng)將人的語(yǔ)音信號(hào)轉(zhuǎn)化為模擬信號(hào),在經(jīng)過(guò)音頻芯片TLV320AIC23量化轉(zhuǎn)化成數(shù)字信號(hào)輸入DSP.DSP完成識(shí)別后,輸出動(dòng)作指令。????FPGA根據(jù)DSP輸入的動(dòng)作指令產(chǎn)生正確的正反轉(zhuǎn)信號(hào)和準(zhǔn)確的脈沖給步進(jìn)電機(jī)驅(qū)動(dòng)芯片,驅(qū)動(dòng)芯片提供步進(jìn)電機(jī)的驅(qū)動(dòng)信號(hào),控制步進(jìn)電機(jī)的轉(zhuǎn)動(dòng)。片外FLASH用于存儲(chǔ)系統(tǒng)程序和語(yǔ)音庫(kù)并完成系統(tǒng)的上電加載。JTAG口用于與PC機(jī)進(jìn)行聯(lián)機(jī)在線仿真,鍵盤則用于參數(shù)調(diào)整和功能的切換。3語(yǔ)音識(shí)別系統(tǒng)設(shè)計(jì)3.1語(yǔ)音信號(hào)的特點(diǎn)????語(yǔ)音信號(hào)的頻率成分主要

4、分布在300~3400Hz之間,根據(jù)采樣定理選擇信號(hào)的采樣率為8kHz。語(yǔ)音信號(hào)的一個(gè)特點(diǎn)在于他的"短時(shí)性",有時(shí)在一個(gè)短時(shí)段呈現(xiàn)隨機(jī)噪聲的特性,而另一段表現(xiàn)周期信號(hào)的特性,或二者兼而有之。語(yǔ)音信號(hào)的特征是隨時(shí)間變化的,只有一段時(shí)間內(nèi),信號(hào)才表現(xiàn)穩(wěn)定一致的特征,一般來(lái)說(shuō)短時(shí)段可取5~50ms,因此語(yǔ)音信號(hào)的處理要建立在其"短時(shí)性"上[2],系統(tǒng)將語(yǔ)音信號(hào)幀長(zhǎng)設(shè)為20ms,幀移設(shè)為10ms,則每幀數(shù)據(jù)為160×16b。3.2語(yǔ)音信號(hào)的采集和播放????語(yǔ)音采集和播放芯片采用的是TI公司生產(chǎn)的TLV320AIC23B,TLV320AIC

5、23B的模數(shù)轉(zhuǎn)換(ADC)和數(shù)模轉(zhuǎn)換(DAC)部件高度集成在芯片內(nèi)部,芯片采用8k采樣率,單聲道模擬信號(hào)輸入,雙聲道輸出。TLV320AIC23具有可編程特性,DSP可通過(guò)控制接口來(lái)編輯該器件的控制寄存器,而且能夠編譯SPI,I2C兩種規(guī)格的接口,TLV320AIC23B與DSP5509的電路連接如圖2所示。????DSP采用I2C口對(duì)TLV320AIC23的寄存器進(jìn)行設(shè)置。當(dāng)MODE=O時(shí),為I2C規(guī)格的接口,DSP采用主發(fā)送模式,通過(guò)I2C口對(duì)地址為0000000~0001111的11個(gè)寄存器進(jìn)行初始化。I2C模式下,數(shù)據(jù)是分為

6、3個(gè)8b寫入的。而TLV320AIC23有7位地址和9位數(shù)據(jù),也就是說(shuō),需要把數(shù)據(jù)項(xiàng)上面的最高位補(bǔ)充到第二個(gè)8B中的最后一位。????MCBSP串口通過(guò)6個(gè)引腳CLKX,CLKR,F(xiàn)SX,F(xiàn)SR,DR和CX與TLV320AIC23相連。數(shù)據(jù)經(jīng)MCBSP串口與外設(shè)的通信通過(guò)DR和DX引腳傳輸,控制同步信號(hào)則由CLKX,CLKR,F(xiàn)SX,F(xiàn)SR四個(gè)引腳實(shí)現(xiàn)。將MCBSP串口設(shè)置為DSPMode模式,然后使串口的接收器和發(fā)送器同步,并且由TLV320AIC23的幀同步信號(hào)LRCIN,LRCOUT啟動(dòng)串口傳輸,同時(shí)將發(fā)送接收的數(shù)據(jù)字長(zhǎng)設(shè)定為

7、32b(左聲道16b,右聲道16b)單幀模式。3.3語(yǔ)音識(shí)別程序模塊的設(shè)計(jì)????為了實(shí)現(xiàn)機(jī)器人對(duì)非特定人語(yǔ)音指令的識(shí)別,系統(tǒng)采用非特定人的孤立詞識(shí)別系統(tǒng)。非特定人的語(yǔ)音識(shí)別是指語(yǔ)音模型由不同年齡、不同性別、不同口音的人進(jìn)行訓(xùn)練,在識(shí)別時(shí)不需要訓(xùn)練就可以識(shí)別說(shuō)話人的語(yǔ)音[2]。系統(tǒng)分為預(yù)加重和加窗,短點(diǎn)檢測(cè),特征提取,與語(yǔ)音庫(kù)的模式匹配和訓(xùn)練幾個(gè)部分。3.3.1語(yǔ)音信號(hào)的預(yù)加重和加窗????預(yù)加重處理主要是去除聲門激勵(lì)和口鼻輻射的影響,預(yù)加重?cái)?shù)字濾波H(Z)=1一KZ-1,其中是為預(yù)加重系數(shù),接近1,本系統(tǒng)中k取0.95。對(duì)語(yǔ)音序列

8、X(n)進(jìn)行預(yù)加重,得到預(yù)加重后的語(yǔ)音序列x(n):x(n)=X(n)一kX(n一1)(1)???系統(tǒng)采用一個(gè)有限長(zhǎng)度的漢明窗在語(yǔ)音序列上進(jìn)行滑動(dòng),用以截取幀長(zhǎng)為20ms,幀移設(shè)為10ms的語(yǔ)音信號(hào),采用漢明窗可以有效減少信號(hào)特征的丟

當(dāng)前文檔最多預(yù)覽五頁(yè),下載文檔查看全文

此文檔下載收益歸作者所有

當(dāng)前文檔最多預(yù)覽五頁(yè),下載文檔查看全文
溫馨提示:
1. 部分包含數(shù)學(xué)公式或PPT動(dòng)畫的文件,查看預(yù)覽時(shí)可能會(huì)顯示錯(cuò)亂或異常,文件下載后無(wú)此問(wèn)題,請(qǐng)放心下載。
2. 本文檔由用戶上傳,版權(quán)歸屬用戶,天天文庫(kù)負(fù)責(zé)整理代發(fā)布。如果您對(duì)本文檔版權(quán)有爭(zhēng)議請(qǐng)及時(shí)聯(lián)系客服。
3. 下載前請(qǐng)仔細(xì)閱讀文檔內(nèi)容,確認(rèn)文檔內(nèi)容符合您的需求后進(jìn)行下載,若出現(xiàn)內(nèi)容與標(biāo)題不符可向本站投訴處理。
4. 下載文檔時(shí)可能由于網(wǎng)絡(luò)波動(dòng)等原因無(wú)法下載或下載錯(cuò)誤,付費(fèi)完成后未能成功下載的用戶請(qǐng)聯(lián)系客服處理。