基於DSP與FPGA的機器人聲控系統設計方案

2021-01-09 電子產品世界

  1 引言

本文引用地址:http://www.eepw.com.cn/article/273867.htm

  機器人聽覺系統主要是對人的聲音進行語音識別並做出判斷,然後輸出相應的動作指令控制頭部和手臂的動作,傳統的機器人聽覺系統一般是以PC機為平臺對機器人進行控制,其特點是用一臺計算機作為機器人的信息處理核心通過接口電路對機器人進行控制,雖然處理能力比較強大,語音庫比較完備,系統更新以及功能拓展比較容易,但是比較笨重,不利於機器人的小型化和複雜條件下進行工作,此外功耗大、成本高。

  本次設計採用了性價比較高的數位訊號處理晶片TMS320VC5509作為語音識別處理器,具有較快的處理速度,使機器人在脫機狀態下,獨立完成複雜的語音信號處理和動作指令控制,FPGA系統的開發降低了時序控制電路和邏輯電路在PCB板所佔的面積,使機器人的"大腦"的語音處理部分微型化、低功耗。一個體積小、低功耗、高速度能完成特定範圍語音識別和動作指令的機器人系統的研製具有很大的實際意義。

  2 系統硬體總體設計

  系統的硬體功能是實現語音指令的採集和步進電機的驅動控制,為系統軟體提供開發和調試平臺。如圖1所示。

  

 

  系統硬體分為語音信號的採集和播放,基於DSP的語音識別,FPGA動作指令控制、步進電機及其驅動、DSP外接快閃記憶體晶片,JTAG口仿真調試和鍵盤控制幾個部分。工作流程是麥克風將人的語音信號轉化為模擬信號,在經過音頻晶片TLV320AIC23量化轉化成數位訊號輸入DSP.DSP完成識別後,輸出動作指令。

  FPGA根據DSP輸入的動作指令產生正確的正反轉信號和準確的脈衝給步進電機驅動晶片,驅動晶片提供步進電機的驅動信號,控制步進電機的轉動。片外 FLASH用於存儲系統程序和語音庫並完成系統的上電加載。JTAG口用於與PC機進行聯機在線仿真,鍵盤則用於參數調整和功能的切換。

  3 語音識別系統設計

  3.1 語音信號的特點

  語音信號的頻率成分主要分布在300~3400Hz之間,根據採樣定理選擇信號的採樣率為8 kHz。語音信號的一個特點在於他的"短時性",有時在一個短時段呈現隨機噪聲的特性,而另一段表現周期信號的特性,或二者兼而有之。語音信號的特徵是隨時間變化的,只有一段時間內,信號才表現穩定一致的特徵,一般來說短時段可取5~50 ms,因此語音信號的處理要建立在其"短時性"上[2],系統將語音信號幀長設為20 ms,幀移設為10 ms,則每幀數據為160×16 b。

  3.2 語音信號的採集和播放

  語音採集和播放晶片採用的是TI公司生產的TLV320AIC23B,TLV320AIC23B的模數轉換(ADC)和數模轉換(DAC)部件高度集成在晶片內部,晶片採用8 k採樣率,單聲道模擬信號輸入,雙聲道輸出。TLV320AIC23具有可編程特性,DSP可通過控制接口來編輯該器件的控制寄存器,而且能夠編譯 SPI,I2C兩種規格的接口,TLV320AIC23B與DSP5509的電路連接如圖2所示。

  

 

  DSP採用I2C口對TLV320AIC23的寄存器進行設置。當MODE=O時,為I2C規格的接口,DSP採用主發送模式,通過I2C口對地址為 0000000~0001111的11個寄存器進行初始化。I2C模式下,數據是分為3個8 b寫入的。而TLV320AIC23有7位地址和9位數據,也就是說,需要把數據項上面的最高位補充到第二個8 B中的最後一位。

  MCBSP串口通過6個引腳CLKX,CLKR,FSX,FSR,DR和CX與TLV320AIC23相連。數據經MCBSP串口與外設的通信通過DR和 DX引腳傳輸,控制同步信號則由CLKX,CLKR,FSX,FSR四個引腳實現。將MCBSP串口設置為DSP Mode模式,然後使串口的接收器和發送器同步,並且由TLV320AIC23的幀同步信號LRCIN,LRCOUT啟動串口傳輸,同時將發送接收的數據字長設定為32 b(左聲道16 b,右聲道16 b)單幀模式。

  3.3 語音識別程序模塊的設計

  為了實現機器人對非特定人語音指令的識別,系統採用非特定人的孤立詞識別系統。非特定人的語音識別是指語音模型由不同年齡、不同性別、不同口音的人進行訓練,在識別時不需要訓練就可以識別說話人的語音[2]。系統分為預加重和加窗,短點檢測,特徵提取,與語音庫的模式匹配和訓練幾個部分。

  3.3.1 語音信號的預加重和加窗

  預加重處理主要是去除聲門激勵和口鼻輻射的影響,預加重數字濾波H(Z)=1一KZ-1,其中是為預加重係數,接近1,本系統中k取0.95。對語音序列X(n)進行預加重,得到預加重後的語音序列

  x(n):x(n)=X(n)一kX(n一1) (1)

  系統採用一個有限長度的漢明窗在語音序列上進行滑動,用以截取幀長為20 ms,幀移設為10 ms的語音信號,採用漢明窗可以有效減少信號特徵的丟失。

  3.3.2 端點檢測

  端點檢測在詞與詞之間有足夠時間間隙的情況下檢測出詞的首末點,一般採用檢測短時能量分布,方程為:

  

 

  其中,x(n)為漢明窗截取語音序列,序列長度為160,所以N取160,為對於無音信號E(n)很小,而對於有音信號E(n)會迅速增大為某一數值,由此可以區分詞的起始點和結束點。

  3.3.3特徵向量提取

  特徵向量是提取語音信號中的有效信息,用於進一步的分析處理。目前常用的特徵參數包括線性預測倒譜係數LPCC、美爾倒譜係數MFCC等。語音信號特徵向量採用Mel頻率倒譜係數MFCC(Mel Frequency Cepstrum Coeficient的提取,MFCC參數是基於人的聽覺特性的,他利用人聽覺的臨界帶效應,採用MEL倒譜分析技術對語音信號處理得到MEL倒譜係數矢量序列,用MEL倒譜係數表示輸入語音的頻譜。在語音頻譜範圍內設置若干個具有三角形或正弦形濾波特性的帶通濾波器,然後將語音能量譜通過該濾波器組,求各個濾波器輸出,對其取對數,並做離散餘弦變換(DCT),即可得到MFCC係數。MFCC係數的變換式可簡化為:

  

 

  其中,i為三角濾波器的個數,本系統選P為16,F(k)為各個濾波器的輸出數據,M為數據長度。

  3.3.4 語音信號的模式匹配和訓練

  模型訓練即將特徵向量進行訓練建立模板,模式匹配即將當前特徵向量與語音庫中的模板進行匹配得出結果。語音庫的模式匹配和訓練採用隱馬爾可夫模型HMM (Hidden Markov Models),他是一種統計隨機過程統計特性的概率模型一個雙重隨機過程,因為隱馬爾可夫模型能夠很好地描述語音信號的非平穩性和可變性,因此得到廣泛的使用。

  HMM的基本算法有3種:Viterbi算法,前向一後向算法,Baum-Welch算法。本次設計使用Viterbi算法進行狀態判別,將採集語音的特徵向量與語音庫的模型進行模式匹配。Baum-Welch算法用來解決語音信號的訓練,由於模型的觀測特徵是幀間獨立的,從而可以使用Baum- Welch算法進行HMM模型的訓練。

  3.4 語音識別程序的DSP開發

  DSP的開發環境為CCS3.1及。DSP/BIOS,將語音識別和訓練程序分別做成模塊,定義為不同的函數,在程序中調用。定義語音識別器函數為int Recognizer(int Micin),識別結果輸出函數為int Result(void),語音訓練器函數為int Train(int Tmode,int Audiod),動作指令輸入函數為int Keyin(int Action)。

  語音識別器的作用是將當前語音輸入變換成語音特徵向量,並對語音庫的模板進行匹配並輸出結果,語音應答輸出函數將獲取的語音識別結果對應的語音應答輸出,語音訓練是將多個不同年齡、不同性別、不同口音的人語音指令輸入轉化為訓練庫的模板。為防止樣本錯誤,每個人的語音指令需要訓練2次,對於2次輸入用用歐氏距離去進行模式匹配,若2次輸入相似度達到95%,則加入樣本集。語音應答輸入函數是為每個語音庫中模板輸入對立的語音輸出,以達到語言應答目的。系統工作狀態為執行語言識別子程序,訓練時執行外部中斷,執行訓練函數,取得資料庫模板,訓練完畢返回。程序框圖如圖3所示。

  

 

  4 機器人的動作控制系統設計

  4.1 FPGA邏輯設計

  系統通過語音控制機器人頭部動作,頭部運動分為上下和左右運動2個自由度,需要2個步進電機控制,DSF完成語音識別以後,輸出相應的動作指令,動作執行結束後,DSP發出歸零指令,頭部回到初試狀態。FPGA的作用是提供DSP接口邏輯,設置存儲DSP指令的RAM塊,同時產生步進電機驅動脈衝控制步進電機轉動方向和角度。

  FPGA器件為動作指令控制單元,設計採用FLEXlOKE晶片,接收DSP數據後並行控制2路步進電機。FPGA內部結構邏輯如圖4所示,FPGA內部設置2個元件為電機脈衝發生器,控制電機的工作脈衝以及正反轉。AO~A7為DSP數據輸入埠,WR為數據寫埠,P1,P2為2個步進電機驅動晶片脈衝輸入口,L1,L2為電機正反轉控制口,ENABLE為使能信號。

  

 

  RAM1和RAM2分別為2個步進電機的指令寄存器,電機脈衝發生器發出與RAM中相應數量的方波脈衝。DSP通過DO~D8數據端輸出8位指令,其中。 D8為RAM選擇,為1時選擇RAM1,為0時選擇RAM0,DO~D7為輸出電機角度,電極上下和左右旋轉角度為120°,精度為1°,初始值都為 60°,DO~D7的範圍為00000000~11111000,初始值為00111100。FPGA作為步進脈衝發生器,通過時鐘周期配置控制電機轉速,與初始值對應坐標決定正反轉。系統動作指令程序如圖5所示。

  

 

  其中R1為DSP指令寄存器,R2為當前坐標寄存器,通過DSP的輸出坐標與FPGA的當前坐標進行差值運算來確定步進電機的旋轉方向和旋轉角度,優點是可以根據新的輸入指令的變化,結束當前動作以運行新的指令,指令執行完畢後,系統清零,步進電機回到初始狀態。

  4.2 FPGA邏輯仿真

  FPGA以MAX-PLUSⅡ開發平臺,用語言為VHDL語言對上述邏輯功能進行設計,並通過JTAG接口進行了調試,FLEXl0KE晶片能夠根據DSP輸出指令輸出正確的正反轉信號和脈衝波形。

  4.3 步進電機驅動設計

  FPGA通過P1,L1,P2,L2輸出控制控制步進電機驅動晶片。步進電機驅動採用的是東芝公司生產的單片正弦細分二相步進電機驅動專用晶片TA8435H,FPGA與TA8435H電路連接如圖6。

  

 

  由於FLEX1OKE和TMS320VC5509工作電壓為3.3 V,而TA8435H為5 V和25 V,所以管腳連接使用光電耦合器件TLP521,使兩邊電壓隔離。CLK1為時鐘輸入腳,CW/CCW為正反轉控制腳,A,A,B,B為二相步進電機輸入。

  5 結 語

  系統充分利用了DSP的高處理速度和可擴展的片外存儲空間,具有高速、實時、識別率高的特點並支持大的語音庫,FPGA的使用使系統電路獲得簡化,一片 FLEXl0KE晶片可以完成2個步進電機的時序控制。雖然在處理速度和語音庫的存儲容量上與PC機系統具有一定的差距,但在機器人的微型化、低功耗和特定功能實現上,以DSP和FPGA為核心的嵌入式系統無疑具有廣闊的前景。

相關焦點

  • 基於FPGA技術的全方位移動機器人運動控制系統的方案設計
    本文研究了一種用FPGA技術實現三輪全方位移動機器人運動控制系統的方法,與雙DSP結構,DSP+CPLD結構,以及DSP+專用集成電路結構等相比,該方法具有簡單可靠,擴展性強等特點。且FPGA設計簡單,使用方便,開發周期短,能夠實現真正的SOPC系統。
  • 基於FPGA的八通道超聲探傷系統設計
    摘要:文中提出了一種基於FPGA的八通道超聲探傷系統設計方案。該系統利用低功耗可變增益運放和八通道ADC構成高集成度的前端放大和數據採集模塊;採用FPGA和ARM作為數位訊號處理的核心和人機互動的通道。
  • 基於FPGA的通用CNN加速設計
    要做一些計算加速的工作,入手先要想好幾個問題: 要加速的是什麼應用,應用的瓶頸是什麼,再針對這個瓶頸,參考前人工作選擇合適的方案。過早地執著於fpga的技術細節容易護士許多的細節。現在software define network/flash/xxx,已然大勢所趨。   WHEN?
  • 基於FPGA的RS232行列式矩陣鍵盤接口設計
    一、引言本文引用地址:http://www.eepw.com.cn/article/245960.htm本方案是用VHDL語言來實現的基於RS232按位串行通信總線的行列式矩陣鍵盤接口電路,具有復位和串行數據的接收與發送功能,根據發光二極體led0
  • 一種基於FPGA的視頻圖像畫面分割器設計
    最後,按照數字視頻圖像的數據格式,將四路視頻圖像合成一路編碼輸出,實現了四路視頻圖像分割的功能,提高了系統集成度,並可根據系統需要修改設計和進一步擴展功能,增加了系統的靈活性,適用於多種不同領域。本文引用地址:http://www.eepw.com.cn/article/236794.htm隨著計算機、DSP、超大規模集成電路等技術的發展,畫面分割器開始採用硬體設計。
  • 基於STM32的家庭服務機器人系統設計
    當前,大部分的家庭服務機器人不具備行走功能或只具有簡單的避障能力,機器人的研究很多依賴於仿真實現,但是現實情況和仿真結果可能大相逕庭。也有一些研究將問題複雜化,反而走了更多的彎路。  針對當前家庭服務機器人的不足和現代智能服務機器人的要求,本文提出一種基於STM32的家庭服務機器人系統的設計方案。
  • 基於FPGA的3G/HD/SD-SDI信號光纖傳輸系統的設計
    編者按:介紹了基於FPGA和高速串行復接/解復接技術,將3G/HD/SD-SDI信號通過光纖實現無損長距離傳輸的方法。與傳統的傳輸方案相比,此方案可以完成傳輸高清視頻的平滑升級,並向下兼容現有的視頻傳輸網絡,降低了網絡的改造升級成本。
  • 「每周FPGA案例」基於FPGA的超聲波測距系統設計
    1.1 總體設計1.1.1 概述學習了明德揚至簡設計法和明德揚設計規範,本人用FPGA設計了一個測距系統。該系統採用超聲波進行測量距離再在數碼管上顯示。在本案例的設計過程中包括了超聲波的驅動、三線式數碼管顯示等技術。
  • 基於SoC+FPGA平臺快速動態加載驅動開發及實現
    摘要:以TI公司的OMAP-L138型號雙核處理器單片系統(SoC)與ALTERA公司 EP3C80F484型號FPGA為核心的嵌入式硬體平臺,介紹了SoC與FPGA通過高速SPI接口實現固件動態加載的方法,以及基於Linux的SoC對FPGA快速動態加載驅動程序開發的原理及步驟。
  • 通過人工智慧實現的dsp晶片,最大的優勢是什麼
    人工智慧的大多數技術都可以在現有的晶片架構上進行實現,但dsp架構的精度(即頻率)是非常高的。以晶片十年後能實現的某種功能(如圖像識別,視頻分析等)為例,人工智慧所需要的計算能力遠比晶片能預期實現的計算能力高得多。
  • 基於FPGA的司機眼球跟蹤疲勞檢測報警系統
    基於FPGA的司機眼球跟蹤疲勞報警系統可以很好的解決上述問題,且相較於傳統的DSP實現具有集成度高、處理速度快、功能更強大、方便改進內部設計等諸多優點。1、研究意義視頻實時跟蹤作為一個應用性研究方向,其應用愈加廣泛,如軍事、航空、防盜、視頻會議等場合,特別是重要場合的安檢系統成為新的應用領域。
  • 基於51系列單片機的智能照明控制系統設計方案
    目前我國高校的教學樓和學生宿舍的照明系統大多採用定時方式控制,存在電能的大量浪費和照明模式不靈活等問題。本文基於51單片機,通過設置時間、感應光照與聲音,針對教學樓和宿舍的不同需求設定照明狀態,實現對照明系統智能動態的控制。測試結果表明該系統可以在不同條件下改變照明狀態,適應不同場所的需求,達到智能控制的目的。
  • 基於FPGA的高速PID控制器設計與仿真
    其設計技術成熟,長期以來形成了典型的結構,參數整定方便,結構更改靈活,能滿足一般控制的要求。  採用這種結構設計的控制系統,其性能只能與原連續控制系統性能接近而不會超過,逼近的精度與被變換的連續數學模型大小及採樣周期長短有關 [1]。特別是在高速運動控制的情況下,採樣周期的影響更大,採樣周期相對較長時,逼近程度才較好,但是對PID控制算法的運算速度及迴路的調節時間等也 提出了更高的要求。
  • 基於FPGA+Python的定點平方根實現
    Python是一種簡單易學並且功能強大的程式語言,並具有強大的軟硬體描述能力,MyHDL採用Python擴展包的形式使其能支持硬體設計和仿真並在仿真結果符合要求後可將軟體算法自動轉換為相應的Verilog 或VHDL硬體描述。本文試圖採用這種新的基於Python的軟硬體設計方法在FPGA上實現定點平方根。
  • 神級經典設計案例:用ARM和FPGA搭建神經網絡處理器通信方案
    嵌入式便攜設備也越來越多地得到應用,多數是基於ARM內核及現場可編程門陣列FPGA的嵌入式應用。某人工神經網絡的FPGA處理器能夠對數據進行運算處理,為了實現集數據通信、操作控制和數據處理於一體的可攜式神經網絡處理器,需要設計一種基於嵌入式ARM內核及現場可編程門陣列FPGA的主從結構處理系統滿足要求。
  • 基於DSP和電壓反饋的機器人多軸運動控制器的設計
    傳統的機器人控制器大多以80C196系列單片機作為處理器,當採用12MHz晶振時,其狀態周期為167ns,機器周期為1ms,不能滿足機器人控制的需要。  DSP晶片處理速度可以達到幾納秒,甚至更高,非常適合於機器人控制。因此,本文選用DSP來代替原有的單片機,同時藉助底層電壓反饋技術,設計出一種分布式機器人多軸運動控制器。
  • 基於ARM-Linux多功能機器人的設計
    ARM處理器是一種高性能、低成本、低功耗的RISC晶片,並移植功能強大、運行穩定的Linux作業系統能使系統的成本、實時性、功耗等性能指標得以改善。基於以上考慮,文中選用基於ARM處理器的嵌入式平臺,通過設計視頻採集模塊、語音識別模塊、無線傳輸模塊,構建一個相對完善的多功能機器人。可應用於無人工廠、倉庫、服務機器人、未知路線探測和人類不能存在或長期存在等環境中。
  • 基於FPGA的Gzip解壓縮硬體設計
    fpga相關文章:fpga是什麼