人工基礎 3-1 語音識別_第1頁
人工基礎 3-1 語音識別_第2頁
人工基礎 3-1 語音識別_第3頁
人工基礎 3-1 語音識別_第4頁
人工基礎 3-1 語音識別_第5頁
已閱讀5頁,還剩12頁未讀 繼續免費閱讀

下載本文檔

版權說明:本文檔由用戶提供并上傳,收益歸屬內容提供方,若內容存在侵權,請進行舉報或認領

文檔簡介

1語音識別模塊3:感知人機語音交互授課人:宋楚平手機美圖視頻監控語音互動機器人智能音箱為啥機器能說話?一、語音識別簡史語音識別(SpeechRecognition,SR)是指將人說的話自動轉換為文字或機器可以理解的指令的過程。1952年,貝爾實驗室研究出世界上第一個識別10個英文數字發音的識別系統1960年,英國的德內斯等人成功研究出第一個計算機語音識別系統20世紀80年代后,研究思路由基于標準模板匹配的技術轉向基于統計模型的技術2010年之后,基于深度神經網絡和分布式計算成為語音識別技術的主流機器學習的一般流程二、語音識別過程五個關鍵要素語音信號處理特征提取聲學模型語言模型解碼搜索二、語音識別過程1、語音信號處理連續的模擬信號時間上離散的數字信號二、語音識別過程提取出聲音最具辨識度的主要成分,過濾掉其他無關信息特征提取四步驟預加重分幀加窗和傅里葉轉換提取特征2、特征提取二、語音識別過程提取出聲音最具辨識度的主要成分,過濾掉其他無關信息特征提取四步驟預加重分幀加窗和傅里葉轉換提取特征2、特征提取二、語音識別過程提取出聲音最具辨識度的主要成分,過濾掉其他無關信息特征提取四步驟預加重分幀加窗和傅里葉轉換提取特征2、特征提取語音能量譜二、語音識別過程提取出聲音最具辨識度的主要成分,過濾掉其他無關信息特征提取四步驟預加重分幀加窗和傅里葉轉換提取特征2、特征提取各幀的FBank特征頻譜圖,即特征圖二、語音識別過程3、聲學模型聲學特征建模單元若干音素隱馬爾可夫聲學模型語音特征向量聲學得分二、語音識別過程4、語言模型音素文字的概率5、解碼搜索聲學模型語言模型發音詞典解碼搜索語音特征文本三、語音識別新技術及應用端到端一體化模型1語音識別新技術大規模自監督預訓練2噪聲魯棒與自適應前端3多模態融合4三、語音識別新技術及應用語音識別新應用實時語音生成字幕語音助手智能車載語音控制門診病歷語音轉寫三、語音識別新技術及應用語音識別新應用仿生機器人ASR支持在線學習智能話筒聲紋認證暢享語音識別的新場景討論語音識別在未來的新場景應用場景用于描述意義或價值①新醫療記錄助手②居家陪聊機器人③兒童智能圖書④車載智能助手⑤智能會議屏……學生分享及教師點評分享要點分值計分教師點評1、你的想法來自哪里?10頭腦風暴、獨立思考2、你的研討是否有其他學生參與?10集思廣益、團結協助3、語音識別技術對場景應用的革命性影響?30積極思考、敢于天馬行空4、如果要選擇一個語音技術最有影響或價值的場景,你的選擇是?20價值思維,前瞻能力5、語音技術發展新的方向20打破常規,展望未來,6

溫馨提示

  • 1. 本站所有資源如無特殊說明,都需要本地電腦安裝OFFICE2007和PDF閱讀器。圖紙軟件為CAD,CAXA,PROE,UG,SolidWorks等.壓縮文件請下載最新的WinRAR軟件解壓。
  • 2. 本站的文檔不包含任何第三方提供的附件圖紙等,如果需要附件,請聯系上傳者。文件的所有權益歸上傳用戶所有。
  • 3. 本站RAR壓縮包中若帶圖紙,網頁內容里面會有圖紙預覽,若沒有圖紙預覽就沒有圖紙。
  • 4. 未經權益所有人同意不得將文件中的內容挪作商業或盈利用途。
  • 5. 人人文庫網僅提供信息存儲空間,僅對用戶上傳內容的表現方式做保護處理,對用戶上傳分享的文檔內容本身不做任何修改或編輯,并不能對任何下載內容負責。
  • 6. 下載文件中如有侵權或不適當內容,請與我們聯系,我們立即糾正。
  • 7. 本站不保證下載資源的準確性、安全性和完整性, 同時也不承擔用戶因使用這些下載資源對自己和他人造成任何形式的傷害或損失。

評論

0/150

提交評論