?

首頁: 電子電路圖,電子技術資料網站首頁

電子資料下載: 電子資料下載頻道 -- 為電子工程師提供激發創新靈感的新方案、新的參考設計、新的設計構想等可下載的電子資料！

電子技術應用: 電子技術應用頻道 -- 為電子工程師提供電子產品設計所需的技術分析、設計技巧、設計工具、測試工具等技術文章！

電子元器件: 專業的電子元器件平臺 -- 及時發布大量最新IC、分立器件、模組等電子元器件產品信息！

電子電路圖: 電路圖頻道 -- 提供電子電路圖,原理圖,汽車電路圖,手機電路圖,功放電路圖,電源電路圖等電路圖紙

電子技術論壇: 構建電子工程師交流的平臺 -- 在交流中進一步學習設計技巧、規劃技術人生、提升自我價值！

電子百科: 電子百科頻道 -- 全民同參與，一起動手添詞條。以我們自己的名義撰寫電子行業最強的開放式百科全書！; 電腦硬件主機配件數碼產品外接配件辦公設備網絡數字家電汽車電子無線通信網絡布線耗材存儲設備通訊產品語音視頻通信技術

您的位置：電子發燒友網>電子百科>通信技術>基礎知識>

語音識別技術原理簡介

2010年03月06日 10:38 轉載作者：佚名用戶評論（0）

關鍵字：語音識別技術(12725)

語音識別技術原理簡介

??????? 自動語音識別技術(Auto Speech Recognize，簡稱ASR)所要解決的問題是讓計算機能夠“聽懂”人類的語音，將語音中包含的文字信息“提取”出來。ASR技術在“能聽會說”的智能計算機系統中扮演著重要角色，相當于給計算機系統安裝上“耳朵”，使其具備“能聽”的功能，進而實現信息時代利用“語音”這一最自然、最便捷的手段進行人機通信和交互。

?????? ?語音識別技術所面臨的問題是非常艱巨和困難的。盡管早在二十世紀五十年代，世界各國就開始了對這項技術孜孜不倦的研究，特別是最近二十年，國內外非常多的研究機構和企業都加入到語音識別技術的研究領域，投入了極大的努力，也取得了豐碩的成果，但是直到今天，距離該技術得到完美解決還存在著巨大的差距，不過這并不妨礙不斷進步的語音識別系統在許多相對受限的場合下獲得成功的應用。

??????? 如今，語音識別技術已經發展成為涉及聲學、語言學、數字信號處理、統計模式識別等多學科技術的一項綜合性技術。基于語音識別技術研發的現代語音識別系統在很多場景下獲得了成功的應用，不同任務條件下所采用的技術又會有所不同。下圖是在一個相對通用的任務條件下的語音識別系統示意圖。語音識別系統構建過程整體上包括兩大部分：訓練和識別。訓練通常是離線完成的，對預先收集好的海量語音、語言數據庫進行信號處理和知識挖掘，獲取語音識別系統所需要的“聲學模型”和“語言模型”；而識別過程通常是在線完成的，對用戶實時的語音進行自動識別。識別過程通常又可以分為“前端”和“后端”兩大模塊：“前端”模塊主要的作用是進行端點檢測（去除多余的靜音和非說話聲）、降噪、特征提取等；“后端”模塊的作用是利用訓練好的“聲學模型”和“語言模型”對用戶說話的特征向量進行統計模式識別（又稱“解碼”），得到其包含的文字信息，此外，后端模塊還存在一個“自適應”的反饋模塊，可以對用戶的語音進行自學習，從而對“聲學模型”和“語音模型”進行必要的“校正”，進一步提高識別的準確率。
?

語音識別技術發展歷史及現狀?
　　語音識別的研究工作大約開始于20世紀50年代，當時AT&T Bell實驗室基于共振峰提取技術實現了第一個可識別十個英文數字的語音識別系統——Audry系統。

　　60年代，計算機的應用推動了語音識別的發展。這時期的重要成果是提出了動態時間規劃（DP）和線性預測分析技術（LPC），其中后者較好地解決了語音信號產生模型的問題，對語音識別的發展產生了深遠影響。

　　70年代，語音識別領域取得了較大進展。在理論上，LP技術得到進一步發展，動態時間歸正技術（DTW）基本成熟，特別是提出了矢量量化（VQ）和隱馬爾可夫模型（HMM）理論。在實踐上，實現了基于線性預測倒譜和DTW技術的特定人孤立語音識別系統。

　　80年代，MFCC的參數提取技術和HMM模型的深入使用使得語音識別技術得到進一步的發展，語音識別的問題逐步在理論體系上得到了比較完整和準確的描述，同時在實踐上又逐步研發出效率較高的解決算法。

　　90年代以來，在美國國防部的Darpa測試、Ears計劃、近期的Gales計劃，以及我國863計劃等推動下，一大批高水平的研究機構和企業加入到語音識別的研究領域，極大地推動了語音識別技術的發展和應用。語音識別系統已經從過去的小詞匯量、孤立詞識別、特定人識別、安靜環境等簡單任務逐步發展到大詞匯量、連續語音、非特定人、噪聲環境下的識別任務，從單純的語音識別任務發展到語音翻譯任務，從實驗室系統走向商用系統。??
?訊飛語音識別技術?

?????? ?訊飛語音識別技術的理念是提供信息時代人機溝通的最佳方式。在核心技術研究方面，科大訊飛公司一直秉承著“頂天立地”的方針。“頂天”，就是要求在基礎技術上不斷創新，不斷突破；“立地”，就是技術要和實際應用相結合，最終能夠產生經濟效益和社會效益。訊飛語音識別技術的研究繼承了這樣的優良傳統，在基礎技術方面銳意進取，不斷創新，特別是在特征魯棒性、模型區分性訓練、大詞匯量語音識別解碼技術、語音模糊搜索等方面提出了多項創新性觀點，并多次在國內外著名的學術期刊、會議及專刊上進行發表，取得了豐碩的成果。在技術與實際應用相結合方面，也充分考慮了應用系統之間的差異，為客戶量身定制，提供了語音命令識別、智能語音搜索、語音檢索等技術，并正在開展針對自然連續語流的會議內容轉寫識別整套解決方案。

??????? 下面是科大訊飛對語音識別技術的整體規劃：

　　命令詞識別技術—在受限的命令詞或者語法范圍提供自動語音識別服務，需要很少的計算資源，但是要求用戶能夠“配合”語音識別系統，盡量說“集內詞”。

　　智能的人機交互技術—結合大詞匯量語音識別、自然語言理解、信息檢索等技術提供特定領域內相對開放輸入的語音識別服務，對用戶的限制較為寬松，在所限定的領域內可以以自然語言的方式進行人機交互。

　　語音轉寫技術—在無特殊限定的范圍內完成對連續自然語音進行內容轉寫，目前還需要較大的計算資源。

　　語音搜索技術—語音技術和搜索技術的結合，提供最便捷的信息搜索服務。

非常好我支持^.^

(129) 35.5%

不好我反對

(234) 64.5%

分享到:

加入收藏(0) + 推薦給朋友 + 挑錯

用戶評論

發表評論即可獲得積分！ 詳見積分規則

發表評論

用戶評論

評價:好評中評差評

發表評論，獲取積分！請遵守相關規定！

or

注冊會員

游客:

精品国产人成在线_亚洲高清无码在线观看_国产在线视频国产永久2021_国产AV综合第一页一个的一区免费影院黑人_最近中文字幕MV高清在线视频

語音識別技術原理簡介

相關閱讀：

用戶評論

發表評論

深度閱讀

相關下載

電子百科閱讀排行

熱門詞