日本黄色一级经典视频|伊人久久精品视频|亚洲黄色色周成人视频九九九|av免费网址黄色小短片|黄色Av无码亚洲成年人|亚洲1区2区3区无码|真人黄片免费观看|无码一级小说欧美日免费三级|日韩中文字幕91在线看|精品久久久无码中文字幕边打电话

當前位置:首頁 > 消費電子 > 消費電子
[導讀] 語音識別技術原理簡介自動語音識別技術(Auto Speech Recognize,簡稱ASR)所要解決的問題是讓計算機能夠“聽懂”人類的語音,將語音中包含的文字信息“提取”出來。ASR技術在“能聽會說&r

 語音識別技術原理簡介

自動語音識別技術(Auto Speech Recognize,簡稱ASR)所要解決的問題是讓計算機能夠“聽懂”人類的語音,將語音中包含的文字信息“提取”出來。ASR技術在“能聽會說”的智能計算機系統(tǒng)中扮演著重要角色,相當于給計算機系統(tǒng)安裝上“耳朵”,使其具備“能聽”的功能,進而實現(xiàn)信息時代利用“語音”這一最自然、最便捷的手段進行人機通信和交互。

語音識別技術所面臨的問題是非常艱巨和困難的。盡管早在二十世紀五十年代,世界各國就開始了對這項技術孜孜不倦的研究,特別是最近二十年,國內外非常多的研究機構和企業(yè)都加入到語音識別技術的研究領域,投入了極大的努力,也取得了豐碩的成果,但是直到今天,距離該技術得到完美解決還存在著巨大的差距,不過這并不妨礙不斷進步的語音識別系統(tǒng)在許多相對受限的場合下獲得成功的應用。

如今,語音識別技術已經發(fā)展成為涉及聲學、語言學、數(shù)字信號處理、統(tǒng)計模式識別等多學科技術的一項綜合性技術?;谡Z音識別技術研發(fā)的現(xiàn)代語音識別系統(tǒng)在很多場景下獲得了成功的應用,不同任務條件下所采用的技術又會有所不同。下圖是在一個相對通用的任務條件下的語音識別系統(tǒng)示意圖。語音識別系統(tǒng)構建過程整體上包括兩大部分:訓練和識別。訓練通常是離線完成的,對預先收集好的海量語音、語言數(shù)據庫進行信號處理和知識挖掘,獲取語音識別系統(tǒng)所需要的“聲學模型”和“語言模型”;而識別過程通常是在線完成的,對用戶實時的語音進行自動識別。識別過程通常又可以分為“前端”和“后端”兩大模塊:“前端”模塊主要的作用是進行端點檢測(去除多余的靜音和非說話聲)、降噪、特征提取等;“后端”模塊的作用是利用訓練好的“聲學模型”和“語言模型”對用戶說話的特征向量進行統(tǒng)計模式識別(又稱“解碼”),得到其包含的文字信息,此外,后端模塊還存在一個“自適應”的反饋模塊,可以對用戶的語音進行自學習,從而對“聲學模型”和“語音模型”進行必要的“校正”,進一步提高識別的準確率。

語音識別技術發(fā)展歷史及現(xiàn)狀

語音識別的研究工作大約開始于20世紀50年代,當時AT&T Bell實驗室基于共振峰提取技術實現(xiàn)了第一個可識別十個英文數(shù)字的語音識別系統(tǒng)——Audry系統(tǒng)。

60年代,計算機的應用推動了語音識別的發(fā)展。這時期的重要成果是提出了動態(tài)時間規(guī)劃(DP)和線性預測分析技術(LPC),其中后者較好地解決了語音信號產生模型的問題,對語音識別的發(fā)展產生了深遠影響。

70年代,語音識別領域取得了較大進展。在理論上,LP技術得到進一步發(fā)展,動態(tài)時間歸正技術(DTW)基本成熟,特別是提出了矢量量化(VQ)和隱馬爾可夫模型(HMM)理論。在實踐上,實現(xiàn)了基于線性預測倒譜和DTW技術的特定人孤立語音識別系統(tǒng)。

80年代,MFCC的參數(shù)提取技術和HMM模型的深入使用使得語音識別技術得到進一步的發(fā)展,語音識別的問題逐步在理論體系上得到了比較完整和準確的描述,同時在實踐上又逐步研發(fā)出效率較高的解決算法。

90年代以來,在美國國防部的Darpa測試、Ears計劃、近期的Gales計劃,以及我國863計劃等推動下,一大批高水平的研究機構和企業(yè)加入到語音識別的研究領域,極大地推動了語音識別技術的發(fā)展和應用。語音識別系統(tǒng)已經從過去的小詞匯量、孤立詞識別、特定人識別、安靜環(huán)境等簡單任務逐步發(fā)展到大詞匯量、連續(xù)語音、非特定人、噪聲環(huán)境下的識別任務,從單純的語音識別任務發(fā)展到語音翻譯任務,從實驗室系統(tǒng)走向商用系統(tǒng)。

本站聲明: 本文章由作者或相關機構授權發(fā)布,目的在于傳遞更多信息,并不代表本站贊同其觀點,本站亦不保證或承諾內容真實性等。需要轉載請聯(lián)系該專欄作者,如若文章內容侵犯您的權益,請及時聯(lián)系本站刪除。
換一批
延伸閱讀

深圳 2025年5月27日 /美通社/ -- 5月25日,國際獨立第三方檢測、檢驗和認證機構德國萊茵TÜV(以下簡稱 "TÜV萊茵"...

關鍵字: 聲學 耳機 電子電氣 BSP

奧地利維也納 2025年4月29日 /美通社/ -- 萊維特于2025年4月29日推出新品插件Space Replicator。 Space Replicator 是一款強大的插件,能讓你通過耳機體驗身臨其境般...

關鍵字: SPACE 聲學 IC 耳機

上海2025年3月18日 /美通社/ -- 由中國電子音響行業(yè)協(xié)會、上海市浦東新區(qū)先進音視頻技術協(xié)會共同主辦,上海國展展覽中心有限公司承辦的2025中國國際音頻產業(yè)大會將于3月26-27日在上海張江科學會堂盛大舉辦。...

關鍵字: 音頻 IO AI 聲學

8月13日消息,國際星閃聯(lián)盟日前發(fā)布公告稱,新一代無線聲學產業(yè)集群基地暨“星閃音頻產業(yè)總部”項目合作交流會,在江西省吉安縣吉安國家級高新技術開發(fā)區(qū)舉行。

關鍵字: 星閃音頻 聲學

密歇根州南菲爾德2024年7月17日 /美通社/ -- Auria是領先的汽車聲學、紡織品以及燃氣和電動汽車貨物管理高度工程化系統(tǒng)供應商,其今日宣布,任命楊秋明為新總裁兼首席...

關鍵字: AN 聲學 BSP 可持續(xù)發(fā)展

上海2024年4月17日 /美通社/ -- 近日,國際公認的測試、檢驗和認證機構SGS為歌爾股份有限公司(以下簡稱"歌爾")頒發(fā)QTL認可實驗室證書,彰顯了歌爾在產品佩戴體驗舒適度檢測及聲學檢測領域的...

關鍵字: 聲學 測試 ISO 檢測技術

本文中,小編將對語音識別技術予以介紹,如果你想對語音識別技術的詳細情況有所認識,或者想要增進對它的了解程度,不妨請看以下內容哦。

關鍵字: 語音識別 語音識別技術

在這篇文章中,小編將為大家?guī)碚Z音識別技術的相關報道。如果你對本文即將要講解的內容存在一定興趣,不妨繼續(xù)往下閱讀哦。

關鍵字: 語音識別 語音識別技術

在下述的內容中,小編將會對語音識別技術的相關消息予以報道,如果語音識別技術是您想要了解的焦點之一,不妨和小編共同閱讀這篇文章哦。

關鍵字: 語音識別 語音識別技術

今天,小編將在這篇文章中為大家?guī)碚Z音識別技術的有關報道,通過閱讀這篇文章,大家可以對它具備清晰的認識,主要內容如下。

關鍵字: 語音識別 語音識別技術
關閉