www.久久久久|狼友网站av天堂|精品国产无码a片|一级av色欲av|91在线播放视频|亚洲无码主播在线|国产精品草久在线|明星AV网站在线|污污内射久久一区|婷婷综合视频网站

當(dāng)前位置:首頁(yè) > 消費(fèi)電子 > 消費(fèi)電子
[導(dǎo)讀] 語(yǔ)音識(shí)別技術(shù)原理簡(jiǎn)介自動(dòng)語(yǔ)音識(shí)別技術(shù)(Auto Speech Recognize,簡(jiǎn)稱ASR)所要解決的問(wèn)題是讓計(jì)算機(jī)能夠“聽(tīng)懂”人類的語(yǔ)音,將語(yǔ)音中包含的文字信息“提取”出來(lái)。ASR技術(shù)在“能聽(tīng)會(huì)說(shuō)&r

 語(yǔ)音識(shí)別技術(shù)原理簡(jiǎn)介

自動(dòng)語(yǔ)音識(shí)別技術(shù)(Auto Speech Recognize,簡(jiǎn)稱ASR)所要解決的問(wèn)題是讓計(jì)算機(jī)能夠“聽(tīng)懂”人類的語(yǔ)音,將語(yǔ)音中包含的文字信息“提取”出來(lái)。ASR技術(shù)在“能聽(tīng)會(huì)說(shuō)”的智能計(jì)算機(jī)系統(tǒng)中扮演著重要角色,相當(dāng)于給計(jì)算機(jī)系統(tǒng)安裝上“耳朵”,使其具備“能聽(tīng)”的功能,進(jìn)而實(shí)現(xiàn)信息時(shí)代利用“語(yǔ)音”這一最自然、最便捷的手段進(jìn)行人機(jī)通信和交互。

語(yǔ)音識(shí)別技術(shù)所面臨的問(wèn)題是非常艱巨和困難的。盡管早在二十世紀(jì)五十年代,世界各國(guó)就開(kāi)始了對(duì)這項(xiàng)技術(shù)孜孜不倦的研究,特別是最近二十年,國(guó)內(nèi)外非常多的研究機(jī)構(gòu)和企業(yè)都加入到語(yǔ)音識(shí)別技術(shù)的研究領(lǐng)域,投入了極大的努力,也取得了豐碩的成果,但是直到今天,距離該技術(shù)得到完美解決還存在著巨大的差距,不過(guò)這并不妨礙不斷進(jìn)步的語(yǔ)音識(shí)別系統(tǒng)在許多相對(duì)受限的場(chǎng)合下獲得成功的應(yīng)用。

如今,語(yǔ)音識(shí)別技術(shù)已經(jīng)發(fā)展成為涉及聲學(xué)、語(yǔ)言學(xué)、數(shù)字信號(hào)處理、統(tǒng)計(jì)模式識(shí)別等多學(xué)科技術(shù)的一項(xiàng)綜合性技術(shù)?;谡Z(yǔ)音識(shí)別技術(shù)研發(fā)的現(xiàn)代語(yǔ)音識(shí)別系統(tǒng)在很多場(chǎng)景下獲得了成功的應(yīng)用,不同任務(wù)條件下所采用的技術(shù)又會(huì)有所不同。下圖是在一個(gè)相對(duì)通用的任務(wù)條件下的語(yǔ)音識(shí)別系統(tǒng)示意圖。語(yǔ)音識(shí)別系統(tǒng)構(gòu)建過(guò)程整體上包括兩大部分:訓(xùn)練和識(shí)別。訓(xùn)練通常是離線完成的,對(duì)預(yù)先收集好的海量語(yǔ)音、語(yǔ)言數(shù)據(jù)庫(kù)進(jìn)行信號(hào)處理和知識(shí)挖掘,獲取語(yǔ)音識(shí)別系統(tǒng)所需要的“聲學(xué)模型”和“語(yǔ)言模型”;而識(shí)別過(guò)程通常是在線完成的,對(duì)用戶實(shí)時(shí)的語(yǔ)音進(jìn)行自動(dòng)識(shí)別。識(shí)別過(guò)程通常又可以分為“前端”和“后端”兩大模塊:“前端”模塊主要的作用是進(jìn)行端點(diǎn)檢測(cè)(去除多余的靜音和非說(shuō)話聲)、降噪、特征提取等;“后端”模塊的作用是利用訓(xùn)練好的“聲學(xué)模型”和“語(yǔ)言模型”對(duì)用戶說(shuō)話的特征向量進(jìn)行統(tǒng)計(jì)模式識(shí)別(又稱“解碼”),得到其包含的文字信息,此外,后端模塊還存在一個(gè)“自適應(yīng)”的反饋模塊,可以對(duì)用戶的語(yǔ)音進(jìn)行自學(xué)習(xí),從而對(duì)“聲學(xué)模型”和“語(yǔ)音模型”進(jìn)行必要的“校正”,進(jìn)一步提高識(shí)別的準(zhǔn)確率。

語(yǔ)音識(shí)別技術(shù)發(fā)展歷史及現(xiàn)狀

語(yǔ)音識(shí)別的研究工作大約開(kāi)始于20世紀(jì)50年代,當(dāng)時(shí)AT&T Bell實(shí)驗(yàn)室基于共振峰提取技術(shù)實(shí)現(xiàn)了第一個(gè)可識(shí)別十個(gè)英文數(shù)字的語(yǔ)音識(shí)別系統(tǒng)——Audry系統(tǒng)。

60年代,計(jì)算機(jī)的應(yīng)用推動(dòng)了語(yǔ)音識(shí)別的發(fā)展。這時(shí)期的重要成果是提出了動(dòng)態(tài)時(shí)間規(guī)劃(DP)和線性預(yù)測(cè)分析技術(shù)(LPC),其中后者較好地解決了語(yǔ)音信號(hào)產(chǎn)生模型的問(wèn)題,對(duì)語(yǔ)音識(shí)別的發(fā)展產(chǎn)生了深遠(yuǎn)影響。

70年代,語(yǔ)音識(shí)別領(lǐng)域取得了較大進(jìn)展。在理論上,LP技術(shù)得到進(jìn)一步發(fā)展,動(dòng)態(tài)時(shí)間歸正技術(shù)(DTW)基本成熟,特別是提出了矢量量化(VQ)和隱馬爾可夫模型(HMM)理論。在實(shí)踐上,實(shí)現(xiàn)了基于線性預(yù)測(cè)倒譜和DTW技術(shù)的特定人孤立語(yǔ)音識(shí)別系統(tǒng)。

80年代,MFCC的參數(shù)提取技術(shù)和HMM模型的深入使用使得語(yǔ)音識(shí)別技術(shù)得到進(jìn)一步的發(fā)展,語(yǔ)音識(shí)別的問(wèn)題逐步在理論體系上得到了比較完整和準(zhǔn)確的描述,同時(shí)在實(shí)踐上又逐步研發(fā)出效率較高的解決算法。

90年代以來(lái),在美國(guó)國(guó)防部的Darpa測(cè)試、Ears計(jì)劃、近期的Gales計(jì)劃,以及我國(guó)863計(jì)劃等推動(dòng)下,一大批高水平的研究機(jī)構(gòu)和企業(yè)加入到語(yǔ)音識(shí)別的研究領(lǐng)域,極大地推動(dòng)了語(yǔ)音識(shí)別技術(shù)的發(fā)展和應(yīng)用。語(yǔ)音識(shí)別系統(tǒng)已經(jīng)從過(guò)去的小詞匯量、孤立詞識(shí)別、特定人識(shí)別、安靜環(huán)境等簡(jiǎn)單任務(wù)逐步發(fā)展到大詞匯量、連續(xù)語(yǔ)音、非特定人、噪聲環(huán)境下的識(shí)別任務(wù),從單純的語(yǔ)音識(shí)別任務(wù)發(fā)展到語(yǔ)音翻譯任務(wù),從實(shí)驗(yàn)室系統(tǒng)走向商用系統(tǒng)。

本站聲明: 本文章由作者或相關(guān)機(jī)構(gòu)授權(quán)發(fā)布,目的在于傳遞更多信息,并不代表本站贊同其觀點(diǎn),本站亦不保證或承諾內(nèi)容真實(shí)性等。需要轉(zhuǎn)載請(qǐng)聯(lián)系該專欄作者,如若文章內(nèi)容侵犯您的權(quán)益,請(qǐng)及時(shí)聯(lián)系本站刪除。
換一批
延伸閱讀

深圳 2025年5月27日 /美通社/ -- 5月25日,國(guó)際獨(dú)立第三方檢測(cè)、檢驗(yàn)和認(rèn)證機(jī)構(gòu)德國(guó)萊茵TÜV(以下簡(jiǎn)稱 "TÜV萊茵"...

關(guān)鍵字: 聲學(xué) 耳機(jī) 電子電氣 BSP

奧地利維也納 2025年4月29日 /美通社/ -- 萊維特于2025年4月29日推出新品插件Space Replicator。 Space Replicator 是一款強(qiáng)大的插件,能讓你通過(guò)耳機(jī)體驗(yàn)身臨其境般...

關(guān)鍵字: SPACE 聲學(xué) IC 耳機(jī)

上海2025年3月18日 /美通社/ -- 由中國(guó)電子音響行業(yè)協(xié)會(huì)、上海市浦東新區(qū)先進(jìn)音視頻技術(shù)協(xié)會(huì)共同主辦,上海國(guó)展展覽中心有限公司承辦的2025中國(guó)國(guó)際音頻產(chǎn)業(yè)大會(huì)將于3月26-27日在上海張江科學(xué)會(huì)堂盛大舉辦。...

關(guān)鍵字: 音頻 IO AI 聲學(xué)

8月13日消息,國(guó)際星閃聯(lián)盟日前發(fā)布公告稱,新一代無(wú)線聲學(xué)產(chǎn)業(yè)集群基地暨“星閃音頻產(chǎn)業(yè)總部”項(xiàng)目合作交流會(huì),在江西省吉安縣吉安國(guó)家級(jí)高新技術(shù)開(kāi)發(fā)區(qū)舉行。

關(guān)鍵字: 星閃音頻 聲學(xué)

密歇根州南菲爾德2024年7月17日 /美通社/ -- Auria是領(lǐng)先的汽車(chē)聲學(xué)、紡織品以及燃?xì)夂碗妱?dòng)汽車(chē)貨物管理高度工程化系統(tǒng)供應(yīng)商,其今日宣布,任命楊秋明為新總裁兼首席...

關(guān)鍵字: AN 聲學(xué) BSP 可持續(xù)發(fā)展

上海2024年4月17日 /美通社/ -- 近日,國(guó)際公認(rèn)的測(cè)試、檢驗(yàn)和認(rèn)證機(jī)構(gòu)SGS為歌爾股份有限公司(以下簡(jiǎn)稱"歌爾")頒發(fā)QTL認(rèn)可實(shí)驗(yàn)室證書(shū),彰顯了歌爾在產(chǎn)品佩戴體驗(yàn)舒適度檢測(cè)及聲學(xué)檢測(cè)領(lǐng)域的...

關(guān)鍵字: 聲學(xué) 測(cè)試 ISO 檢測(cè)技術(shù)

本文中,小編將對(duì)語(yǔ)音識(shí)別技術(shù)予以介紹,如果你想對(duì)語(yǔ)音識(shí)別技術(shù)的詳細(xì)情況有所認(rèn)識(shí),或者想要增進(jìn)對(duì)它的了解程度,不妨請(qǐng)看以下內(nèi)容哦。

關(guān)鍵字: 語(yǔ)音識(shí)別 語(yǔ)音識(shí)別技術(shù)

在這篇文章中,小編將為大家?guī)?lái)語(yǔ)音識(shí)別技術(shù)的相關(guān)報(bào)道。如果你對(duì)本文即將要講解的內(nèi)容存在一定興趣,不妨繼續(xù)往下閱讀哦。

關(guān)鍵字: 語(yǔ)音識(shí)別 語(yǔ)音識(shí)別技術(shù)

在下述的內(nèi)容中,小編將會(huì)對(duì)語(yǔ)音識(shí)別技術(shù)的相關(guān)消息予以報(bào)道,如果語(yǔ)音識(shí)別技術(shù)是您想要了解的焦點(diǎn)之一,不妨和小編共同閱讀這篇文章哦。

關(guān)鍵字: 語(yǔ)音識(shí)別 語(yǔ)音識(shí)別技術(shù)

今天,小編將在這篇文章中為大家?guī)?lái)語(yǔ)音識(shí)別技術(shù)的有關(guān)報(bào)道,通過(guò)閱讀這篇文章,大家可以對(duì)它具備清晰的認(rèn)識(shí),主要內(nèi)容如下。

關(guān)鍵字: 語(yǔ)音識(shí)別 語(yǔ)音識(shí)別技術(shù)
關(guān)閉