99精品伊人亚洲|最近国产中文炮友|九草在线视频支援|AV网站大全最新|美女黄片免费观看|国产精品资源视频|精彩无码视频一区|91大神在线后入|伊人终合在线播放|久草综合久久中文

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線(xiàn)課程
  • 觀(guān)看技術(shù)視頻
  • 寫(xiě)文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

基于語(yǔ)音識(shí)別技術(shù)用于錄音應(yīng)用

星星科技指導(dǎo)員 ? 來(lái)源:嵌入式計(jì)算設(shè)計(jì) ? 作者:OpenSystems Media ? 2022-06-09 09:50 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

在一個(gè)癡迷于互聯(lián)網(wǎng)隱私的世界里,令人驚訝的是,我們很少談?wù)撓?Amazon Echo 這樣的始終在聽(tīng)的設(shè)備。畢竟,一家想要了解你生活中的私密細(xì)節(jié)以便向你推銷(xiāo)更多東西的公司會(huì)在你的廚房里永久打開(kāi)一個(gè)麥克風(fēng)。

如果您擁有 Echo 并且不知道此功能,請(qǐng)打開(kāi)您的 Alexa 應(yīng)用程序,選擇“設(shè)置”菜單,然后選擇“歷史記錄”。聽(tīng)一聽(tīng)。所有這些錄音都是為 Echo 準(zhǔn)備的嗎?

我想隱私是現(xiàn)代消費(fèi)主義中便利的代價(jià)。事情將變得更加方便。

雜音、雞尾酒會(huì)、便利和圣誕節(jié)

XMOS 是一家從布里斯托大學(xué)分離出來(lái)的無(wú)晶圓半導(dǎo)體公司,專(zhuān)注于語(yǔ)音和音樂(lè)處理 IC。在這些 IC 中,基于 32 位 xCORE MCU 架構(gòu)的設(shè)備在語(yǔ)音識(shí)別市場(chǎng)上取得了顯著的成功,提供了 16 個(gè)可編程內(nèi)核(分為 8 個(gè)內(nèi)核的兩個(gè)區(qū)塊,每個(gè)內(nèi)核共享一個(gè)地址空間),DSP 功能集成在相同的芯片。

XMOS 將 xCORE 架構(gòu)加入到用于亞馬遜 Alexa 語(yǔ)音服務(wù) (AVS) 的 VocalFusion 4-Mic 開(kāi)發(fā)套件中。該套件圍繞英飛凌的 VocalFusion XVF3000 集成遠(yuǎn)場(chǎng)語(yǔ)音處理器和四個(gè)高信噪比 (SNR) MEMS 麥克風(fēng)而設(shè)計(jì)。XMOS 聲稱(chēng)該套件是市場(chǎng)上第一個(gè)遠(yuǎn)場(chǎng)線(xiàn)性麥克風(fēng)陣列解決方案。

在范圍之外,在解決“雞尾酒會(huì)”問(wèn)題或平臺(tái)需要將單個(gè)揚(yáng)聲器的聲音與嘈雜環(huán)境隔離的情況時(shí),遠(yuǎn)場(chǎng)語(yǔ)音處理變得非常有趣。在 5 m 或更遠(yuǎn)的距離處,VocalFusion 4-Mic 開(kāi)發(fā)套件使用聲學(xué)回聲消除 (AEC)、自適應(yīng)波束形成、動(dòng)態(tài)去混響和自動(dòng)增益控制 (AGC) 的組合來(lái)隔離和提取聲音信號(hào)主講者。除此之外,事情開(kāi)始變得令人毛骨悚然。

今年早些時(shí)候,XMOS 收購(gòu)了馬薩諸塞州波士頓的 Setem Technologies, Inc.,該公司開(kāi)發(fā)了用于盲源信號(hào)分離的大規(guī)模傅立葉變換。這些盲源分離算法在數(shù)學(xué)上從一組信號(hào)中分解源信號(hào)的元素,然后單獨(dú)或作為組重構(gòu)它們(圖 1)。在語(yǔ)音識(shí)別中,這可以應(yīng)用于單個(gè)說(shuō)話(huà)者,甚至是對(duì)話(huà)。

poYBAGKhUguADw9uAACPBFyn28M881.png

圖 1.現(xiàn)在隸屬于 XMOS 的 Setem Technologies 開(kāi)發(fā)了盲源分離算法,可用于隔離嘈雜環(huán)境中的一個(gè)或多個(gè)揚(yáng)聲器。

現(xiàn)在,在理論上(或許在實(shí)踐中),盲源分離可用于隔離房間內(nèi)多個(gè)說(shuō)話(huà)者的語(yǔ)音頻率,從而為每個(gè)說(shuō)話(huà)者建立生物識(shí)別身份。正如你可以想象的那樣,這種技術(shù)的應(yīng)用可能會(huì)很廣泛,不僅僅是亞馬遜想知道你的每個(gè)家庭成員想要什么圣誕節(jié)。例如,監(jiān)視立即浮現(xiàn)在腦海中。

這讓我們回到了 VocalFusion 4-Mic Dev Kit 的線(xiàn)性麥克風(fēng)陣列。雖然 Amazon Echo 和 Google Home 等許多平臺(tái)使用圓形陣列的全向麥克風(fēng)來(lái)提供 360 度的房間覆蓋,但線(xiàn)性陣列設(shè)計(jì)用于 180 度的弧度。這很有趣,因?yàn)檎Z(yǔ)音識(shí)別領(lǐng)域的領(lǐng)導(dǎo)者設(shè)想了一個(gè)未來(lái),今天基于塔的虛擬助手將退居電視、冰箱、沙發(fā)、墻壁等日常物品中——你可以說(shuō)出來(lái)。

這個(gè)未來(lái)被設(shè)計(jì)為超級(jí)方便,通過(guò)音節(jié)提供服務(wù)。但小心點(diǎn)。你可能不知道誰(shuí)或什么在聽(tīng)。

審核編輯:郭婷

聲明:本文內(nèi)容及配圖由入駐作者撰寫(xiě)或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀(guān)點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 處理器
    +關(guān)注

    關(guān)注

    68

    文章

    19885

    瀏覽量

    235063
  • dsp
    dsp
    +關(guān)注

    關(guān)注

    556

    文章

    8155

    瀏覽量

    357350
  • 揚(yáng)聲器
    +關(guān)注

    關(guān)注

    29

    文章

    1341

    瀏覽量

    64136
收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    芯知識(shí)|廣州唯創(chuàng)電子WTR096錄音語(yǔ)音芯片IC深度解析

    、外掛Flash適配,可廣泛應(yīng)用于智能玩具、家用電器(如語(yǔ)音鬧鐘、門(mén)鈴)、工業(yè)設(shè)備提示器、安防告警系統(tǒng)等領(lǐng)域。二、核心參數(shù)與技術(shù)特性1.多段錄音能力:靈活應(yīng)對(duì)場(chǎng)景需
    的頭像 發(fā)表于 05-16 09:02 ?211次閱讀
    芯知識(shí)|廣州唯創(chuàng)電子WTR096<b class='flag-5'>錄音</b><b class='flag-5'>語(yǔ)音</b>芯片IC深度解析

    芯資訊|廣州唯創(chuàng)電子錄音語(yǔ)音芯片應(yīng)用指南及常見(jiàn)問(wèn)題解析

    一、引言:錄音語(yǔ)音芯片的廣泛應(yīng)用廣州唯創(chuàng)電子作為國(guó)內(nèi)領(lǐng)先的語(yǔ)音解決方案提供商,其錄音語(yǔ)音芯片憑借高集成度、低功耗和靈活的擴(kuò)展性,廣泛應(yīng)
    的頭像 發(fā)表于 05-16 08:41 ?152次閱讀
    芯資訊|廣州唯創(chuàng)電子<b class='flag-5'>錄音</b><b class='flag-5'>語(yǔ)音</b>芯片應(yīng)用指南及常見(jiàn)問(wèn)題解析

    芯知識(shí)|廣州唯創(chuàng)電子高品質(zhì)錄音IC語(yǔ)音芯片技術(shù)解析與應(yīng)用指南

    作為國(guó)內(nèi)領(lǐng)先的語(yǔ)音芯片研發(fā)企業(yè),廣州唯創(chuàng)電子自1999年成立以來(lái),始終專(zhuān)注于語(yǔ)音技術(shù)的創(chuàng)新與場(chǎng)景化應(yīng)用。其錄音語(yǔ)音芯片以高音質(zhì)、低功耗、靈活
    的頭像 發(fā)表于 05-15 08:38 ?173次閱讀
    芯知識(shí)|廣州唯創(chuàng)電子高品質(zhì)<b class='flag-5'>錄音</b>IC<b class='flag-5'>語(yǔ)音</b>芯片<b class='flag-5'>技術(shù)</b>解析與應(yīng)用指南

    廠(chǎng)家芯資訊|廣州唯創(chuàng)電子語(yǔ)音識(shí)別芯片技術(shù)解析

    、音頻編解碼等核心技術(shù),廣泛應(yīng)用于智能家居、工業(yè)設(shè)備、醫(yī)療電子及消費(fèi)類(lèi)產(chǎn)品中。二、核心技術(shù)特點(diǎn)語(yǔ)音識(shí)別與處理
    的頭像 發(fā)表于 03-19 08:46 ?356次閱讀
    廠(chǎng)家芯資訊|廣州唯創(chuàng)電子<b class='flag-5'>語(yǔ)音</b><b class='flag-5'>識(shí)別</b>芯片<b class='flag-5'>技術(shù)</b>解析

    語(yǔ)音識(shí)別技術(shù)在通信領(lǐng)域中的應(yīng)用實(shí)例

    語(yǔ)音識(shí)別技術(shù)也被稱(chēng)為自動(dòng)語(yǔ)音識(shí)別(Automatic Speech Recognition,ASR),是通過(guò)計(jì)算機(jī)對(duì)
    的頭像 發(fā)表于 02-21 17:12 ?690次閱讀

    詳解語(yǔ)音識(shí)別技術(shù)在通信領(lǐng)域中的應(yīng)用

    語(yǔ)音識(shí)別技術(shù)也被稱(chēng)為自動(dòng)語(yǔ)音識(shí)別(Automatic Speech Recognition,ASR),是通過(guò)計(jì)算機(jī)對(duì)
    的頭像 發(fā)表于 02-21 17:05 ?779次閱讀
    詳解<b class='flag-5'>語(yǔ)音</b><b class='flag-5'>識(shí)別</b><b class='flag-5'>技術(shù)</b>在通信領(lǐng)域中的應(yīng)用

    【「嵌入式系統(tǒng)設(shè)計(jì)與實(shí)現(xiàn)」閱讀體驗(yàn)】+ 基于語(yǔ)音識(shí)別的智能杯墊

    語(yǔ)音命令Q 識(shí)別,適用于智能家居控制、玩具、人機(jī)交互等多個(gè)領(lǐng)域。該模塊以其高識(shí)別率、低功耗和易于集成的特點(diǎn)受到廣大開(kāi)發(fā)者的青睞。 主要技術(shù)
    發(fā)表于 01-02 18:15

    語(yǔ)音識(shí)別技術(shù)在醫(yī)療領(lǐng)域的應(yīng)用

    語(yǔ)音識(shí)別技術(shù)在醫(yī)療領(lǐng)域的應(yīng)用已經(jīng)越來(lái)越廣泛,為醫(yī)療服務(wù)帶來(lái)了諸多便利和效率提升。以下是對(duì)語(yǔ)音識(shí)別技術(shù)
    的頭像 發(fā)表于 11-26 09:35 ?1200次閱讀

    語(yǔ)音識(shí)別與自然語(yǔ)言處理的關(guān)系

    在人工智能的快速發(fā)展中,語(yǔ)音識(shí)別和自然語(yǔ)言處理(NLP)成為了兩個(gè)重要的技術(shù)支柱。語(yǔ)音識(shí)別技術(shù)使
    的頭像 發(fā)表于 11-26 09:21 ?1491次閱讀

    語(yǔ)音識(shí)別技術(shù)的應(yīng)用與發(fā)展

    語(yǔ)音識(shí)別技術(shù)的發(fā)展可以追溯到20世紀(jì)50年代,但直到近年來(lái),隨著計(jì)算能力的提升和機(jī)器學(xué)習(xí)技術(shù)的進(jìn)步,這項(xiàng)技術(shù)才真正成熟并廣泛應(yīng)
    的頭像 發(fā)表于 11-26 09:20 ?1624次閱讀

    ASR與傳統(tǒng)語(yǔ)音識(shí)別的區(qū)別

    ASR(Automatic Speech Recognition,自動(dòng)語(yǔ)音識(shí)別)與傳統(tǒng)語(yǔ)音識(shí)別在多個(gè)方面存在顯著的區(qū)別。以下是對(duì)這兩者的對(duì)比: 一、
    的頭像 發(fā)表于 11-18 15:22 ?1343次閱讀

    ASR語(yǔ)音識(shí)別技術(shù)應(yīng)用

    ASR(Automatic Speech Recognition)語(yǔ)音識(shí)別技術(shù),是計(jì)算機(jī)科學(xué)與人工智能領(lǐng)域的重要突破,能將人類(lèi)語(yǔ)音轉(zhuǎn)換為文本,廣泛應(yīng)
    的頭像 發(fā)表于 11-18 15:12 ?2058次閱讀

    基于Arm Neoverse N2實(shí)現(xiàn)自動(dòng)語(yǔ)音識(shí)別技術(shù)

    自動(dòng)語(yǔ)音識(shí)別 (Automatic Speech Recognition) 技術(shù)已經(jīng)深入到現(xiàn)代生活的方方面面,廣泛應(yīng)用于語(yǔ)音助手、轉(zhuǎn)錄服務(wù)
    的頭像 發(fā)表于 11-15 11:35 ?1095次閱讀
    基于Arm Neoverse N2實(shí)現(xiàn)自動(dòng)<b class='flag-5'>語(yǔ)音</b><b class='flag-5'>識(shí)別</b><b class='flag-5'>技術(shù)</b>

    WTK6900FC語(yǔ)音識(shí)別模塊

    語(yǔ)音識(shí)別
    WT-深圳唯創(chuàng)知音電子有限公司
    發(fā)布于 :2024年09月25日 17:35:07

    什么是離線(xiàn)語(yǔ)音識(shí)別芯片?與在線(xiàn)語(yǔ)音識(shí)別的區(qū)別

    離線(xiàn)語(yǔ)音識(shí)別芯片適用于智能家電等,特點(diǎn)為小詞匯量、低成本、安全性高、響應(yīng)快,無(wú)需聯(lián)網(wǎng)。在線(xiàn)語(yǔ)音識(shí)別功能更廣泛、
    的頭像 發(fā)表于 07-22 11:33 ?951次閱讀