99精品伊人亚洲|最近国产中文炮友|九草在线视频支援|AV网站大全最新|美女黄片免费观看|国产精品资源视频|精彩无码视频一区|91大神在线后入|伊人终合在线播放|久草综合久久中文

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

AIoT下的多模態(tài)演變之路 垂直領(lǐng)域競爭激烈

MZjJ_DIGITIMES ? 來源:cg ? 2019-01-05 09:45 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

2018年人工智能AI)行業(yè)成為了最受關(guān)注的熱點之一,不同場景的AI芯片層出不窮,成為了智能時代的“入場券”,大多數(shù)業(yè)者稱“得芯者得天下”,將2018年定義為“芯片元年”。

語音垂直應(yīng)用領(lǐng)域,“造芯”似已成為云知聲、出門問問、Rokid 、思必馳、科大訊飛從算法出發(fā)“軟硬兼施”一條必走之途,但也顯得語音AI市場變得異常競爭激烈。

在此背景下,2018年5月,云知聲推出首款物聯(lián)網(wǎng)AI芯片——雨燕(Swift),通過“唯快不破”的發(fā)展思路,很快在語音識別風(fēng)口中和科大訊飛比肩,并完成C輪1億美元的融資躋身國內(nèi)眾多AI獨角獸榜單中的一員。

而在2019年開年之際,云知聲繼續(xù)搶跑,于1月2日召開了“2019云知聲多模態(tài)AI芯片戰(zhàn)略發(fā)布會”,會上正式公布了其多模態(tài)AI技術(shù),以及正在研發(fā)中的多款定位不同場景的AI芯片,包括實用性更廣的超輕量級物聯(lián)網(wǎng)語音芯片雨燕(Lite)、可面向智慧城市場景提供對語音和圖像等多模態(tài)計算支持的海豚(Dolphin),以及面向智慧出行場景的車規(guī)級芯片雪豹(Leopard)。以上三款芯片計劃于2019年啟動量產(chǎn)。

AIoT下的多模態(tài)演變之路

云知聲創(chuàng)始人兼CEO黃偉認(rèn)為,5G與人工智能的結(jié)合將真正促使萬物智聯(lián)(AIoT)的落地與實現(xiàn)??梢灶A(yù)見的是,未來巨量的多維數(shù)據(jù)(如語音、圖像、視頻等)集中處理與邊緣式分布計算的需求,勢必將進(jìn)一步挑戰(zhàn)AI底層支持硬件——芯片的計算能力。

與此同時,AI應(yīng)用對于端云互動有著強(qiáng)需求。強(qiáng)大的云會讓端能力更強(qiáng),而強(qiáng)大的端則可提升數(shù)據(jù)處理的實時性和有效性,進(jìn)而增強(qiáng)云的能力。二者需要緊密結(jié)合,這要求對芯片設(shè)計和云端架構(gòu)進(jìn)行統(tǒng)一考量。傳統(tǒng)的通用方案架構(gòu)由于在高實時性、高智能化場景中的算力有限,且無法平衡好成本、功耗、安全性等諸多現(xiàn)實需求,因此具備多維度AI數(shù)據(jù)集中處理能力的多模態(tài)AI芯片將成必由之路。

為實現(xiàn)多模態(tài)AI芯片的戰(zhàn)略落地,目前云知聲已在加速技術(shù)布局,并在機(jī)器視覺方面取得飛速進(jìn)展。其中,面向機(jī)器視覺的輕量級圖像信號處理器已可實現(xiàn)在不依賴外部內(nèi)存的情況下,在30 fps的速率下實時對傳感器的圖片進(jìn)行預(yù)處理,以進(jìn)一步提高后續(xù)機(jī)器視覺處理模塊的處理速度和效果。借助基于人臉信息分析的多模態(tài)技術(shù),已可實現(xiàn)人臉/物體識別、表情分析、標(biāo)簽化、唇動狀態(tài)跟蹤等功能,可為產(chǎn)品交互和用戶體驗提供更多的可玩性和靈活性。

此外,云知聲發(fā)布多模態(tài)人工智能核心IP——DeepNet2.0,可兼容LSTM/CNN/RNN/TDNN等多種推理網(wǎng)絡(luò),支持可重構(gòu)計算與Winograd處理,最高可配置算力達(dá)4T。目前云知聲DeepNet2.0已在FPGA上得到驗證,將在2019年落地的全新多模態(tài)AI芯片海豚(Dolphin)上落地。

直面思必馳、科大訊飛垂直領(lǐng)域競爭

語音識別與語義分析,這是人們比較能理解的人工智能應(yīng)用領(lǐng)域。雖然在這條起跑線上,云知聲后來追上,但不難發(fā)現(xiàn),與其業(yè)務(wù)重合度較高的莫過于思必馳和科大訊飛兩家公司。

梳理之下可以看出,在產(chǎn)品線競爭上,云知聲圍繞智能家居、智能車載、機(jī)器人、智慧醫(yī)療和智慧教育等的五大領(lǐng)域四面受敵。

云知聲產(chǎn)品線中的智能家居方案、智能車載方案和機(jī)器人方案,直面與思必馳構(gòu)成業(yè)務(wù)重疊,競爭態(tài)勢強(qiáng)烈。據(jù)思必馳CMO龍夢竹曾介紹,思必馳車載語音在智能車載后裝市場占據(jù)約60%的份額,在智能后視鏡領(lǐng)域約為70%,HUD領(lǐng)域已高達(dá)80%。

在智慧醫(yī)療與智慧教育領(lǐng)域里,科大訊飛仍是擺在眼前的不小阻力。除了雙方均大力布局將語音轉(zhuǎn)成結(jié)構(gòu)化電子病歷系統(tǒng)與智能口語評測外,科大訊飛還在醫(yī)學(xué)影像輔助診斷和基于認(rèn)知計算的輔助診療系統(tǒng)方面有所布局,并且根據(jù)科大訊飛2017年財報表示,其智慧教育產(chǎn)品已經(jīng)覆蓋全國15000余所學(xué)校,深度用戶超過1500萬,占總主營業(yè)務(wù)收入的25.54%。

因此,對于云知聲而言,面對行業(yè)里既有科大訊飛這樣的“老大”,又有不斷加碼人工智能投入的BAT等巨頭,由應(yīng)用場景來定義AI芯片的研發(fā)與產(chǎn)品形態(tài)無疑是其獨立發(fā)展的最佳路徑。

以語音病歷系統(tǒng)為例。醫(yī)生在說話時,能輕松地與電腦、iPad、移動查房設(shè)備等建立聯(lián)系;說話的內(nèi)容會被轉(zhuǎn)錄成文字并顯示在醫(yī)院專門的HIS、PACS、CIS等系統(tǒng)中。但是在醫(yī)療這個專業(yè)性非常強(qiáng)的領(lǐng)域,常規(guī)語音識別系統(tǒng)并不能完美勝任。

為此,云知聲針對醫(yī)院不同科室的業(yè)務(wù)進(jìn)行了梳理,整理了超過30GB的醫(yī)療文本資料,并對這些資料進(jìn)行分類、檢索等處理,使得定制語音模型覆蓋各個科室常用病癥、藥品名稱、操作步驟等關(guān)鍵信息,使語音識別準(zhǔn)確率超過95%。同時,針對醫(yī)生的口音問題,云知聲提出了無監(jiān)督自適應(yīng)技術(shù),提高對醫(yī)生口語的識別率。

所以,在這一輪人工智能風(fēng)潮的到來,最重要的是芯片定位。云知聲的做法是,針對細(xì)分客戶的需求做極致化服務(wù),從算法公司的角度出發(fā)做芯片,軟硬結(jié)合打造出一個好用的芯片,欲成為語音交互佼佼者,同時希望推出語音AI芯片打造生態(tài),從而實現(xiàn)價值的提升。

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報投訴
  • 語音交互
    +關(guān)注

    關(guān)注

    3

    文章

    307

    瀏覽量

    28619
  • AI芯片
    +關(guān)注

    關(guān)注

    17

    文章

    1983

    瀏覽量

    35915

原文標(biāo)題:“聲”勢驚人 AI語音交互芯片 啟動新一輪垂直領(lǐng)域戰(zhàn)場

文章出處:【微信號:DIGITIMES,微信公眾號:DIGITIMES】歡迎添加關(guān)注!文章轉(zhuǎn)載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關(guān)推薦
    熱點推薦

    模態(tài)感知+豆包大模型!家居端側(cè)智能升級

    的關(guān)鍵力量。星宸科技與豆包大模型的合作,將這一技術(shù)趨勢落實到實際應(yīng)用場景中,在智能家居、可穿戴設(shè)備以及連鎖店等領(lǐng)域引發(fā)了深刻變革。 ? 智能家居升級 ? 陳立敬指出:“智能家居2.0需要大模型大腦”。在智能家居領(lǐng)域,
    的頭像 發(fā)表于 06-21 00:06 ?5714次閱讀
    <b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>感知+豆包大模型!家居端側(cè)智能升級

    模態(tài)+空間智能:盾華以AI+智慧路燈桿,點亮城市治理新方式

    模態(tài)+空間智能:盾華以AI+智慧路燈桿,點亮城市治理新方式
    的頭像 發(fā)表于 06-12 10:17 ?172次閱讀
    <b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>+空間智能:盾華以AI+智慧路燈桿,點亮城市治理新方式

    愛芯通元NPU適配Qwen2.5-VL-3B視覺模態(tài)大模型

    熟悉愛芯通元NPU的網(wǎng)友很清楚,從去年開始我們在端側(cè)模態(tài)大模型適配上一直處于主動緊跟的節(jié)奏。先后適配了國內(nèi)最早開源的模態(tài)大模MiniCPM V 2.0,上海人工智能實驗室的書生
    的頭像 發(fā)表于 04-21 10:56 ?1435次閱讀
    愛芯通元NPU適配Qwen2.5-VL-3B視覺<b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>大模型

    ??低暟l(fā)布模態(tài)大模型AI融合巡檢超腦

    基于海康觀瀾大模型技術(shù)體系,海康威視推出新一代模態(tài)大模型AI融合巡檢超腦,全面升級人、車、行為、事件等算法,為行業(yè)帶來全新的模態(tài)大模型巡檢體驗,以更準(zhǔn)確、更高效的智慧巡檢,為各行各
    的頭像 發(fā)表于 04-17 17:12 ?825次閱讀

    采用可更新且具區(qū)分度錨點的模態(tài)運動預(yù)測研究

    在自動駕駛領(lǐng)域,運動預(yù)測 (Motion Prediction) 是一個重要任務(wù),它有助于場景理解和安全決策。該任務(wù)利用歷史狀態(tài)和道路地圖來預(yù)測目標(biāo)智能體的未來軌跡。其主要挑戰(zhàn)來自未來行為的模態(tài)性 (Multimodality
    的頭像 發(fā)表于 04-01 10:32 ?353次閱讀
    采用可更新且具區(qū)分度錨點的<b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>運動預(yù)測研究

    ?模態(tài)交互技術(shù)解析

    模態(tài)交互 模態(tài)交互( Multimodal Interaction )是指通過多種感官通道(如視覺、聽覺、觸覺等)或多種交互方式(如語音、手勢、觸控、眼動等)與計算機(jī)系統(tǒng)進(jìn)行自然、
    的頭像 發(fā)表于 03-17 15:12 ?2054次閱讀

    ??低暟l(fā)布模態(tài)大模型文搜存儲系列產(chǎn)品

    模態(tài)大模型為安防行業(yè)帶來重大技術(shù)革新,基于觀瀾大模型技術(shù)體系,海康威視將大參數(shù)量、大樣本量的圖文模態(tài)大模型與嵌入式智能硬件深度融合,發(fā)布
    的頭像 發(fā)表于 02-18 10:33 ?684次閱讀

    體驗MiniCPM-V 2.6 模態(tài)能力

    模態(tài)組網(wǎng)
    jf_23871869
    發(fā)布于 :2025年01月20日 13:40:48

    商湯日日新模態(tài)大模型權(quán)威評測第一

    剛剛,商湯科技日日新SenseNova模態(tài)大模型,在權(quán)威綜合評測權(quán)威平臺OpenCompass的模態(tài)評測中取得榜單第一。
    的頭像 發(fā)表于 12-20 10:39 ?1022次閱讀

    一文理解模態(tài)大語言模型——

    /understanding-multimodal-llms ? 《一文理解模態(tài)大語言模型 - 上》介紹了什么是模態(tài)大語言模型,以及構(gòu)建
    的頭像 發(fā)表于 12-03 15:18 ?595次閱讀
    一文理解<b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>大語言模型——<b class='flag-5'>下</b>

    利用OpenVINO部署Qwen2模態(tài)模型

    模態(tài)大模型的核心思想是將不同媒體數(shù)據(jù)(如文本、圖像、音頻和視頻等)進(jìn)行融合,通過學(xué)習(xí)不同模態(tài)之間的關(guān)聯(lián),實現(xiàn)更加智能化的信息處理。簡單來說,模態(tài)
    的頭像 發(fā)表于 10-18 09:39 ?1261次閱讀

    云知聲山海模態(tài)大模型UniGPT-mMed登頂MMMU測評榜首

    近日,模態(tài)人工智能模型基準(zhǔn)評測集MMMU更新榜單,云知聲山海模態(tài)大模型UniGPT-mMed以通用能力、醫(yī)療專業(yè)能力雙雙排名第一的優(yōu)異成績登頂榜首,力壓GPT-4V,充分彰顯其硬核
    的頭像 發(fā)表于 10-12 14:09 ?678次閱讀
    云知聲山海<b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>大模型UniGPT-mMed登頂MMMU測評榜首

    Meta發(fā)布模態(tài)LLAMA 3.2人工智能模型

    Meta Platforms近日宣布了一項重要技術(shù)突破,成功推出了模態(tài)LLAMA 3.2人工智能模型。這一創(chuàng)新模型不僅能夠深度解析文本信息,還實現(xiàn)了對圖像內(nèi)容的精準(zhǔn)理解,標(biāo)志著Meta在AI
    的頭像 發(fā)表于 09-27 11:44 ?700次閱讀

    云知聲推出山海模態(tài)大模型

    在人工智能技術(shù)的浩瀚星海中,模態(tài)交互技術(shù)正成為引領(lǐng)未來的新航標(biāo)。繼OpenAI的GPT-4o掀起滔天巨浪后,云知聲以創(chuàng)新之姿,推出了其匠心獨運的山海模態(tài)大模型,正式宣告“Her時代
    的頭像 發(fā)表于 08-27 15:20 ?629次閱讀

    依圖模態(tài)大模型伙伴CTO精研班圓滿舉辦

    大模型在不同行業(yè)領(lǐng)域的應(yīng)用前景;7月19日, “依圖科技模態(tài)大模型伙伴CTO精研班”在杭州圓滿舉辦,讓更多的伙伴們深度體驗了依圖模態(tài)大模
    的頭像 發(fā)表于 07-23 15:16 ?690次閱讀