2018年人工智能(AI)行業(yè)成為了最受關(guān)注的熱點(diǎn)之一,不同場(chǎng)景的AI芯片層出不窮,成為了智能時(shí)代的“入場(chǎng)券”,大多數(shù)業(yè)者稱“得芯者得天下”,將2018年定義為“芯片元年”。
語音垂直應(yīng)用領(lǐng)域,“造芯”似已成為云知聲、出門問問、Rokid 、思必馳、科大訊飛從算法出發(fā)“軟硬兼施”一條必走之途,但也顯得語音AI市場(chǎng)變得異常競(jìng)爭(zhēng)激烈。
在此背景下,2018年5月,云知聲推出首款物聯(lián)網(wǎng)AI芯片——雨燕(Swift),通過“唯快不破”的發(fā)展思路,很快在語音識(shí)別風(fēng)口中和科大訊飛比肩,并完成C輪1億美元的融資躋身國(guó)內(nèi)眾多AI獨(dú)角獸榜單中的一員。
而在2019年開年之際,云知聲繼續(xù)搶跑,于1月2日召開了“2019云知聲多模態(tài)AI芯片戰(zhàn)略發(fā)布會(huì)”,會(huì)上正式公布了其多模態(tài)AI技術(shù),以及正在研發(fā)中的多款定位不同場(chǎng)景的AI芯片,包括實(shí)用性更廣的超輕量級(jí)物聯(lián)網(wǎng)語音芯片雨燕(Lite)、可面向智慧城市場(chǎng)景提供對(duì)語音和圖像等多模態(tài)計(jì)算支持的海豚(Dolphin),以及面向智慧出行場(chǎng)景的車規(guī)級(jí)芯片雪豹(Leopard)。以上三款芯片計(jì)劃于2019年啟動(dòng)量產(chǎn)。
AIoT下的多模態(tài)演變之路
云知聲創(chuàng)始人兼CEO黃偉認(rèn)為,5G與人工智能的結(jié)合將真正促使萬物智聯(lián)(AIoT)的落地與實(shí)現(xiàn)??梢灶A(yù)見的是,未來巨量的多維數(shù)據(jù)(如語音、圖像、視頻等)集中處理與邊緣式分布計(jì)算的需求,勢(shì)必將進(jìn)一步挑戰(zhàn)AI底層支持硬件——芯片的計(jì)算能力。
與此同時(shí),AI應(yīng)用對(duì)于端云互動(dòng)有著強(qiáng)需求。強(qiáng)大的云會(huì)讓端能力更強(qiáng),而強(qiáng)大的端則可提升數(shù)據(jù)處理的實(shí)時(shí)性和有效性,進(jìn)而增強(qiáng)云的能力。二者需要緊密結(jié)合,這要求對(duì)芯片設(shè)計(jì)和云端架構(gòu)進(jìn)行統(tǒng)一考量。傳統(tǒng)的通用方案架構(gòu)由于在高實(shí)時(shí)性、高智能化場(chǎng)景中的算力有限,且無法平衡好成本、功耗、安全性等諸多現(xiàn)實(shí)需求,因此具備多維度AI數(shù)據(jù)集中處理能力的多模態(tài)AI芯片將成必由之路。
為實(shí)現(xiàn)多模態(tài)AI芯片的戰(zhàn)略落地,目前云知聲已在加速技術(shù)布局,并在機(jī)器視覺方面取得飛速進(jìn)展。其中,面向機(jī)器視覺的輕量級(jí)圖像信號(hào)處理器已可實(shí)現(xiàn)在不依賴外部?jī)?nèi)存的情況下,在30 fps的速率下實(shí)時(shí)對(duì)傳感器的圖片進(jìn)行預(yù)處理,以進(jìn)一步提高后續(xù)機(jī)器視覺處理模塊的處理速度和效果。借助基于人臉信息分析的多模態(tài)技術(shù),已可實(shí)現(xiàn)人臉/物體識(shí)別、表情分析、標(biāo)簽化、唇動(dòng)狀態(tài)跟蹤等功能,可為產(chǎn)品交互和用戶體驗(yàn)提供更多的可玩性和靈活性。
此外,云知聲發(fā)布多模態(tài)人工智能核心IP——DeepNet2.0,可兼容LSTM/CNN/RNN/TDNN等多種推理網(wǎng)絡(luò),支持可重構(gòu)計(jì)算與Winograd處理,最高可配置算力達(dá)4T。目前云知聲DeepNet2.0已在FPGA上得到驗(yàn)證,將在2019年落地的全新多模態(tài)AI芯片海豚(Dolphin)上落地。
直面思必馳、科大訊飛垂直領(lǐng)域競(jìng)爭(zhēng)
語音識(shí)別與語義分析,這是人們比較能理解的人工智能應(yīng)用領(lǐng)域。雖然在這條起跑線上,云知聲后來追上,但不難發(fā)現(xiàn),與其業(yè)務(wù)重合度較高的莫過于思必馳和科大訊飛兩家公司。
梳理之下可以看出,在產(chǎn)品線競(jìng)爭(zhēng)上,云知聲圍繞智能家居、智能車載、機(jī)器人、智慧醫(yī)療和智慧教育等的五大領(lǐng)域四面受敵。
云知聲產(chǎn)品線中的智能家居方案、智能車載方案和機(jī)器人方案,直面與思必馳構(gòu)成業(yè)務(wù)重疊,競(jìng)爭(zhēng)態(tài)勢(shì)強(qiáng)烈。據(jù)思必馳CMO龍夢(mèng)竹曾介紹,思必馳車載語音在智能車載后裝市場(chǎng)占據(jù)約60%的份額,在智能后視鏡領(lǐng)域約為70%,HUD領(lǐng)域已高達(dá)80%。
在智慧醫(yī)療與智慧教育領(lǐng)域里,科大訊飛仍是擺在眼前的不小阻力。除了雙方均大力布局將語音轉(zhuǎn)成結(jié)構(gòu)化電子病歷系統(tǒng)與智能口語評(píng)測(cè)外,科大訊飛還在醫(yī)學(xué)影像輔助診斷和基于認(rèn)知計(jì)算的輔助診療系統(tǒng)方面有所布局,并且根據(jù)科大訊飛2017年財(cái)報(bào)表示,其智慧教育產(chǎn)品已經(jīng)覆蓋全國(guó)15000余所學(xué)校,深度用戶超過1500萬,占總主營(yíng)業(yè)務(wù)收入的25.54%。
因此,對(duì)于云知聲而言,面對(duì)行業(yè)里既有科大訊飛這樣的“老大”,又有不斷加碼人工智能投入的BAT等巨頭,由應(yīng)用場(chǎng)景來定義AI芯片的研發(fā)與產(chǎn)品形態(tài)無疑是其獨(dú)立發(fā)展的最佳路徑。
以語音病歷系統(tǒng)為例。醫(yī)生在說話時(shí),能輕松地與電腦、iPad、移動(dòng)查房設(shè)備等建立聯(lián)系;說話的內(nèi)容會(huì)被轉(zhuǎn)錄成文字并顯示在醫(yī)院專門的HIS、PACS、CIS等系統(tǒng)中。但是在醫(yī)療這個(gè)專業(yè)性非常強(qiáng)的領(lǐng)域,常規(guī)語音識(shí)別系統(tǒng)并不能完美勝任。
為此,云知聲針對(duì)醫(yī)院不同科室的業(yè)務(wù)進(jìn)行了梳理,整理了超過30GB的醫(yī)療文本資料,并對(duì)這些資料進(jìn)行分類、檢索等處理,使得定制語音模型覆蓋各個(gè)科室常用病癥、藥品名稱、操作步驟等關(guān)鍵信息,使語音識(shí)別準(zhǔn)確率超過95%。同時(shí),針對(duì)醫(yī)生的口音問題,云知聲提出了無監(jiān)督自適應(yīng)技術(shù),提高對(duì)醫(yī)生口語的識(shí)別率。
所以,在這一輪人工智能風(fēng)潮的到來,最重要的是芯片定位。云知聲的做法是,針對(duì)細(xì)分客戶的需求做極致化服務(wù),從算法公司的角度出發(fā)做芯片,軟硬結(jié)合打造出一個(gè)好用的芯片,欲成為語音交互佼佼者,同時(shí)希望推出語音AI芯片打造生態(tài),從而實(shí)現(xiàn)價(jià)值的提升。
-
語音交互
+關(guān)注
關(guān)注
3文章
287瀏覽量
28072 -
AI芯片
+關(guān)注
關(guān)注
17文章
1906瀏覽量
35219
原文標(biāo)題:“聲”勢(shì)驚人 AI語音交互芯片 啟動(dòng)新一輪垂直領(lǐng)域戰(zhàn)場(chǎng)
文章出處:【微信號(hào):DIGITIMES,微信公眾號(hào):DIGITIMES】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。
發(fā)布評(píng)論請(qǐng)先 登錄
相關(guān)推薦
![](https://file1.elecfans.com/web3/M00/06/A4/wKgZO2eN4dmAWH2dAAPhhyGFzsw191.png)
商湯日日新多模態(tài)大模型權(quán)威評(píng)測(cè)第一
一文理解多模態(tài)大語言模型——下
![一文理解<b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>大語言模型——<b class='flag-5'>下</b>](https://file1.elecfans.com//web3/M00/00/E5/wKgZO2dOtyiACm8SAAQZToNs9ng951.png)
利用OpenVINO部署Qwen2多模態(tài)模型
云知聲山海多模態(tài)大模型UniGPT-mMed登頂MMMU測(cè)評(píng)榜首
![云知聲山海<b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>大模型UniGPT-mMed登頂MMMU測(cè)評(píng)榜首](https://file1.elecfans.com/web1/M00/F2/C2/wKgaoWcKE1CAAPGWAAAR5o7IQS0976.png)
Meta發(fā)布多模態(tài)LLAMA 3.2人工智能模型
云知聲推出山海多模態(tài)大模型
依圖多模態(tài)大模型伙伴CTO精研班圓滿舉辦
智譜AI發(fā)布全新多模態(tài)開源模型GLM-4-9B
谷歌發(fā)布多模態(tài)AI新品,加劇AI巨頭競(jìng)爭(zhēng)
人大系初創(chuàng)公司智子引擎發(fā)布全新多模態(tài)大模型Awaker 1.0
李未可科技正式推出WAKE-AI多模態(tài)AI大模型
![李未可科技正式推出WAKE-AI<b class='flag-5'>多</b><b class='flag-5'>模態(tài)</b>AI大模型](https://file1.elecfans.com/web2/M00/CD/4D/wKgZomYg4ZyAbfOHAFDzaCuLdZ8032.png)
評(píng)論