什么棋牌能挣人民币,优惠大厅直播活动方案策划书怎么写好 ,百家乐官网波音平台有假吗(中国)·官方网站

2018年人工智能（AI）行業(yè)成為了最受關(guān)注的熱點(diǎn)之一，不同場(chǎng)景的AI芯片層出不窮，成為了智能時(shí)代的“入場(chǎng)券”，大多數(shù)業(yè)者稱“得芯者得天下”，將2018年定義為“芯片元年”。

語音垂直應(yīng)用領(lǐng)域，“造芯”似已成為云知聲、出門問問、Rokid 、思必馳、科大訊飛從算法出發(fā)“軟硬兼施”一條必走之途，但也顯得語音AI市場(chǎng)變得異常競(jìng)爭(zhēng)激烈。

在此背景下，2018年5月，云知聲推出首款物聯(lián)網(wǎng)AI芯片——雨燕（Swift），通過“唯快不破”的發(fā)展思路，很快在語音識(shí)別風(fēng)口中和科大訊飛比肩，并完成C輪1億美元的融資躋身國(guó)內(nèi)眾多AI獨(dú)角獸榜單中的一員。

而在2019年開年之際，云知聲繼續(xù)搶跑，于1月2日召開了“2019云知聲多模態(tài)AI芯片戰(zhàn)略發(fā)布會(huì)”，會(huì)上正式公布了其多模態(tài)AI技術(shù)，以及正在研發(fā)中的多款定位不同場(chǎng)景的AI芯片，包括實(shí)用性更廣的超輕量級(jí)物聯(lián)網(wǎng)語音芯片雨燕（Lite）、可面向智慧城市場(chǎng)景提供對(duì)語音和圖像等多模態(tài)計(jì)算支持的海豚（Dolphin），以及面向智慧出行場(chǎng)景的車規(guī)級(jí)芯片雪豹（Leopard）。以上三款芯片計(jì)劃于2019年啟動(dòng)量產(chǎn)。

AIoT下的多模態(tài)演變之路

云知聲創(chuàng)始人兼CEO黃偉認(rèn)為，5G與人工智能的結(jié)合將真正促使萬物智聯(lián)（AIoT）的落地與實(shí)現(xiàn)?？梢灶A(yù)見的是，未來巨量的多維數(shù)據(jù)（如語音、圖像、視頻等）集中處理與邊緣式分布計(jì)算的需求，勢(shì)必將進(jìn)一步挑戰(zhàn)AI底層支持硬件——芯片的計(jì)算能力。

與此同時(shí)，AI應(yīng)用對(duì)于端云互動(dòng)有著強(qiáng)需求。強(qiáng)大的云會(huì)讓端能力更強(qiáng)，而強(qiáng)大的端則可提升數(shù)據(jù)處理的實(shí)時(shí)性和有效性，進(jìn)而增強(qiáng)云的能力。二者需要緊密結(jié)合，這要求對(duì)芯片設(shè)計(jì)和云端架構(gòu)進(jìn)行統(tǒng)一考量。傳統(tǒng)的通用方案架構(gòu)由于在高實(shí)時(shí)性、高智能化場(chǎng)景中的算力有限，且無法平衡好成本、功耗、安全性等諸多現(xiàn)實(shí)需求，因此具備多維度AI數(shù)據(jù)集中處理能力的多模態(tài)AI芯片將成必由之路。

為實(shí)現(xiàn)多模態(tài)AI芯片的戰(zhàn)略落地，目前云知聲已在加速技術(shù)布局，并在機(jī)器視覺方面取得飛速進(jìn)展。其中，面向機(jī)器視覺的輕量級(jí)圖像信號(hào)處理器已可實(shí)現(xiàn)在不依賴外部?jī)?nèi)存的情況下，在30 fps的速率下實(shí)時(shí)對(duì)傳感器的圖片進(jìn)行預(yù)處理，以進(jìn)一步提高后續(xù)機(jī)器視覺處理模塊的處理速度和效果。借助基于人臉信息分析的多模態(tài)技術(shù)，已可實(shí)現(xiàn)人臉/物體識(shí)別、表情分析、標(biāo)簽化、唇動(dòng)狀態(tài)跟蹤等功能，可為產(chǎn)品交互和用戶體驗(yàn)提供更多的可玩性和靈活性。

此外，云知聲發(fā)布多模態(tài)人工智能核心IP——DeepNet2.0，可兼容LSTM/CNN/RNN/TDNN等多種推理網(wǎng)絡(luò)，支持可重構(gòu)計(jì)算與Winograd處理，最高可配置算力達(dá)4T。目前云知聲DeepNet2.0已在FPGA上得到驗(yàn)證，將在2019年落地的全新多模態(tài)AI芯片海豚（Dolphin）上落地。

直面思必馳、科大訊飛垂直領(lǐng)域競(jìng)爭(zhēng)

語音識(shí)別與語義分析，這是人們比較能理解的人工智能應(yīng)用領(lǐng)域。雖然在這條起跑線上，云知聲后來追上，但不難發(fā)現(xiàn)，與其業(yè)務(wù)重合度較高的莫過于思必馳和科大訊飛兩家公司。

梳理之下可以看出，在產(chǎn)品線競(jìng)爭(zhēng)上，云知聲圍繞智能家居、智能車載、機(jī)器人、智慧醫(yī)療和智慧教育等的五大領(lǐng)域四面受敵。

云知聲產(chǎn)品線中的智能家居方案、智能車載方案和機(jī)器人方案，直面與思必馳構(gòu)成業(yè)務(wù)重疊，競(jìng)爭(zhēng)態(tài)勢(shì)強(qiáng)烈。據(jù)思必馳CMO龍夢(mèng)竹曾介紹，思必馳車載語音在智能車載后裝市場(chǎng)占據(jù)約60%的份額，在智能后視鏡領(lǐng)域約為70%，HUD領(lǐng)域已高達(dá)80%。

在智慧醫(yī)療與智慧教育領(lǐng)域里，科大訊飛仍是擺在眼前的不小阻力。除了雙方均大力布局將語音轉(zhuǎn)成結(jié)構(gòu)化電子病歷系統(tǒng)與智能口語評(píng)測(cè)外，科大訊飛還在醫(yī)學(xué)影像輔助診斷和基于認(rèn)知計(jì)算的輔助診療系統(tǒng)方面有所布局，并且根據(jù)科大訊飛2017年財(cái)報(bào)表示，其智慧教育產(chǎn)品已經(jīng)覆蓋全國(guó)15000余所學(xué)校，深度用戶超過1500萬，占總主營(yíng)業(yè)務(wù)收入的25.54%。

因此，對(duì)于云知聲而言，面對(duì)行業(yè)里既有科大訊飛這樣的“老大”，又有不斷加碼人工智能投入的BAT等巨頭，由應(yīng)用場(chǎng)景來定義AI芯片的研發(fā)與產(chǎn)品形態(tài)無疑是其獨(dú)立發(fā)展的最佳路徑。

以語音病歷系統(tǒng)為例。醫(yī)生在說話時(shí)，能輕松地與電腦、iPad、移動(dòng)查房設(shè)備等建立聯(lián)系；說話的內(nèi)容會(huì)被轉(zhuǎn)錄成文字并顯示在醫(yī)院專門的HIS、PACS、CIS等系統(tǒng)中。但是在醫(yī)療這個(gè)專業(yè)性非常強(qiáng)的領(lǐng)域，常規(guī)語音識(shí)別系統(tǒng)并不能完美勝任。

為此，云知聲針對(duì)醫(yī)院不同科室的業(yè)務(wù)進(jìn)行了梳理，整理了超過30GB的醫(yī)療文本資料，并對(duì)這些資料進(jìn)行分類、檢索等處理，使得定制語音模型覆蓋各個(gè)科室常用病癥、藥品名稱、操作步驟等關(guān)鍵信息，使語音識(shí)別準(zhǔn)確率超過95%。同時(shí)，針對(duì)醫(yī)生的口音問題，云知聲提出了無監(jiān)督自適應(yīng)技術(shù)，提高對(duì)醫(yī)生口語的識(shí)別率。

所以，在這一輪人工智能風(fēng)潮的到來，最重要的是芯片定位。云知聲的做法是，針對(duì)細(xì)分客戶的需求做極致化服務(wù)，從算法公司的角度出發(fā)做芯片，軟硬結(jié)合打造出一個(gè)好用的芯片，欲成為語音交互佼佼者，同時(shí)希望推出語音AI芯片打造生態(tài)，從而實(shí)現(xiàn)價(jià)值的提升。

聲明：本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人，不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用，如有內(nèi)容侵權(quán)或者其他違規(guī)問題，請(qǐng)聯(lián)系本站處理。舉報(bào)投訴

語音交互

語音交互

+關(guān)注

關(guān)注
3

文章
287

瀏覽量
28072
AI芯片

AI芯片

+關(guān)注

關(guān)注
17

文章
1906

瀏覽量
35219

原文標(biāo)題：“聲”勢(shì)驚人 AI語音交互芯片啟動(dòng)新一輪垂直領(lǐng)域戰(zhàn)場(chǎng)

文章出處：【微信號(hào)：DIGITIMES，微信公眾號(hào)：DIGITIMES】歡迎添加關(guān)注！文章轉(zhuǎn)載請(qǐng)注明出處。

評(píng)論

相關(guān)推薦

體驗(yàn)MiniCPM-V 2.6 多模態(tài)能力

多模態(tài)組網(wǎng)

jf_23871869

發(fā)布于 :2025年01月20日 13:40:48

商湯日日新多模態(tài)大模型權(quán)威評(píng)測(cè)第一

剛剛，商湯科技日日新SenseNova多模態(tài)大模型，在權(quán)威綜合評(píng)測(cè)權(quán)威平臺(tái)OpenCompass的多模態(tài)評(píng)測(cè)中取得榜單第一。

發(fā)表于 12-20 10:39 ?355次閱讀

一文理解多模態(tài)大語言模型——下

/understanding-multimodal-llms ? 《一文理解多模態(tài)大語言模型 - 上》介紹了什么是多模態(tài)大語言模型，以及構(gòu)建多

發(fā)表于 12-03 15:18 ?203次閱讀

利用OpenVINO部署Qwen2多模態(tài)模型

多模態(tài)大模型的核心思想是將不同媒體數(shù)據(jù)（如文本、圖像、音頻和視頻等）進(jìn)行融合，通過學(xué)習(xí)不同模態(tài)之間的關(guān)聯(lián)，實(shí)現(xiàn)更加智能化的信息處理。簡(jiǎn)單來說，多模態(tài)

發(fā)表于 10-18 09:39 ?553次閱讀

云知聲山海多模態(tài)大模型UniGPT-mMed登頂MMMU測(cè)評(píng)榜首

近日，多模態(tài)人工智能模型基準(zhǔn)評(píng)測(cè)集MMMU更新榜單，云知聲山海多模態(tài)大模型UniGPT-mMed以通用能力、醫(yī)療專業(yè)能力雙雙排名第一的優(yōu)異成績(jī)登頂榜首，力壓GPT-4V，充分彰顯其硬核

發(fā)表于 10-12 14:09 ?341次閱讀

Meta發(fā)布多模態(tài)LLAMA 3.2人工智能模型

Meta Platforms近日宣布了一項(xiàng)重要技術(shù)突破，成功推出了多模態(tài)LLAMA 3.2人工智能模型。這一創(chuàng)新模型不僅能夠深度解析文本信息，還實(shí)現(xiàn)了對(duì)圖像內(nèi)容的精準(zhǔn)理解，標(biāo)志著Meta在AI多

發(fā)表于 09-27 11:44 ?454次閱讀

云知聲推出山海多模態(tài)大模型

在人工智能技術(shù)的浩瀚星海中，多模態(tài)交互技術(shù)正成為引領(lǐng)未來的新航標(biāo)。繼OpenAI的GPT-4o掀起滔天巨浪后，云知聲以創(chuàng)新之姿，推出了其匠心獨(dú)運(yùn)的山海多模態(tài)大模型，正式宣告“Her時(shí)代

發(fā)表于 08-27 15:20 ?436次閱讀

依圖多模態(tài)大模型伙伴CTO精研班圓滿舉辦

大模型在不同行業(yè)領(lǐng)域的應(yīng)用前景;7月19日， “依圖科技多模態(tài)大模型伙伴CTO精研班”在杭州圓滿舉辦，讓更多的伙伴們深度體驗(yàn)了依圖多模態(tài)大模

發(fā)表于 07-23 15:16 ?471次閱讀

智譜AI發(fā)布全新多模態(tài)開源模型GLM-4-9B

近日，智譜AI在人工智能領(lǐng)域取得重大突破，成功推出全新開源模型GLM-4-9B。這款模型以其卓越的多模態(tài)能力，再次刷新了業(yè)界對(duì)于大型語言模型的認(rèn)識(shí)。

發(fā)表于 06-07 09:17 ?824次閱讀

谷歌發(fā)布多模態(tài)AI新品，加劇AI巨頭競(jìng)爭(zhēng)

在全球AI競(jìng)技場(chǎng)上，谷歌與OpenAI一直穩(wěn)居領(lǐng)先地位。近日，谷歌在I/O開發(fā)者大會(huì)上掀起了一股新的技術(shù)浪潮，發(fā)布了多款全新升級(jí)的多模態(tài)AI產(chǎn)品。

發(fā)表于 05-16 09:28 ?493次閱讀

人大系初創(chuàng)公司智子引擎發(fā)布全新多模態(tài)大模型Awaker 1.0

人大系初創(chuàng)公司智子引擎近日震撼發(fā)布了新一代多模態(tài)大模型Awaker 1.0，這一里程碑式的成果標(biāo)志著公司在通用人工智能（AGI）領(lǐng)域取得了重要突破。與前代ChatImg序列模型相比，Awaker 1.0憑借其獨(dú)特的MOE架構(gòu)和業(yè)

發(fā)表于 05-06 09:59 ?669次閱讀

李未可科技正式推出WAKE-AI多模態(tài)AI大模型

李未可科技多模態(tài) AI 大模型正式發(fā)布，積極推進(jìn) AI 在終端的場(chǎng)景應(yīng)用 ? 4月18日，2024中國(guó)生成式AI大會(huì)上李未可科技正式發(fā)布為眼鏡等未來終端定向優(yōu)化等自研WAKE-AI多模態(tài)

發(fā)表于 04-18 17:01 ?661次閱讀

AI機(jī)器人迎來多模態(tài)模型

配備 GR00T 模型的機(jī)器人由于需要“吸收消化”外界的多模態(tài)信息，還要快速完成理解、決策、行動(dòng)等一系列動(dòng)作，因此對(duì)于算力的需求是巨量的。

發(fā)表于 04-12 10:39 ?310次閱讀

谷歌推出多模態(tài)VLOGGER AI

谷歌最新推出的VLOGGER AI技術(shù)引起了廣泛關(guān)注，這項(xiàng)創(chuàng)新的多模態(tài)模型能夠讓靜態(tài)肖像圖“活”起來并“說話”。用戶只需提供一張人物肖像照片和一段音頻內(nèi)容，VLOGGER AI就能讓圖片中的人物仿佛真的在朗讀這段音頻，面部表情豐富，栩栩如生。

發(fā)表于 03-22 10:45 ?906次閱讀

蘋果發(fā)布300億參數(shù)MM1多模態(tài)大模型

近日，科技巨頭蘋果公司在一篇由多位專家共同撰寫的論文中，正式公布了其最新的多模態(tài)大模型研究成果——MM1。這款具有高達(dá)300億參數(shù)的多模態(tài)模型系列，由密集模型和混合專家（MoE）變體組

發(fā)表于 03-19 11:19 ?957次閱讀

衡阳派盒市场营销有限公司

搜索歷史

AIoT下的多模態(tài)演變之路垂直領(lǐng)域競(jìng)爭(zhēng)激烈

評(píng)論

體驗(yàn)MiniCPM-V 2.6 多模態(tài)能力

商湯日日新多模態(tài)大模型權(quán)威評(píng)測(cè)第一

一文理解多模態(tài)大語言模型——下

利用OpenVINO部署Qwen2多模態(tài)模型

云知聲山海多模態(tài)大模型UniGPT-mMed登頂MMMU測(cè)評(píng)榜首

Meta發(fā)布多模態(tài)LLAMA 3.2人工智能模型

云知聲推出山海多模態(tài)大模型

依圖多模態(tài)大模型伙伴CTO精研班圓滿舉辦

智譜AI發(fā)布全新多模態(tài)開源模型GLM-4-9B

谷歌發(fā)布多模態(tài)AI新品，加劇AI巨頭競(jìng)爭(zhēng)

人大系初創(chuàng)公司智子引擎發(fā)布全新多模態(tài)大模型Awaker 1.0

李未可科技正式推出WAKE-AI多模態(tài)AI大模型

AI機(jī)器人迎來多模態(tài)模型

谷歌推出多模態(tài)VLOGGER AI

蘋果發(fā)布300億參數(shù)MM1多模態(tài)大模型

搜索歷史

AIoT下的多模態(tài)演變之路 垂直領(lǐng)域競(jìng)爭(zhēng)激烈

評(píng)論

AIoT下的多模態(tài)演變之路垂直領(lǐng)域競(jìng)爭(zhēng)激烈