近日,小米推出了全面支持情感化語音交互的小米小愛音箱Art,小米也成為業(yè)內(nèi)首家情感化TTS大規(guī)模落地的企業(yè)。
基于開心、關(guān)心、害羞等有限但類型不同的情感音頻數(shù)據(jù),通過不同技術(shù)訓(xùn)練并迭代聲學(xué)模型,這款音箱支持情感TTS合成,并實現(xiàn)了“小愛同學(xué)”的音感化、擬人化。
隨著人工智能技術(shù)的發(fā)展,在實現(xiàn)人機(jī)對話的基礎(chǔ)上,各大AI企業(yè)都在情感化語音交互的領(lǐng)域積極展開探索。
例如在智能客服領(lǐng)域,當(dāng)用戶的問題無法解決或者問題表述不清時,智能客服很有可能無法識別用戶的情緒、進(jìn)行進(jìn)一步操作,從而引發(fā)用戶的不滿和投訴。
針對這一情況,日本NTT研究所研發(fā)出一款客服電話情感識別系統(tǒng),對用戶的電話語音進(jìn)行收集處理,如果未檢測到用戶憤怒的情感,則繼續(xù)當(dāng)前的語音服務(wù);如果檢測到憤怒的情感,則轉(zhuǎn)為人工服務(wù)進(jìn)行業(yè)務(wù)處理。
語音情感識別通常指機(jī)器從語音中自動識別人類情感和情感相關(guān)狀態(tài)的過程。通過分析說話人情緒使機(jī)器進(jìn)行擬人化的互動,識別說話人的情感成為語音技術(shù)發(fā)力的一個新熱點。
語音情感識別包括兩種,NTT推出的客服電話情感識別系統(tǒng)屬于只通過聲音來分析情感。這一情感語音識別模型的落地應(yīng)用離不開訓(xùn)練數(shù)據(jù)的支撐。
數(shù)據(jù)堂深耕于AI數(shù)據(jù)領(lǐng)域近十年,一直致力于為全球人工智能企業(yè)提供專業(yè)的數(shù)據(jù)服務(wù),行業(yè)內(nèi)高標(biāo)準(zhǔn)的語音情感識別訓(xùn)練數(shù)據(jù)《20人英文情感語音麥克風(fēng)采集數(shù)據(jù)》和《30部電影語音視頻標(biāo)注數(shù)據(jù)》廣受重視和好評。
語音情感識別的另外一種模型就是結(jié)合聲音和圖像的多模態(tài)情感分析。
機(jī)器人Pepper就是應(yīng)用多模態(tài)情感分析的典型案例。
Pepper是由日本軟銀集團(tuán)和法國Aldebaran Robotics研發(fā)的一款人形機(jī)器人,可綜合考慮周圍環(huán)境,積極主動地作出反應(yīng)。
Pepper配備了語音識別技術(shù)以及分析表情和聲調(diào)的情緒識別技術(shù),經(jīng)過定制化開發(fā),可通過表情、動作、語音與人類交流、反饋,甚至能夠跳舞、開玩笑。
如今在商業(yè)領(lǐng)域,全球超過2000家企業(yè)應(yīng)用了Pepper,服務(wù)于零售、金融、健康護(hù)理等眾多行業(yè)。
麻省理工學(xué)院媒體實驗室分拆公司Affectiva通過語音和面部數(shù)據(jù)打造了情感檔案,其神經(jīng)網(wǎng)絡(luò)SoundNet可以在短短1.2秒內(nèi)識別出音頻數(shù)據(jù)中的憤怒情緒。
除了憤怒,人的情感從大類上可分為高興、悲傷、失望、驚訝等面部情感,從內(nèi)心情感上還可細(xì)分為:尷尬、猶豫、贊同、羨慕等。這些情感可以用VAD方法進(jìn)行量化打分。
所謂VAD,是指Valence、Arousal、Dominance三個衡量維度。
· Valence(效價),指達(dá)到目標(biāo)對于滿足個人需要的價值,同一個目標(biāo)對每一個人可能有三種效價:正、零、負(fù)。
· Arousal(積極程度),即精神+身體共同體現(xiàn)出的積極程度,如充滿活力或死氣沉沉。
· Dominance(優(yōu)勢度),表示個體對情景和他人的控制狀態(tài),如憤怒就屬于優(yōu)勢度高的情感,而恐懼屬于優(yōu)勢度低的情感。
數(shù)據(jù)堂一直致力于開發(fā)個性化的機(jī)器訓(xùn)練數(shù)據(jù),并將數(shù)據(jù)和服務(wù)落地到AI產(chǎn)品和業(yè)務(wù),為人們帶去更好的產(chǎn)品體驗,讓每個人都能享受人工智能帶來的美好生活。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!
2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領(lǐng)軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊”,云天勵飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運營商、科研院所等優(yōu)秀團(tuán)隊
這幾個月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓(xùn)練模型來實現(xiàn)圖像識別、聲音識別、語言處理等特
文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發(fā)者大會上,發(fā)布了企業(yè)級戰(zhàn)略PaaS2.0,希望通過一個平臺+四大開發(fā)服務(wù),建立起IoT生態(tài)。對于這場發(fā)布會,市場的態(tài)度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩(wěn)定
美團(tuán)曾經(jīng)的二號人物王慧文對標(biāo)OpenAI的創(chuàng)業(yè)項目光年之外,以20億賣給美團(tuán),再度引發(fā)市場對大模型的熱議。
2020年底,王慧文在朋友圈寫下這句話時,外界本以為這位伴隨中國互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺。但是,一個曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。
文/道哥美國設(shè)計軟件公司Figma近期在紐約證券交易所掛牌上市,首日即上演“狂飆”行情——發(fā)行價定每股33美元,開盤報價85美元,較發(fā)行價翻倍。首日收報115.50美元,較發(fā)行價大漲約250%,市值飆升至近670億美元,創(chuàng)下近30年來同等規(guī)模美股IPO的最大單日漲幅紀(jì)錄。然而,隨著短線資金獲利了結(jié),
8月16日,盧松松非常榮幸的成為了一名《2025世界人形機(jī)器人運動會》的觀眾。這是一場超酷的機(jī)器人運動會,也是人類給機(jī)器人辦的第一屆奧運會,來自16個國家的280支隊伍會參加500多個比賽項目??戳艘惶斓谋荣悾砩暇突貋韺懳恼?,編輯短視頻。先說感悟:(1)這是人類首次給機(jī)器人辦的第一屆運動會,史無前
文/一燈來源/節(jié)點財經(jīng)在當(dāng)前無人敢缺席的AI軍備競賽中,巨頭們一面為巨額的資本支出焦慮,一面又向市場勾勒著未來的宏偉藍(lán)圖。在各家動輒千億級投入的背景下,市場迫切需要一份關(guān)于AI回報價值的有力證明。而騰訊,率先給出了答卷。8月13日,騰訊控股發(fā)布2025年第二季度財報。盡管資本開支同比劇增119%,達(dá)
文/二風(fēng)來源/節(jié)點財經(jīng)2025年的硅谷,一場沒有硝煙的戰(zhàn)爭正以前所未有的烈度上演。這場戰(zhàn)爭的核心武器不是代碼或芯片,而是人——那些全球僅有數(shù)千名、能夠構(gòu)建未來人工智能基礎(chǔ)模型的頂尖大腦。在這場激烈的人才爭奪戰(zhàn)中,Meta及其首席執(zhí)行官馬克·扎克伯格(MarkZuckerberg)正扮演著最具侵略性的
阿里媽媽、巨量引擎、騰訊廣告,誰是當(dāng)代“AI印鈔機(jī)”?
Manus撕開一道真相
文/八真來源/節(jié)點財經(jīng)具身智能賽道,誰最有可能拔得A股資本市場的頭籌?答案大概率是誕生剛剛兩年,由華為"天才少年"、B站百萬粉絲科技UP主稚暉君(彭志輝)創(chuàng)立的智元機(jī)器人。近期,從事新材料研發(fā)與生產(chǎn)的上緯新材(688585.SH)丟出重磅炸彈,宣布智元機(jī)器人及相關(guān)主體將通過收購其至少63.62%的股
文/道哥大舉裁員、清空賬號、國內(nèi)IP無法訪問——曾被譽為“中國AIAgent希望之星”的Manus,在估值飆至5億美元的高光時刻“閃離”中國市場。近日,Manus“裁員、出走”的消息在媒體端大量發(fā)酵。消息稱,Manus公司總部將由中國遷至新加坡,其國內(nèi)團(tuán)隊也將大幅裁撤——原有120人規(guī)模團(tuán)隊除40余