專(zhuān)業(yè)機(jī)構(gòu)發(fā)布《2019年語(yǔ)音技術(shù)》報(bào)告稱(chēng),語(yǔ)音將成為未來(lái)十年決定性主題之一,與人工智能一起從根本上改變?nèi)伺c機(jī)器的關(guān)系。近日,搜狗輸入法在語(yǔ)音輸入領(lǐng)域率先推出“個(gè)性化語(yǔ)音識(shí)別”功能,突破語(yǔ)音識(shí)別技術(shù)瓶頸,大幅優(yōu)化個(gè)人詞匯錄入的直接準(zhǔn)確性,在語(yǔ)音輸入領(lǐng)域?qū)崿F(xiàn)“更懂用戶(hù)”。
搜狗“個(gè)性化語(yǔ)音識(shí)別”打造用戶(hù)專(zhuān)屬輸入法
在日常交流中,個(gè)人口頭禪、慣用語(yǔ)經(jīng)常會(huì)干擾雙方的信息傳達(dá),這一問(wèn)題在人機(jī)語(yǔ)音交互中尤為凸顯。在語(yǔ)音輸入時(shí),往往用戶(hù)只是想錄入一個(gè)名稱(chēng),輸入結(jié)果卻顯示的是音同意不同的另一項(xiàng)結(jié)果。比如,當(dāng)用戶(hù)希望輸入法顯示人名“憑遠(yuǎn)”時(shí),通用的語(yǔ)音識(shí)別往往將大眾常用的“平原、品源”列在前列的候選詞匯,用戶(hù)的個(gè)性化內(nèi)容并不在其中。除此之外,用戶(hù)習(xí)慣使用的個(gè)人詞匯,以及一些多音字、讀音差錯(cuò)也會(huì)對(duì)語(yǔ)音識(shí)別結(jié)果造成影響。
基于以上原因,搜狗語(yǔ)音率先對(duì)語(yǔ)音識(shí)別技術(shù)進(jìn)行了革新優(yōu)化,推出“個(gè)性化語(yǔ)音識(shí)別”服務(wù)。經(jīng)過(guò)本輪更新,用戶(hù)只需在搜狗輸入法App選擇一鍵登錄個(gè)人賬戶(hù),即可體驗(yàn)此項(xiàng)服務(wù)。成功開(kāi)啟后,“個(gè)性化語(yǔ)音識(shí)別”會(huì)通過(guò)強(qiáng)化學(xué)習(xí)用戶(hù)習(xí)慣使用的個(gè)人詞匯,為每個(gè)用戶(hù)建立定制化語(yǔ)音輸入法。此后,在用戶(hù)需要進(jìn)行語(yǔ)音輸入時(shí),輸入法會(huì)根據(jù)語(yǔ)言環(huán)境,結(jié)合上下段落語(yǔ)句進(jìn)行分析,快速輸出符合用戶(hù)心意的文本內(nèi)容,有效減少用戶(hù)手動(dòng)進(jìn)行二次更改的頻率。
搜狗語(yǔ)音又誕生“黑科技”語(yǔ)音識(shí)別更精準(zhǔn)
搜狗“個(gè)性化語(yǔ)音識(shí)別”不僅可有效提升用戶(hù)個(gè)性化詞句的識(shí)別準(zhǔn)確率,同時(shí)全自動(dòng)詞庫(kù)學(xué)習(xí)這一特色極大保證了系統(tǒng)的處理及反饋速度,實(shí)現(xiàn)整個(gè)學(xué)習(xí)個(gè)性化特征的過(guò)程在“毫秒級(jí)別”就可以全部自動(dòng)完成。
通過(guò)DTSS(Deep Transformer-based Sequence to Sequence model)的端到端聲學(xué)模型、神經(jīng)網(wǎng)絡(luò)語(yǔ)言模型和智能標(biāo)點(diǎn)預(yù)測(cè)等技術(shù),搜狗輸入法引入前沿深度學(xué)習(xí)技術(shù),對(duì)語(yǔ)音識(shí)別進(jìn)行仿真模擬和訓(xùn)練,有效提高語(yǔ)音錄入在通用場(chǎng)景下的識(shí)別準(zhǔn)確性,精準(zhǔn)度已達(dá)到領(lǐng)先業(yè)內(nèi)。“個(gè)性化語(yǔ)音識(shí)別”可基于用戶(hù)數(shù)據(jù)分析,對(duì)用戶(hù)習(xí)慣使用的個(gè)性化詞組進(jìn)行掃描記錄,在語(yǔ)音輸入時(shí),優(yōu)先選擇用戶(hù)習(xí)慣用語(yǔ)進(jìn)行文本輸出。通過(guò)此項(xiàng)技術(shù)革新,在保障通用識(shí)別準(zhǔn)確性的前提下,使用戶(hù)常用語(yǔ)的字詞錯(cuò)誤率下降40%,攻克語(yǔ)音識(shí)別精準(zhǔn)化的技術(shù)難關(guān)。
掌控AI從個(gè)性化語(yǔ)音識(shí)別開(kāi)始
手和舌頭是人類(lèi)最靈活的兩個(gè)部分,從移動(dòng)智能設(shè)備發(fā)展以來(lái),各種觸控交互無(wú)不依賴(lài)于手的操作。而當(dāng)語(yǔ)音技術(shù)和人工智能同時(shí)走向成熟時(shí),或許就像《2019語(yǔ)音技術(shù)報(bào)告》中所描述的那樣:語(yǔ)音交互扭轉(zhuǎn)了以往人機(jī)交互的存在形態(tài),用戶(hù)與設(shè)備間基于語(yǔ)音交互的全新關(guān)系開(kāi)始搭建,與之前互聯(lián)網(wǎng)向移動(dòng)互聯(lián)網(wǎng)過(guò)渡一樣,其對(duì)底層平臺(tái)的全新需求也在醞釀當(dāng)中。
新時(shí)代即將來(lái)臨,為應(yīng)對(duì)人工智能、虛擬現(xiàn)實(shí)等技術(shù)的革新以及不同維度、多場(chǎng)景使用的需要,用戶(hù)輸入法的使用習(xí)慣逐漸向語(yǔ)音輸入轉(zhuǎn)移。同時(shí),與文本輸入相比,語(yǔ)音輸入注定成為最主要的人機(jī)互動(dòng)接口。優(yōu)化語(yǔ)音識(shí)別技術(shù),為用戶(hù)提供更自然、更便利、更高效的語(yǔ)音錄入服務(wù),是智慧輸入法的發(fā)展趨勢(shì)。
隨著語(yǔ)音識(shí)別技術(shù)的不斷成熟,以及用戶(hù)個(gè)性化詞庫(kù)的不斷豐富,搜狗將聚合用戶(hù)級(jí)語(yǔ)音個(gè)性化資源,實(shí)現(xiàn)“定制化語(yǔ)音輸入法”。使每個(gè)用戶(hù)基于“定制版”、“更懂自己”的搜狗語(yǔ)音識(shí)別的支持,在日常生活以及醫(yī)療、法律等專(zhuān)業(yè)領(lǐng)域,有效提高線(xiàn)上交流和人機(jī)溝通的效率及準(zhǔn)確度,或?qū)⒊蔀槿斯ぶ悄軙r(shí)代輸入端的全局掌控者。
申請(qǐng)創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!
2025年10月25日,2025世界青年科學(xué)家峰會(huì)之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國(guó)際院士科創(chuàng)中心主辦,中國(guó)投資協(xié)會(huì)能源投資專(zhuān)業(yè)委員會(huì)、溫港院士科創(chuàng)中心承辦,中國(guó)電工技術(shù)學(xué)會(huì)、中科先進(jìn)技術(shù)溫州研究院與溫州市電力工程學(xué)會(huì)提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,
個(gè)人創(chuàng)業(yè)需要啟動(dòng)成本低、無(wú)需龐大團(tuán)隊(duì)、可快速驗(yàn)證、能利用個(gè)人技能或資源。這里分享適合個(gè)人創(chuàng)業(yè)的十個(gè)機(jī)會(huì)一.AI內(nèi)容優(yōu)化與本地化服務(wù)·做什么:幫助企業(yè)或個(gè)人利用AI工具(如GPT-4,Midjourney)優(yōu)化內(nèi)容生產(chǎn)流程。例如,為跨境電商撰寫(xiě)多語(yǔ)言產(chǎn)品描述,為小紅書(shū)博主生成爆款文案,為小公司制作營(yíng)銷(xiāo)
百度AI團(tuán)隊(duì)今日正式推出PaddleOCR3.1版本,以突破性的多語(yǔ)言組合識(shí)別(MultilingualCompositionPerception,MCP)技術(shù)為核心,徹底重構(gòu)復(fù)雜文檔處理邊界。此次升級(jí)標(biāo)志著OCR領(lǐng)域首次實(shí)現(xiàn)對(duì)同一文檔內(nèi)任意混合語(yǔ)言文本的精準(zhǔn)識(shí)別,為全球化企業(yè)、跨境業(yè)務(wù)及多元文化場(chǎng)
導(dǎo)航網(wǎng)站的崛起:從信息過(guò)載到精準(zhǔn)觸達(dá)隨著全球AI工具數(shù)量爆發(fā)式增長(zhǎng)(2025年已超數(shù)萬(wàn)款),用戶(hù)面臨前所未有的選擇困境。傳統(tǒng)搜索引擎的“關(guān)鍵詞-鏈接”模式難以應(yīng)對(duì)工具篩選的場(chǎng)景需求,垂直化、場(chǎng)景化的AI導(dǎo)航網(wǎng)站應(yīng)運(yùn)而生。這類(lèi)平臺(tái)通過(guò)聚合、評(píng)測(cè)、分類(lèi)與推薦四重機(jī)制,將分散的工具資源整合為結(jié)構(gòu)化入口。例
當(dāng)微信公眾號(hào)文章中出現(xiàn)一個(gè)人的名字,它會(huì)自動(dòng)變成藍(lán)色鏈接,點(diǎn)擊即可查看AI生成的“個(gè)人簡(jiǎn)歷”——這一微信新功能讓不少用戶(hù)感到被“扒光”在互聯(lián)網(wǎng)上。近日,微信新上線(xiàn)的“AI搜索”功能陷入隱私泄露爭(zhēng)議漩渦。多位網(wǎng)友在社交平臺(tái)反映,當(dāng)微信公眾號(hào)推文中出現(xiàn)本人姓名時(shí),名字會(huì)自動(dòng)變?yōu)樗{(lán)色超鏈接,點(diǎn)擊即可瀏覽由
AI的“免費(fèi)紅利期”結(jié)束了,未來(lái)18個(gè)月,靠“API倒賣(mài)”的公司,會(huì)成片消失。這個(gè)導(dǎo)火索就是最近Google的一輪封號(hào)導(dǎo)致的,隨著封號(hào)風(fēng)波的結(jié)束,這也標(biāo)志著AI行業(yè)【收租時(shí)代】來(lái)了。2月封號(hào)潮:高付費(fèi)用戶(hù)被一鍋端一周前,Google開(kāi)始大規(guī)模封號(hào),付著250美金月費(fèi)的人,賬號(hào)說(shuō)沒(méi)就沒(méi),Gmail、Y
來(lái)自路透社等媒體報(bào)道的最新消息:DeepSeek未發(fā)布的V4Lite模型遭泄露上網(wǎng),華為獲得早期訪(fǎng)問(wèn)權(quán)限,英偉達(dá)被排除在外。近期,谷歌發(fā)表了2篇Multi-Agent協(xié)作學(xué)習(xí)新論文有網(wǎng)友提供了更加詳細(xì)的信息,DeepSeekV4Lite:100萬(wàn)token上下文窗口(V3為128K)內(nèi)置原生多模態(tài)推
春節(jié)紅包會(huì)結(jié)束,但AI已融入數(shù)億人生活里
性能、商業(yè)、生態(tài)詮釋開(kāi)源模型的最佳姿態(tài)
2026年剛開(kāi)年,全世界最狂的那個(gè)男人,穿著他的經(jīng)典黑皮衣,在CES舞臺(tái)上發(fā)出了未來(lái)十年的信號(hào)。他搞了個(gè)“能吃飽套餐”:6個(gè)包子+一碟小菜+一碗粥=肉包子套餐,這樣以后你只要買(mǎi)一個(gè)套餐就能吃飽了。(Rubin平臺(tái))同時(shí)他們店里還免費(fèi)提供的筷子、勺子、蘸料、醬油、醋、水果、零食等等。(開(kāi)放10萬(wàn)億語(yǔ)言
12月12日-14日,2025全球開(kāi)發(fā)者先鋒大會(huì)暨國(guó)際具身智能技能大賽(GDPS2025)于上海張江科學(xué)會(huì)堂舉行,大會(huì)以具身智能競(jìng)技為核心,融合了技術(shù)比拼、產(chǎn)業(yè)展示與科普體驗(yàn),為全球觀(guān)眾呈現(xiàn)出具身智能的現(xiàn)在與未來(lái)。上海開(kāi)普勒機(jī)器人有限公司(以下簡(jiǎn)稱(chēng)"開(kāi)普勒機(jī)器人")攜明星產(chǎn)品K2"大黃蜂"亮相,并參
在數(shù)字化與智能化深度交織的時(shí)代浪潮中,安全的邊界不斷延展,技術(shù)的演進(jìn)正引領(lǐng)產(chǎn)業(yè)邁向新一輪變革。10月24日,以“弈動(dòng)Dynamic·數(shù)智躍遷博弈無(wú)界”為主題的2025TechWorld智慧安全大會(huì)在北京盛大召開(kāi)。來(lái)自國(guó)家部委、院士學(xué)者、高??蒲袡C(jī)構(gòu)和企業(yè)的權(quán)威專(zhuān)家與業(yè)界精英齊聚北京,共議AI安全、數(shù)
2025年10月25日,2025世界青年科學(xué)家峰會(huì)之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國(guó)際院士科創(chuàng)中心主辦,中國(guó)投資協(xié)會(huì)能源投資專(zhuān)業(yè)委員會(huì)、溫港院士科創(chuàng)中心承辦,中國(guó)電工技術(shù)學(xué)會(huì)、中科先進(jìn)技術(shù)溫州研究院與溫州市電力工程學(xué)會(huì)提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,
我覺(jué)得我們AI的目標(biāo)是:從芯片設(shè)計(jì)到軟件生態(tài),全鏈路自主開(kāi)發(fā),建立可控的世界級(jí)AI體系。所以這是俺對(duì)未來(lái)5年中國(guó)AI圈的展望和判斷。(1)2026年,英偉達(dá)造車(chē)、國(guó)產(chǎn)開(kāi)車(chē)26年國(guó)產(chǎn)芯片會(huì)在推理和垂直場(chǎng)景上發(fā)力。以DeepSeek為代表,大多數(shù)AI大模型會(huì)以軟件彌補(bǔ)硬件不足,所以訓(xùn)練和推理分開(kāi),訓(xùn)練就