專業機構發布《2019年語音技術》報告稱,語音將成為未來十年決定性主題之一,與人工智能一起從根本上改變人與機器的關系。近日,搜狗輸入法在語音輸入領域率先推出“個性化語音識別”功能,突破語音識別技術瓶頸,大幅優化個人詞匯錄入的直接準確性,在語音輸入領域實現“更懂用戶”。
搜狗“個性化語音識別”打造用戶專屬輸入法
在日常交流中,個人口頭禪、慣用語經常會干擾雙方的信息傳達,這一問題在人機語音交互中尤為凸顯。在語音輸入時,往往用戶只是想錄入一個名稱,輸入結果卻顯示的是音同意不同的另一項結果。比如,當用戶希望輸入法顯示人名“憑遠”時,通用的語音識別往往將大眾常用的“平原、品源”列在前列的候選詞匯,用戶的個性化內容并不在其中。除此之外,用戶習慣使用的個人詞匯,以及一些多音字、讀音差錯也會對語音識別結果造成影響。
基于以上原因,搜狗語音率先對語音識別技術進行了革新優化,推出“個性化語音識別”服務。經過本輪更新,用戶只需在搜狗輸入法App選擇一鍵登錄個人賬戶,即可體驗此項服務。成功開啟后,“個性化語音識別”會通過強化學習用戶習慣使用的個人詞匯,為每個用戶建立定制化語音輸入法。此后,在用戶需要進行語音輸入時,輸入法會根據語言環境,結合上下段落語句進行分析,快速輸出符合用戶心意的文本內容,有效減少用戶手動進行二次更改的頻率。
搜狗語音又誕生“黑科技”語音識別更精準
搜狗“個性化語音識別”不僅可有效提升用戶個性化詞句的識別準確率,同時全自動詞庫學習這一特色極大保證了系統的處理及反饋速度,實現整個學習個性化特征的過程在“毫秒級別”就可以全部自動完成。
通過DTSS(Deep Transformer-based Sequence to Sequence model)的端到端聲學模型、神經網絡語言模型和智能標點預測等技術,搜狗輸入法引入前沿深度學習技術,對語音識別進行仿真模擬和訓練,有效提高語音錄入在通用場景下的識別準確性,精準度已達到領先業內。“個性化語音識別”可基于用戶數據分析,對用戶習慣使用的個性化詞組進行掃描記錄,在語音輸入時,優先選擇用戶習慣用語進行文本輸出。通過此項技術革新,在保障通用識別準確性的前提下,使用戶常用語的字詞錯誤率下降40%,攻克語音識別精準化的技術難關。
掌控AI從個性化語音識別開始
手和舌頭是人類最靈活的兩個部分,從移動智能設備發展以來,各種觸控交互無不依賴于手的操作。而當語音技術和人工智能同時走向成熟時,或許就像《2019語音技術報告》中所描述的那樣:語音交互扭轉了以往人機交互的存在形態,用戶與設備間基于語音交互的全新關系開始搭建,與之前互聯網向移動互聯網過渡一樣,其對底層平臺的全新需求也在醞釀當中。
新時代即將來臨,為應對人工智能、虛擬現實等技術的革新以及不同維度、多場景使用的需要,用戶輸入法的使用習慣逐漸向語音輸入轉移。同時,與文本輸入相比,語音輸入注定成為最主要的人機互動接口。優化語音識別技術,為用戶提供更自然、更便利、更高效的語音錄入服務,是智慧輸入法的發展趨勢。
隨著語音識別技術的不斷成熟,以及用戶個性化詞庫的不斷豐富,搜狗將聚合用戶級語音個性化資源,實現“定制化語音輸入法”。使每個用戶基于“定制版”、“更懂自己”的搜狗語音識別的支持,在日常生活以及醫療、法律等專業領域,有效提高線上交流和人機溝通的效率及準確度,或將成為人工智能時代輸入端的全局掌控者。
申請創業報道,分享創業好點子。點擊此處,共同探討創業新機遇!
2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據悉,在昇騰AI大模型的創新研發中,華為聯手26家行業領軍企業,組建了一支協同創新的“AI明星隊”,云天勵飛作為中國人工智能企業的杰出代表,和互聯網大廠、運營商、科研院所等優秀團隊
這幾個月來,以ChatGPT為代表的生成式AI展現出的能力令世界驚嘆。自從2016年AlphaGo戰勝李世石掀起了一波AI浪潮后,AI仿佛已經沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓練模型來實現圖像識別、聲音識別、語言處理等特
文:互聯網江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發者大會上,發布了企業級戰略PaaS2.0,希望通過一個平臺+四大開發服務,建立起IoT生態。對于這場發布會,市場的態度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩定
2020年底,王慧文在朋友圈寫下這句話時,外界本以為這位伴隨中國互聯網發展而持續創業20年的人物即將告別創業舞臺。但是,一個曾經多次創業,正值壯年的互聯網老將心中的創業熱情是難以熄滅的。
Manus撕開一道真相
文/八真來源/節點財經具身智能賽道,誰最有可能拔得A股資本市場的頭籌?答案大概率是誕生剛剛兩年,由華為"天才少年"、B站百萬粉絲科技UP主稚暉君(彭志輝)創立的智元機器人。近期,從事新材料研發與生產的上緯新材(688585.SH)丟出重磅炸彈,宣布智元機器人及相關主體將通過收購其至少63.62%的股
文/道哥大舉裁員、清空賬號、國內IP無法訪問——曾被譽為“中國AIAgent希望之星”的Manus,在估值飆至5億美元的高光時刻“閃離”中國市場。近日,Manus“裁員、出走”的消息在媒體端大量發酵。消息稱,Manus公司總部將由中國遷至新加坡,其國內團隊也將大幅裁撤——原有120人規模團隊除40余
四個月前邀請碼炒至10萬元,如今官網變灰、社交賬號清空,這家AI新貴的閃電遷移折射中國科技企業出海潮涌。7月11日,打開Manus官網的用戶發現一則突兀提示:“Manus在你所在的地區不可用”。而就在不久前,這個位置還顯示著“Manus中文版本正在開發中”的樂觀聲明。同時,Manus官方微博和小紅書
文/十界來源/節點財經一場圍繞算力自主的競賽,正在科創板上演。近日,國產全功能GPU廠商摩爾線程遞交科創板招股書,擬募資約80億人民幣,成為今年上半年科創板擬募資規模最大的沖刺者,也打響了“國產英偉達”上市的第一槍。據招股書顯示,摩爾線程自2020年成立以來,主營全功能GPU芯片的研發與銷售,以自主
“AI大模型六小虎”百川智能危機重重。這是前搜狗CEO王小川創辦的AI公司。昨天就爆出新聞,百川智能的聯合創始人離職,這是王小川入局AI的第一道大坎。接下的成敗非常關鍵:(1)拿下河北(2)學習科大訊飛百川智能離職高端概覽:(1)2025年7月10日,百川智能技術聯合創始人謝劍將離職。他是百川只能的
百度AI團隊今日正式推出PaddleOCR3.1版本,以突破性的多語言組合識別(MultilingualCompositionPerception,MCP)技術為核心,徹底重構復雜文檔處理邊界。此次升級標志著OCR領域首次實現對同一文檔內任意混合語言文本的精準識別,為全球化企業、跨境業務及多元文化場
“宇樹已形成硬件、算法、場景聯動的業務飛輪,自研率超95%的技術壁壘讓其成為全球機器人賽道不可忽視的中國力量?!笔壮藤Y本管理合伙人朱方文在追加投資時如是評價。7月7日,據每日經濟新聞從宇樹科技投資方處獲悉,國內人形機器人領軍企業宇樹科技(UnitreeRobotics)已明確計劃于科創板IPO,預計
推理與多模態的終極融合,將徹底終結用戶在不同模型間切換的煩惱。7月7日,OpenAI正式確認將在今年夏季推出新一代人工智能模型GPT-5。這一突破性產品將整合現有的多個強大模型,特別是融合專注推理能力的“O系列”與具備多模態功能的“GPT系列”,為用戶提供前所未有的統一體驗。OpenAI開發者體驗負