1. 創(chuàng)業(yè)頭條
  2. 前沿領域
  3. AI智能
  4. 正文

搜狗擊敗訊飛阿里,獲IWSLT國際口語機器翻譯評測大賽冠軍

 2018-10-31 10:40  來源:互聯(lián)網  我來投稿 撤稿糾錯

  阿里云優(yōu)惠券 先領券再下單

近日,在剛剛落幕的IWSLT(International Workshop on Spoken Language Translation)國際頂級口語機器翻譯評測大賽上,搜狗擊敗訊飛、阿里巴巴, APPTEK(美國應用科技公司)、AFRL(美國空軍研究實驗室)以及KIT(德國卡爾斯魯厄理工學院)等國際國內多個強勁對手,一舉奪得了2018年IWSLT大賽Baseline Model(基線模型)賽道冠軍,代表中國向世界彰顯了AI領域的技術硬實力!

表1 IWSLT大賽Baseline Model賽道最終結果

--取自IWSLT官方公布結:https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

這是搜狗繼WMT 2017機器翻譯頂級評測大賽奪冠之后,所摘得的又一翻譯領域的技術桂冠。短期內連續(xù)登頂世界第一的位置,充分證明了搜狗在翻譯行業(yè)特別是口語翻譯領域已位居領先地位。

IWSLT是什么比賽?

IWSLT是國際最具影響力的口語機器翻譯評測比賽,從2004年開始已經舉辦了15屆。每屆比賽都吸引了世界各地機器翻譯領域的知名企業(yè)和研究機構參與,本屆比賽吸引了訊飛、阿里巴巴等國內公司,愛爾蘭ADAPT中心,美國約翰霍普金斯大學,德國卡爾斯魯厄理工學院,芬蘭赫爾辛基大學,英國愛丁堡大學,美國AppTek公司等多家國際知名大學、研究機構和公司參加。

表2 IWSLT2018大賽參賽情況

--取自IWSLT官方公布結果:

:https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

本屆IWSLT 2018的口語機器翻譯任務主要評測基于指定數據集從英語到德語的語音翻譯能力,共分為Baseline Model(基線模型賽道)和End-to-End(端到端賽道)兩個賽道,其中Baseline Model賽道主要評測語音翻譯的流水線方案,輸入語音先通過語音識別系統(tǒng)得到語音識別結果,之后將結果送入機器翻譯系統(tǒng)獲得譯文,這也是業(yè)內最主流、效果最好的語音翻譯解決方案,市場上商用機器同傳、翻譯機等語音翻譯類產品幾乎都采用了類似的方法;End-to-End則是本次評測新增設的賽道,主要鼓勵參賽方探索基于神經網絡的端到端語音翻譯解決方案,希望能夠輸入語音,基于深度神經網絡模型直接輸出譯文,這種方法目前仍處于早期研究階段,受制于語音-文本平行語料難以大規(guī)模采集、算法研究不成熟等因素的限制,距離商用仍存在較大距離。本次評測中,在訓練集、測試集相同的情況下,Baseline Model賽道最好的系統(tǒng)取得了28.09的BLEU(機器翻譯質量評價指標,值越大代表翻譯質量越好),而End-to-End賽道最好的系統(tǒng)僅取得了19.4的BLEU,較Baseline Model賽道相差8.69個BLEU,差距非常明顯,也證明了Baseline Model賽道評測的算法仍是目前最可行和實用的解決方案。

搜狗本次參加的是Baseline Model賽道的評測,并取得了第一名的好成績。評測任務面向TED演講和大會學術報告場景,測試集包括來自英國、歐洲、印度等各個國家的英語演講者,存在噪聲、口音、自由表達等復雜語音現象,同時語言中存在大量領域專有名詞和口語化的表達(如:大量語氣詞、錯誤語法表達等),具有極強的實戰(zhàn)意義和挑戰(zhàn)性。最終,搜狗提交的系統(tǒng)BLEU值達到28.09,領先排名第二的科大訊飛1.6個BLEU,證明了搜狗在口語機器翻譯領域強大的實力。

AI賽道中持續(xù)發(fā)力,搜狗領跑語音翻譯行業(yè)

搜狗的AI戰(zhàn)略藍圖之中,語言是最核心的重頭戲。一直以來,搜狗都堅持著“自然交互+知識計算”的人工智能核心方向,并持續(xù)深耕技術,推動技術向產品的快速轉化,2016年,搜狗發(fā)布了自有人機交互解決方案-知音引擎。擁有充足真實語料數據優(yōu)勢的搜狗,將語音識別與機器翻譯技術相結合,并在2016年推出了全球首款商用AI同傳系統(tǒng)-搜狗同傳,引領了語音翻譯技術的普及與應用。通過數百場的國際會議“實戰(zhàn)”,搜狗同傳獲得了無數媒體和觀眾的好評,成為當下炙手可熱的“AI字幕君”。

與此同時,搜狗也推出了一系列的智能硬件,將語音翻譯技術應用到了更廣闊的場景之中,幫助用戶打破了跨國交流時的語言困境。2018年3月,搜狗推出了搜狗旅行翻譯寶,具備離線翻譯功能與拍照翻譯功能,讓馬化騰都為之心動,在朋友圈里大打廣告。作為首款智能翻譯硬件,它支持42種語言對話翻譯,解決了旅游場景中用戶聽不懂、看不懂、不會說等真實痛點。該項產品在京東平臺首發(fā)當日即告售罄,首日銷售額破千萬。與此同時,搜狗還推出了錄音翻譯筆,提供錄音轉寫、對話翻譯、同聲傳譯等功能,把AI同傳落地到了消費級產品之中,開拓了語音翻譯的新航道。

眾所周知,人工智能是未來科技的風向標。通過這次在IWSLT比賽中的優(yōu)秀成績,可以看到以搜狗為代表的國產科技巨頭企業(yè),已表現出了引領行業(yè)的技術硬實力。

申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!

相關標簽
搜狗翻譯
ai技術

相關文章

  • 甌江論道:AI賦能綠色發(fā)展

    2025年10月25日,2025世界青年科學家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術學會、中科先進技術溫州研究院與溫州市電力工程學會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,

    標簽:
    ai技術
  • 王通:未來個人創(chuàng)業(yè)的十個機會

    個人創(chuàng)業(yè)需要啟動成本低、無需龐大團隊、可快速驗證、能利用個人技能或資源。這里分享適合個人創(chuàng)業(yè)的十個機會一.AI內容優(yōu)化與本地化服務·做什么:幫助企業(yè)或個人利用AI工具(如GPT-4,Midjourney)優(yōu)化內容生產流程。例如,為跨境電商撰寫多語言產品描述,為小紅書博主生成爆款文案,為小公司制作營銷

  • 百度智能云PaddleOCR 3.1正式發(fā)布:關鍵能力支持MCP

    百度AI團隊今日正式推出PaddleOCR3.1版本,以突破性的多語言組合識別(MultilingualCompositionPerception,MCP)技術為核心,徹底重構復雜文檔處理邊界。此次升級標志著OCR領域首次實現對同一文檔內任意混合語言文本的精準識別,為全球化企業(yè)、跨境業(yè)務及多元文化場

    標簽:
    ai智能
    ai技術
  • AI工具導航網站,未來的發(fā)展前景怎么樣?

    導航網站的崛起:從信息過載到精準觸達隨著全球AI工具數量爆發(fā)式增長(2025年已超數萬款),用戶面臨前所未有的選擇困境。傳統(tǒng)搜索引擎的“關鍵詞-鏈接”模式難以應對工具篩選的場景需求,垂直化、場景化的AI導航網站應運而生。這類平臺通過聚合、評測、分類與推薦四重機制,將分散的工具資源整合為結構化入口。例

  • 微信AI搜索被指“強行開盒”:名字成了數據入口,騰訊回應“僅用公開信息”

    當微信公眾號文章中出現一個人的名字,它會自動變成藍色鏈接,點擊即可查看AI生成的“個人簡歷”——這一微信新功能讓不少用戶感到被“扒光”在互聯(lián)網上。近日,微信新上線的“AI搜索”功能陷入隱私泄露爭議漩渦。多位網友在社交平臺反映,當微信公眾號推文中出現本人姓名時,名字會自動變?yōu)樗{色超鏈接,點擊即可瀏覽由

    標簽:
    ai技術
    ai搜索
  • 弈動 Dynamic·數智躍遷 博弈無界|2025TechWorld智慧安全大會在京召開

    在數字化與智能化深度交織的時代浪潮中,安全的邊界不斷延展,技術的演進正引領產業(yè)邁向新一輪變革。10月24日,以“弈動Dynamic·數智躍遷博弈無界”為主題的2025TechWorld智慧安全大會在北京盛大召開。來自國家部委、院士學者、高??蒲袡C構和企業(yè)的權威專家與業(yè)界精英齊聚北京,共議AI安全、數

    標簽:
    弈動
  • 甌江論道:AI賦能綠色發(fā)展

    2025年10月25日,2025世界青年科學家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術學會、中科先進技術溫州研究院與溫州市電力工程學會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,

    標簽:
    ai技術
  • AI云“分野”:阿里云們“賣鏟”,火山引擎奇襲“MaaS”

    AI云“分野”:阿里云們“賣鏟”,火山引擎奇襲“MaaS”

    標簽:
    阿里巴巴
  • 未來5年,中國AI的“大洗牌”和“內循環(huán)”

    我覺得我們AI的目標是:從芯片設計到軟件生態(tài),全鏈路自主開發(fā),建立可控的世界級AI體系。所以這是俺對未來5年中國AI圈的展望和判斷。(1)2026年,英偉達造車、國產開車26年國產芯片會在推理和垂直場景上發(fā)力。以DeepSeek為代表,大多數AI大模型會以軟件彌補硬件不足,所以訓練和推理分開,訓練就

  • H20芯片開賣即叫停,英偉達如何解圍?

    文/道哥在深陷“后門”風波、接受網信辦問詢之后,英偉達的“特供版”H20芯片,又有了新消息。近日,美國科技媒體《TheInformation》援引知情人士消息稱,英偉達已悄然向其關鍵供應商——包括負責封裝的安靠科技、供應高帶寬內存的三星電子、以及承擔后端處理的富士康發(fā)出指令,要求暫停所有與H20AI

    標簽:
    英偉達
  • 真正的「國產英偉達」來了

    文/二風來源/節(jié)點財經一場關于“中國芯”的IPO審議,正把投資者們的目光鎖定在上交所。根據上交所發(fā)布的公告,上市審核委員會已定于9月26日審議摩爾線程的科創(chuàng)板首發(fā)申請。作為中國半導體自主化浪潮中最受矚目的“考生”之一,包括其創(chuàng)始人顯赫的英偉達背景、高達80億元人民幣的募資雄心,以及在國產GPU領域取

    標簽:
    英偉達