2019年數(shù)字生態(tài)大會(huì)于5月21日—23日在昆明舉行,在AI分論壇上,騰訊優(yōu)圖實(shí)驗(yàn)室聯(lián)合負(fù)責(zé)人、杰出科學(xué)家賈佳亞分享了優(yōu)圖近期在AI手語識(shí)別上取得的突破——推出基于自研算法的“優(yōu)圖AI手語翻譯機(jī)”。
據(jù)賈佳亞介紹,AI手語翻譯機(jī)以普通攝像頭作為手語采集裝置,依托高性能計(jì)算機(jī)進(jìn)行后臺(tái)運(yùn)算,用戶只要正對(duì)攝像頭完成手語表達(dá),翻譯機(jī)就能快速運(yùn)算出結(jié)果并把手語翻譯成為文字。未來有望在機(jī)場(chǎng)、民政窗口等公共場(chǎng)所部署和落地,助力信息無障礙城市建設(shè)。
(騰訊優(yōu)圖實(shí)驗(yàn)室聯(lián)合負(fù)責(zé)人、騰訊杰出科學(xué)家 賈佳亞)
AI手語翻譯機(jī):自研算法,實(shí)現(xiàn)手語識(shí)別“黑科技”
手語識(shí)別(SLR),就是指通過計(jì)算機(jī)算法,自動(dòng)區(qū)分手語表達(dá)中的各類手勢(shì)、動(dòng)作以及這些手勢(shì)和動(dòng)作之間的切換,最后將表達(dá)的手語翻譯成文字。不過相比于其他AI視覺識(shí)別技術(shù)的研究,手語識(shí)別的研發(fā)卻存在更大的困難和挑戰(zhàn)。手語表達(dá)所特有的地域性、復(fù)雜性和多樣性極大地增加了數(shù)據(jù)采集與清洗的難度和成本,而受限于數(shù)據(jù)量的大小和人工設(shè)計(jì)特征的缺陷,很多傳統(tǒng)研究的研究方法在適應(yīng)性、泛化性及魯棒性上都十分有限。

(優(yōu)圖AI手語翻譯機(jī)界面)
據(jù)賈佳亞介紹,此次騰訊優(yōu)圖推出的AI手語翻譯機(jī),結(jié)合聽障人士手語表達(dá)的習(xí)慣采集手語數(shù)據(jù),參考先進(jìn)的手勢(shì)識(shí)別、動(dòng)作識(shí)別和序列翻譯等技術(shù),通過自研算法實(shí)現(xiàn)了對(duì)復(fù)雜手語表達(dá)的識(shí)別技術(shù)突破。相較于其他方法,優(yōu)圖AI手語翻譯機(jī)的數(shù)據(jù)集覆蓋了近千句日常表達(dá),900個(gè)常用詞匯,同時(shí)對(duì)數(shù)據(jù)進(jìn)行進(jìn)一步的分析和歸納,擁有目前最大的中文手語識(shí)別數(shù)據(jù)集,并支持整句手語表達(dá)的識(shí)別,可直接判斷用戶是否結(jié)束并完成實(shí)時(shí)翻譯。
應(yīng)用探索:視覺AI,助力信息無障礙建設(shè)
據(jù)北京聽力協(xié)會(huì)2017年公開數(shù)據(jù),估計(jì)中國殘疾性聽力障礙人士已達(dá)7200萬,相當(dāng)于北京市常住人口(約2200萬,2015年數(shù)據(jù))的3倍多。盡管我國在信息無障礙領(lǐng)域的投入逐漸增加,但目前國內(nèi)的聽障人群需求依然得不到滿足。優(yōu)圖AI手語翻譯機(jī)的推出將一定程度地緩解聽障人士的交流障礙。
在演講中,賈佳亞表示,“未來,我們希望通過與聾啞人士或手語使用者的深入接觸,嘗試在公共事物場(chǎng)所為聽障者提供更好的服務(wù),更好地助力信息無障礙的建設(shè)。”下一步,優(yōu)圖實(shí)驗(yàn)室將對(duì)AI手語翻譯機(jī)展開優(yōu)化和升級(jí),嘗試在日常服務(wù)窗口、手語教育等場(chǎng)景中落地,為聽障人士帶來實(shí)實(shí)在在的便利。
目前,優(yōu)圖實(shí)驗(yàn)室已經(jīng)和深圳市信息無障礙研究會(huì)成立AI手語識(shí)別聯(lián)合項(xiàng)目組,就手語數(shù)據(jù)采集、產(chǎn)品算法優(yōu)化等方面展開長(zhǎng)期深度合作,并通過與聽障者或手語使用者進(jìn)一步接觸,擴(kuò)充數(shù)據(jù)容量,完善數(shù)據(jù)規(guī)范,致力于推動(dòng)后續(xù)的產(chǎn)品和服務(wù)部署,推動(dòng)信息無障礙建設(shè)。
(優(yōu)圖和深圳信息無障礙研究會(huì)AI聽障無障礙聯(lián)合項(xiàng)目組)
此次的數(shù)字生態(tài)大會(huì)展示的優(yōu)圖AI手語翻譯機(jī),并不是騰訊在信息無障礙建設(shè)上的首次嘗試。早在2009年騰訊便開始了信息無障礙方面的探索,截至目前,旗下QQ、QQ空間、微信、騰訊網(wǎng)、騰訊新聞、應(yīng)用寶、企鵝FM等大部分產(chǎn)品已針對(duì)障礙用戶實(shí)現(xiàn)專門優(yōu)化,致力于為障礙人士構(gòu)建信息友好社會(huì)。2013年,騰訊優(yōu)圖團(tuán)隊(duì)和手機(jī)QQ一起打磨了OCR引擎技術(shù),基于計(jì)算機(jī)視覺算法及自然語言處理能力,可將圖片上的文字直接轉(zhuǎn)換為可編輯的結(jié)構(gòu)化文本,幫助視障群體實(shí)現(xiàn)信息溝通無障礙化。
與本次亮相數(shù)字生態(tài)大會(huì)AI分論壇的跨年齡人臉識(shí)別技術(shù)一樣,優(yōu)圖AI手語翻譯機(jī)同樣是騰訊踐行“科技向善”的重要體現(xiàn)。而優(yōu)圖實(shí)驗(yàn)室也將繼續(xù)秉承“科技向善”這一理念,推動(dòng)前沿技術(shù)在社會(huì)場(chǎng)景中的應(yīng)用,切實(shí)讓更多的實(shí)際問題得以解決。做有溫度的AI,讓科技產(chǎn)生更大的社會(huì)價(jià)值。
申請(qǐng)創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!
2023年7月6日,第六屆世界人工智能大會(huì)(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會(huì)的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領(lǐng)軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊(duì)”,云天勵(lì)飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運(yùn)營(yíng)商、科研院所等優(yōu)秀團(tuán)隊(duì)
這幾個(gè)月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個(gè)名詞重回C位。過去在AI1.0時(shí)代,主要通過訓(xùn)練模型來實(shí)現(xiàn)圖像識(shí)別、聲音識(shí)別、語言處理等特
文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個(gè)新故事。6月29日,涂鴉智能在開發(fā)者大會(huì)上,發(fā)布了企業(yè)級(jí)戰(zhàn)略PaaS2.0,希望通過一個(gè)平臺(tái)+四大開發(fā)服務(wù),建立起IoT生態(tài)。對(duì)于這場(chǎng)發(fā)布會(huì),市場(chǎng)的態(tài)度是積極的。美東時(shí)間6月29日收盤,涂鴉智能美股股價(jià)上漲5.6%,來到1.87美元/股。近日股價(jià)穩(wěn)定
美團(tuán)曾經(jīng)的二號(hào)人物王慧文對(duì)標(biāo)OpenAI的創(chuàng)業(yè)項(xiàng)目光年之外,以20億賣給美團(tuán),再度引發(fā)市場(chǎng)對(duì)大模型的熱議。
2020年底,王慧文在朋友圈寫下這句話時(shí),外界本以為這位伴隨中國互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺(tái)。但是,一個(gè)曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。
我覺得我們AI的目標(biāo)是:從芯片設(shè)計(jì)到軟件生態(tài),全鏈路自主開發(fā),建立可控的世界級(jí)AI體系。所以這是俺對(duì)未來5年中國AI圈的展望和判斷。(1)2026年,英偉達(dá)造車、國產(chǎn)開車26年國產(chǎn)芯片會(huì)在推理和垂直場(chǎng)景上發(fā)力。以DeepSeek為代表,大多數(shù)AI大模型會(huì)以軟件彌補(bǔ)硬件不足,所以訓(xùn)練和推理分開,訓(xùn)練就
文/道哥在深陷“后門”風(fēng)波、接受網(wǎng)信辦問詢之后,英偉達(dá)的“特供版”H20芯片,又有了新消息。近日,美國科技媒體《TheInformation》援引知情人士消息稱,英偉達(dá)已悄然向其關(guān)鍵供應(yīng)商——包括負(fù)責(zé)封裝的安靠科技、供應(yīng)高帶寬內(nèi)存的三星電子、以及承擔(dān)后端處理的富士康發(fā)出指令,要求暫停所有與H20AI
文/二風(fēng)來源/節(jié)點(diǎn)財(cái)經(jīng)一場(chǎng)關(guān)于“中國芯”的IPO審議,正把投資者們的目光鎖定在上交所。根據(jù)上交所發(fā)布的公告,上市審核委員會(huì)已定于9月26日審議摩爾線程的科創(chuàng)板首發(fā)申請(qǐng)。作為中國半導(dǎo)體自主化浪潮中最受矚目的“考生”之一,包括其創(chuàng)始人顯赫的英偉達(dá)背景、高達(dá)80億元人民幣的募資雄心,以及在國產(chǎn)GPU領(lǐng)域取
技術(shù)的進(jìn)步永無止境,繼創(chuàng)下TPC-C性能&性價(jià)比雙冠之后,阿里云PolarDB云原生數(shù)據(jù)庫再度實(shí)現(xiàn)關(guān)鍵突破。9月24日杭州云棲大會(huì)上,阿里云宣布推出全球首款基于CXL(ComputeExpressLink)2.0Switch技術(shù)的PolarDB數(shù)據(jù)庫專用服務(wù)器。在原有RDMA網(wǎng)絡(luò)的基礎(chǔ)上,Polar
2025年9月24日,在杭州舉辦的云棲大會(huì)上,阿里云正式發(fā)布全新一代服務(wù)器操作系統(tǒng)AlibabaCloudLinux4(簡(jiǎn)稱Alinux4)。Alinux4基于Linux6.6內(nèi)核打造,是首個(gè)全面遵循龍蜥社區(qū)“開源生態(tài)合作倡議”規(guī)范的商業(yè)發(fā)行版。它不僅兼容主流開源社區(qū)生態(tài),更針對(duì)阿里云最新9代ECS
9月24日,杭州云棲大會(huì)技術(shù)主論壇上,阿里云重磅發(fā)布AI安全護(hù)欄,提供五項(xiàng)核心安全能力,護(hù)航AI安全。一方面為客戶提供融入AIAgent開發(fā)全鏈路的原生安全防護(hù),另一方面持續(xù)用AI賦能安全產(chǎn)品智能化升級(jí),打造Agentic-SOC安全運(yùn)營(yíng),提升安全威脅檢測(cè)和響應(yīng)效率。在過去的一年,AIAgent正在
9月24日,魔搭社區(qū)舉辦了“全球協(xié)作?科學(xué)突破?創(chuàng)意無限”的專題論壇,并發(fā)布魔搭社區(qū)國際版、科學(xué)智能專區(qū)與AIGC創(chuàng)作引擎FlowBench,旨在連接全球開發(fā)者、加速科研范式創(chuàng)新、賦能創(chuàng)意表達(dá)。自2022年11月初成立至今,魔搭社區(qū)已成長(zhǎng)為中國最大AI開源社區(qū),其模型數(shù)量已突破10萬,服務(wù)了全球20
9月24日,2025云棲大會(huì)現(xiàn)場(chǎng),阿里云CTO周靖人接連發(fā)布了七款大模型技術(shù)產(chǎn)品。七款技術(shù)產(chǎn)品覆蓋語言、語音、視覺、多模態(tài)、代碼等模型領(lǐng)域,在模型智能水平、Agent工具調(diào)用以及Coding能力、深度推理、多模態(tài)等方面均實(shí)現(xiàn)突破。在大語言模型中,阿里通義旗艦?zāi)P蚎wen3-Max全新亮相,性能超過G
9月24日,阿里云在云棲大會(huì)上宣布新一輪全球基礎(chǔ)設(shè)施擴(kuò)建計(jì)劃:將在巴西、法國和荷蘭首次設(shè)立云計(jì)算地域節(jié)點(diǎn)(region),并將擴(kuò)建墨西哥、日本、韓國、馬來西亞和迪拜的數(shù)據(jù)中心,以便更好服務(wù)全球客戶日益增長(zhǎng)的AI和云計(jì)算需求。目前,阿里云在全球29個(gè)地區(qū)運(yùn)營(yíng)91個(gè)可用區(qū),是中國最大、亞太第一的云服務(wù)商