欧美三级一区 I 亚洲一本大道av久在线播放 I 神马影院一区二区 I 欧美日韩亚洲国产综合 I 午夜日韩福利 I 久久久久免费精品国产 I 小小拗女性bbwxxxx国产 I 精品日韩一区 I 天天射天天搞 I 久久精品极品盛宴观看 I 日韩欧美高清一区二区 I 国产日韩欧美网站 I 欧美在线天堂 I 久草91视频 I 99精品久久久久久久婷婷 I 天天网综合 I 黄色av播放 I 福利片一区二区 I 国产一区二区不卡老阿姨 I 91九色蝌蚪在线观看 I 亚洲 国产 日韩在线 精品 I 久久国内精品自在自线图片 I 华人在线视频 I 日韩城人免费 I 色小妹影院 I 久久亚洲人成综合网 I 久操中文在线 I 午夜精品三级久久久有码 I 天堂无码人妻精品av一区 I 久久亚洲精中文字幕冲田杏梨 I 精品少妇无码一区二区三批 I 女生裸体视频一区二区三区 I 91久久精品www人人做人人爽 I 欧洲做爰大片 I 一区二区三区中文字幕精品精品

首頁 > 汽車生活 > 汽車生活 > 在世界頂級計算機視覺大會上,聯(lián)想拿下6項冠軍!

在世界頂級計算機視覺大會上,聯(lián)想拿下6項冠軍!

發(fā)布時間:2024-07-01 22:23:27

計算機視覺是人工智能重要的技術(shù)領(lǐng)域之一。每年,國內(nèi)外都會舉辦眾多的計算機視覺學術(shù)或者行業(yè)大會,其中,計算機視覺與模式識別國際會議(IEEE CVPR)、國際計算機視覺大會(ICCV)以及歐洲計算機視覺國際會議(ECCV)是最為知名的三大頂會。

在全球?qū)<覍W者交流研討的同時,這些頂會還會舉辦系列挑戰(zhàn)賽,全球眾多頂尖團隊積極報名參賽,在計算機視覺的各個細分領(lǐng)域同臺“論劍”,一爭高下。

6月下旬舉辦的CVPR大會也不例外。在本次大會組織的各項計算機視覺挑戰(zhàn)賽中,聯(lián)想研究院團隊共斬獲6項冠軍,包括:

  • 第一人稱視角與外界視角融合的4D視覺挑戰(zhàn)賽(Ego4D and EgoExo4D Challenge)社交互動(Looking At Me)賽道冠軍;
  • 第一人稱視角與外界視角融合的4D視覺挑戰(zhàn)賽(Ego4D and EgoExo4D Challenge)手部姿態(tài)估計(Hand Pose)賽道冠軍;
  • 自動駕駛ARGOVERSE挑戰(zhàn)賽3D物體檢測(3D Object Detection Challenge)賽道冠軍;
  • 自動駕駛ARGOVERSE挑戰(zhàn)賽3D多目標跟蹤(3D Multi-Object Tracking Challenge)賽道冠軍;
  • 自主系統(tǒng)挑戰(zhàn)賽(Autonomous Grand Challenge, AGC)具身多模態(tài)三維視覺定位(Multi-View 3D Visual Grounding)賽道冠軍,并拿下最具創(chuàng)新獎;
  • 人工智能城市挑戰(zhàn)賽(AI City Challenge)多相機多行人跟蹤(Multi-Camera Multi-People Tracking)賽道冠軍。
  •  

其中,研究院PC創(chuàng)新與生態(tài)系統(tǒng)實驗室團隊收獲前四項冠軍,而人工智能實驗室和清華大學、以及與上海交通大學的兩個聯(lián)合團隊分別拿下自主系統(tǒng)挑戰(zhàn)賽具身多模態(tài)三維視覺定位冠軍和最具創(chuàng)新獎,以及AI CITY挑戰(zhàn)賽多相機多行人跟蹤賽道冠軍。

第一人稱視角與外界視角融合的4D視覺挑戰(zhàn)賽(Ego4D and EgoExo4D Challenge)

Ego4D數(shù)據(jù)集是一個大規(guī)模的以自我為中心的視頻數(shù)據(jù)集和基準套件。它提供3670小時的日常生活活動視頻,涵蓋數(shù)百種場景(家庭,戶外,工作場所,休閑等),由來自全球74個地點和9個不同國家的931名獨特的相機佩戴者(camera wearer)拍攝。

 

Ego-Exo4D數(shù)據(jù)集則是一個多樣化的、大規(guī)模的多模式多視角視頻數(shù)據(jù)集和基準套件。Ego-Exo4D同時捕捉以自我為中心和以外部為中心的,大眾熟悉的人類活動視頻(例如,體育、音樂、舞蹈、自行車修理等)。

 

基于這兩個數(shù)據(jù)集,CVPR2024提出了一系列新的基準挑戰(zhàn),這些挑戰(zhàn)圍繞著理解第一人稱視覺體驗展開。聯(lián)想研究院PC創(chuàng)新與生態(tài)系統(tǒng)實驗室團隊收獲了其中的社交互動(Looking At Me)賽道和手部姿態(tài)估計(Hand Pose)賽道兩項冠軍。

社交互動(Looking At Me)挑戰(zhàn)

在社交互動(Looking At Me)賽道,團隊以80.91 mAP(mean Average Precision,平均精度均值)的成績獲得了挑戰(zhàn)賽第一名。

 

社交互動是人類行為理解的關(guān)鍵。通過獲取以自我為中心的視頻數(shù)據(jù),我們可以獲得一種獨特的視角,捕捉到每個參與者的言語交流和非語言線索。這種技術(shù)為研究社交互動提供了寶貴的信息源,有助于深入理解人類的社交行為。未來,這種技術(shù)有望推動虛擬助理和社交機器人的發(fā)展,使其能夠更好地融入人類的社交環(huán)境,提供更智能、更貼心的交互體驗。通過分析社交互動的細微信號,我們可以培養(yǎng)出更富同理心和社交智慧的人工智能系統(tǒng),使其能夠更自然地與人類進行溝通互動。

比如該技術(shù)可以用來檢測家庭成員情緒狀態(tài),并為其提供建議或播放音樂等緩解情緒,具備情境理解與響應(yīng)能力。再比如,當檢測到廚房的煙霧報警器響起時,它不僅能即時通知家庭成員,還能自動聯(lián)系緊急服務(wù),并指導(dǎo)家中的兒童安全撤離。

在該挑戰(zhàn)中,參與者獲得了一段視頻,其中包含了已被定位和識別的社交伙伴的人臉,并對每個可見的人臉進行分類,判斷它們是否都在看向相機佩戴者。由于場景中人與攝像機之間的距離,以及人體的運動,導(dǎo)致了人臉圖像的模糊,使得這項任務(wù)具有很高的挑戰(zhàn)性。

面對這項挑戰(zhàn),團隊提出了由一個InterVL圖像編碼器和Bi-LSTM網(wǎng)絡(luò)組成的InternLSTM解決方案。InternVL負責提取空間特征,Bi-LSTM提取時間特征。為了解決任務(wù)的復(fù)雜性,我們引入了平滑濾波器,以消除輸出的噪聲或尖峰。

汽車生活更多>>

庫克稱iPhone 17等兼容機型用戶正“積極利用”蘋果牌AI IDC發(fā)布最新數(shù)據(jù):OPPO系手機全球銷量猛增,擠進前三! 特斯拉財報會議萬字實錄|馬斯克意外官宣停產(chǎn)Model S/X;直言只有中國機器人配做對手 【智庫聲音】上觀新聞 | 張虎祥等:社群運營:上海社區(qū)商業(yè)的新玩法 抖音電商:年貨節(jié)期間品牌年貨禮盒銷量增長3倍 對話九識CEO孔旗:我們已實現(xiàn)業(yè)務(wù)現(xiàn)金流和毛利率正向增長 千問迭代,是阿里的又一次 AI 戰(zhàn)略選擇 哈工大系闖出人形機器人黑馬:成立不到一年,全棧開源3m/s原型機 新能源車的「硬核」戰(zhàn)事,2026年卷向何處? 賈國龍再發(fā)聲:西貝從來不存在“兩歲的西藍花”,現(xiàn)在標準是一個月內(nèi)使用完畢 ARR達2.4億美元,可靈能帶快手起飛嗎? 世界級工廠按斤賣,觀致常熟工廠是如何被人為做空的 兩部門:對公租房建設(shè)期間用地及公租房建成后占地,免征城鎮(zhèn)土地使用稅 華住,比攜程還會撈金? 追覓科技俞浩:生態(tài)鏈基金已獲募資數(shù)量和規(guī)模雙料第一 國泰海通證券:維持農(nóng)夫山泉“增持”評級 料下半年提速 盈利繼續(xù)樂觀 國泰海通證券:維持優(yōu)然牧業(yè)(09858)“增持”評級 大股東定增彰顯信心 新一代奧迪Q5L賣30.98萬起!盤盤優(yōu)缺點,我推薦購買嗎? Agent時代,為什么多模態(tài)數(shù)據(jù)湖是必選項? 索尼與本田聯(lián)手造車了?AFEELA 1亮相,車內(nèi)可遠程操控PS游戲機 尺寸全面升級!哈弗猛龍加長版要來了,造型硬朗氣派,搭1.5T插混 本田革新品牌標識 “雙手”新“H”引領(lǐng)2027電動化新紀元‌ 北向資金持倉路徑曝光!全球鋰電巨頭連續(xù)7個季度獲加倉,商業(yè)航天概念股獲大面積掃貨 又一半導(dǎo)體概念股,將登陸A股!本周五申購! iQOO/紅米/OPPO/真我新機齊發(fā):誰才是真正的中端小鋼炮? 消息稱蘋果iOS 26.4將對健康應(yīng)用進行重大升級 榮耀MagicBook Pro 14 2026筆記本亮相CES 小米開出大罰單,許斐徐潔云取消年終獎,辭退經(jīng)辦人員,大熊道歉 這誰頂?shù)米。縤QOO新機1月6日突襲曝光,性能直接拉滿到爆! iPhone 18影像規(guī)格曝光,沒有2億像素