日本黄色一级经典视频|伊人久久精品视频|亚洲黄色色周成人视频九九九|av免费网址黄色小短片|黄色Av无码亚洲成年人|亚洲1区2区3区无码|真人黄片免费观看|无码一级小说欧美日免费三级|日韩中文字幕91在线看|精品久久久无码中文字幕边打电话

當(dāng)前位置:首頁 > > AI科技大本營
[導(dǎo)讀]編譯|禾木木出品|?AI科技大本營(ID:rgznai100)你是否能想象AI以第一人稱視角來理解世界是什么樣的呢?未來,以第一人稱視角理解世界的AI可以開啟沉浸式體驗的新時代。增強現(xiàn)實(AR)眼鏡和虛擬現(xiàn)實(VR)耳機等設(shè)備在日常生活中,將會變得像智能手機一樣普遍且有用。想象一...

Facebook?正在研究新型?AI?系統(tǒng),以自我視角與世界進行交互編譯 | 禾木木出品 | AI科技大本營(ID:rgznai100)你是否能想象 AI 以第一人稱視角來理解世界是什么樣的呢?未來,以第一人稱視角理解世界的 AI 可以開啟沉浸式體驗的新時代。增強現(xiàn)實(AR)眼鏡和虛擬現(xiàn)實(VR)耳機等設(shè)備在日常生活中,將會變得像智能手機一樣普遍且有用。想象一下,你的 AR 設(shè)備準(zhǔn)確地顯示了如何在架子鼓課上握住鼓棒,知道你完成一個食譜;幫助你找到丟失的鑰匙,或是像全息圖一樣在你的記憶中重現(xiàn)。為了構(gòu)建這些新技術(shù),人工智能需要像我們一樣,可以從第一人稱的角度理解世界并進行互動。在研究界,通常稱為以自我為中心的感知。然而,今天的計算機視覺系統(tǒng)通常是以第三人稱視角來拍攝的數(shù)百萬張照片或是在視頻中學(xué)習(xí),而相機只是動作的旁觀者。
Facebook?正在研究新型?AI?系統(tǒng),以自我視角與世界進行交互


Facebook AI 推出 Ego4D

近日,F(xiàn)acebook AI 宣布推出 Ego4D,這是一個雄心勃勃的長期項目,為的就是解決以自我為中心的感知領(lǐng)域的研究挑戰(zhàn)。研究者匯集了一個由 9 個國家的 13 所大學(xué)和實驗室組成的聯(lián)盟,他們在野外收集了 700 多名參與者的日常生活,超過 2,200 小時的第一人稱視頻。Ego4D 是一個具有多樣性的大規(guī)模的以第一人稱視角為中心的數(shù)據(jù)集。它由來自全球 9 個不同國家 74 個地點的 855 名獨特參與者收集的 3025 小時視頻組成。該項目匯集了 88 名國際財團的研究人員,以大幅提高公開的以自我為中心的數(shù)據(jù)規(guī)模,使其在錄像時間方面比任何其他數(shù)據(jù)集都大20倍以上。
Facebook?正在研究新型?AI?系統(tǒng),以自我視角與世界進行交互


AI 也可以體驗第一視覺

Facebook 首席研究科學(xué)家克里斯汀·格勞曼 (Kristen Grauman) 表示,今天的計算機視覺系統(tǒng)不像人類那樣與第一人稱和第三人稱視角相關(guān)聯(lián)。就像是,將計算機視覺系統(tǒng)綁在過山車上,即使它是根據(jù)從地面邊線顯示的數(shù)十萬張過山車的圖像或視頻進行訓(xùn)練的,但是它也不知道它在看什么。為了讓人工智能系統(tǒng)能夠像我們一樣的方式與世界互動,人工智能領(lǐng)域需要發(fā)展到一種全新的第一人稱感知范式,”格勞曼在一份聲明中說?!斑@意味著人工智能在實時運動、交互和多感官觀察的背景下,通過人眼理解日常生活活動?!?/span>Facebook AI 還開發(fā)了五個以第一人稱視覺體驗為中心的基準(zhǔn)挑戰(zhàn),這將推動未來 AI 助手向現(xiàn)實世界應(yīng)用的發(fā)展。例如,“我把鑰匙放哪兒了?”“手機在哪里?”“有看到我的充電線嗎?”這種場景別提有多熟悉了,幾乎每天都會上場。
  • Ego4D 的第一個基準(zhǔn)挑戰(zhàn)是情景記憶(Episodic memory)


關(guān)鍵就是什么時候發(fā)生的?AI 可以通過檢索過去以自我為中心的視頻中的關(guān)鍵時刻來回答自由形式的問題并擴展個人記憶。


你可以問 AI 助手各種各樣的問題,例如:我把孩子最喜歡的泰迪熊放哪兒了?
  • 下一步就是進行預(yù)測:接下來可能會做什么?



人工智能可以理解佩戴者的行為會如何影響這個人未來的狀態(tài),比如這個人可能會移動到哪里,他們可能會觸摸什么物體,或者他們接下來可能會從事什么活動。預(yù)測行動不僅需要認(rèn)識到已經(jīng)發(fā)生的事情,還需要展望未來,預(yù)測下一步行動。這樣AI系統(tǒng)就可以在當(dāng)下提供有用的指導(dǎo)。例如,就在你想要再次準(zhǔn)備向鍋里加鹽時,你的人工智能助手會趕緊通知你“等等,您已經(jīng)加鹽了”
  • 第三個挑戰(zhàn)基準(zhǔn)就是手-物之間的互動(Hand and object manipulation)也是難點和關(guān)鍵的一步,因為AI需要理解在做什么,如何做?


學(xué)習(xí)手如何與物體互動對于AI指導(dǎo)我們的日常生活至關(guān)重要。AI必須檢測第一人稱的人-物交互,識別抓取,并檢測物體狀態(tài)變化。這種推動力也受到機器人學(xué)習(xí)的推動,機器人可以通過視頻中觀察到的人們的經(jīng)驗間接獲得經(jīng)驗。


因此,當(dāng)你在烹飪一份食譜時,AI 助手可以指導(dǎo)你需要哪些配料,需要先做什么,了解你已經(jīng)做了什么,指導(dǎo)你完成每一個關(guān)鍵步驟。人類可以用聲音來理解世界,未來的人工智能也要學(xué)會這種視聽記錄(Audio-visual diarization)。如果你正在上一堂重要的課,但因收到的信息而分了心,你可以問AI:“教授把我們的試卷收上去之后,課堂討論的主要話題是什么?”


  • 這個就是第四個挑戰(zhàn)基準(zhǔn) - 視聽分類


我正在與誰互動,如何互動?例如“如何在嘈雜的地方更好地聽到別人說話的聲音”


  • 社會互動(Social interaction)是 Ego4D 的最后一個方向。


除了識別視覺和聲音提示外,理解社交互動是智能 AI 助手的核心。一個社交智能的 AI 會理解誰在和誰說話,誰在關(guān)注誰。


所以,下次參加晚宴時,即使再嘈雜,AI 助手可以幫助你專注于桌子對面和你說話的人在說什么。以上這些基準(zhǔn)挑戰(zhàn)都是以第一人稱視覺為中心的人工智能的基本構(gòu)建模塊,這將讓 AI 不僅可以在現(xiàn)實世界中理解和互動,還可以在元宇宙中進行理解和交互,構(gòu)成更有用的 AI 助手和其他未來創(chuàng)新的基礎(chǔ)。
Facebook?正在研究新型?AI?系統(tǒng),以自我視角與世界進行交互

解開真實數(shù)據(jù)集

基準(zhǔn)和數(shù)據(jù)集在歷史上被證明是人工智能行業(yè)創(chuàng)新的關(guān)鍵催化劑。畢竟,今天的 CV 系統(tǒng)幾乎可以識別圖像中的任何對象,它是建立在數(shù)據(jù)集和基準(zhǔn)(例如 MNIST、COCO 和 ImageNet)之上的,它們?yōu)檠芯咳藛T提供了一個用于研究真實世界圖像的試驗臺。但是以自我為中心的感知是一個全新的領(lǐng)域。我們不能使用昨天的工具來構(gòu)建明天的創(chuàng)新。Ego4D 前所未有的規(guī)模和多樣性對于引入下一代智能 AI 系統(tǒng)至關(guān)重要。為了構(gòu)建這個數(shù)據(jù)集,每所合作大學(xué)的團隊向研究者分發(fā)了頭戴式攝像頭和其他可穿戴傳感器,以便他們能夠捕捉第一人稱、無腳本視頻。日常生活。參與者從日常場景中錄制大約8分鐘的視頻片段,例如雜貨店購物、烹飪和邊玩游戲邊交談以及與家人和朋友一起參與其他集體活動。Ego4D 捕捉了佩戴攝像機的人在特定環(huán)境中選擇注視的內(nèi)容,用手或是面前的物體做了什么,以及他們?nèi)绾我缘谝蝗朔Q視覺與其他人進行互動。與現(xiàn)有數(shù)據(jù)集相比,Ego4D 數(shù)據(jù)集提供了更大的場景、人物和活動的多樣性,這增加了針對不同背景、種族、職業(yè)和年齡的人訓(xùn)練的模型的適用性。
Facebook?正在研究新型?AI?系統(tǒng),以自我視角與世界進行交互

Ego4D 及以后的下一步是什么?

Facebook AI 試圖通過 Ego4D 項目打造一條全新的道路,以構(gòu)建更智能、更具交互性和靈活性的計算機視覺系統(tǒng)。隨著人工智能對人們正常生活方式有了更深入的理解,它可以開始以前所未有的方式對交互體驗進行情境化和個性化。Grauman表示:“Ego4D 使人工智能有可能獲得根植于物理和社會世界的知識,這些知識是通過生活在其中的人的第一人稱視角收集的。”“由此開始,人工智能不僅會更好地了解周圍的世界,有一天它可能還會實現(xiàn)個性化——它能知道你最喜歡的咖啡杯,或者為你的下一次家庭旅行指引路線?!?/span>有了 Ego4D 的基準(zhǔn)支持,配合上在全新數(shù)據(jù)集中的訓(xùn)練,AI 助手有可能以非常獨特和有意義的方式提供很多的價值,例如,幫助回憶起最近與同事交談中的關(guān)鍵信息,或者指導(dǎo)制作新的晚餐食譜,新的宜家家居等。Facebook 表示,從這一系列工作中獲得的價值將推動我們走向未來的現(xiàn)實。瑪麗皇后大學(xué)的人工智能研究員Mike Cook認(rèn)為,“從積極的角度來說,至少就目前而言,這是一個非常棒的大型數(shù)據(jù)集?!?/span>“但,這實際上并沒有解決人工智能中的一個緊迫挑戰(zhàn)或問題......除非你是一家想要銷售可穿戴相機的科技公司。它確實告訴你更多關(guān)于Facebook的未來計劃,但是......他們向它注入資金并不意味著它一定會變得重要。”參考鏈接:https://venturebeat.com/2021/10/14/facebook-introduces-dataset-and-benchmarks-to-make-ai-more-egocentric/https://ai.facebook.com/blog/teaching-ai-to-perceive-the-world-through-your-eyes/本文由AI科技大本營翻譯,轉(zhuǎn)載請注明出處。Facebook?正在研究新型?AI?系統(tǒng),以自我視角與世界進行交互



本站聲明: 本文章由作者或相關(guān)機構(gòu)授權(quán)發(fā)布,目的在于傳遞更多信息,并不代表本站贊同其觀點,本站亦不保證或承諾內(nèi)容真實性等。需要轉(zhuǎn)載請聯(lián)系該專欄作者,如若文章內(nèi)容侵犯您的權(quán)益,請及時聯(lián)系本站刪除。
換一批
延伸閱讀

LED驅(qū)動電源的輸入包括高壓工頻交流(即市電)、低壓直流、高壓直流、低壓高頻交流(如電子變壓器的輸出)等。

關(guān)鍵字: 驅(qū)動電源

在工業(yè)自動化蓬勃發(fā)展的當(dāng)下,工業(yè)電機作為核心動力設(shè)備,其驅(qū)動電源的性能直接關(guān)系到整個系統(tǒng)的穩(wěn)定性和可靠性。其中,反電動勢抑制與過流保護是驅(qū)動電源設(shè)計中至關(guān)重要的兩個環(huán)節(jié),集成化方案的設(shè)計成為提升電機驅(qū)動性能的關(guān)鍵。

關(guān)鍵字: 工業(yè)電機 驅(qū)動電源

LED 驅(qū)動電源作為 LED 照明系統(tǒng)的 “心臟”,其穩(wěn)定性直接決定了整個照明設(shè)備的使用壽命。然而,在實際應(yīng)用中,LED 驅(qū)動電源易損壞的問題卻十分常見,不僅增加了維護成本,還影響了用戶體驗。要解決這一問題,需從設(shè)計、生...

關(guān)鍵字: 驅(qū)動電源 照明系統(tǒng) 散熱

根據(jù)LED驅(qū)動電源的公式,電感內(nèi)電流波動大小和電感值成反比,輸出紋波和輸出電容值成反比。所以加大電感值和輸出電容值可以減小紋波。

關(guān)鍵字: LED 設(shè)計 驅(qū)動電源

電動汽車(EV)作為新能源汽車的重要代表,正逐漸成為全球汽車產(chǎn)業(yè)的重要發(fā)展方向。電動汽車的核心技術(shù)之一是電機驅(qū)動控制系統(tǒng),而絕緣柵雙極型晶體管(IGBT)作為電機驅(qū)動系統(tǒng)中的關(guān)鍵元件,其性能直接影響到電動汽車的動力性能和...

關(guān)鍵字: 電動汽車 新能源 驅(qū)動電源

在現(xiàn)代城市建設(shè)中,街道及停車場照明作為基礎(chǔ)設(shè)施的重要組成部分,其質(zhì)量和效率直接關(guān)系到城市的公共安全、居民生活質(zhì)量和能源利用效率。隨著科技的進步,高亮度白光發(fā)光二極管(LED)因其獨特的優(yōu)勢逐漸取代傳統(tǒng)光源,成為大功率區(qū)域...

關(guān)鍵字: 發(fā)光二極管 驅(qū)動電源 LED

LED通用照明設(shè)計工程師會遇到許多挑戰(zhàn),如功率密度、功率因數(shù)校正(PFC)、空間受限和可靠性等。

關(guān)鍵字: LED 驅(qū)動電源 功率因數(shù)校正

在LED照明技術(shù)日益普及的今天,LED驅(qū)動電源的電磁干擾(EMI)問題成為了一個不可忽視的挑戰(zhàn)。電磁干擾不僅會影響LED燈具的正常工作,還可能對周圍電子設(shè)備造成不利影響,甚至引發(fā)系統(tǒng)故障。因此,采取有效的硬件措施來解決L...

關(guān)鍵字: LED照明技術(shù) 電磁干擾 驅(qū)動電源

開關(guān)電源具有效率高的特性,而且開關(guān)電源的變壓器體積比串聯(lián)穩(wěn)壓型電源的要小得多,電源電路比較整潔,整機重量也有所下降,所以,現(xiàn)在的LED驅(qū)動電源

關(guān)鍵字: LED 驅(qū)動電源 開關(guān)電源

LED驅(qū)動電源是把電源供應(yīng)轉(zhuǎn)換為特定的電壓電流以驅(qū)動LED發(fā)光的電壓轉(zhuǎn)換器,通常情況下:LED驅(qū)動電源的輸入包括高壓工頻交流(即市電)、低壓直流、高壓直流、低壓高頻交流(如電子變壓器的輸出)等。

關(guān)鍵字: LED 隧道燈 驅(qū)動電源
關(guān)閉