
創(chuàng)新中心副總經(jīng)理李春枝表示,“具身智能”作為人工智能與其他學科交叉融合發(fā)展的智能新范式,通過賦予AI“身體”,主動探索世界、認識世界、改變世界,助力邁向通用人工智能。前期創(chuàng)新中心和中國信通院共同完成的《具身智能發(fā)展報告(2024)》,致力于厘清具身智能的概念內(nèi)涵、演進歷程、技術(shù)體系,通過梳理當前具身智能技術(shù)發(fā)展現(xiàn)狀,研判分析具身智能的應(yīng)用潛力和帶來的影響,并總結(jié)面臨的問題挑戰(zhàn),展望思維智能和行動智能有機融合的可能,期待這份報告能夠為行業(yè)發(fā)展提供方向指引和決策參考。
中國信通院副總工程師許志遠對報告內(nèi)容進行了解讀。
報告核心觀點如下:
具身智能是一種智能系統(tǒng),它通過與環(huán)境的交互來實現(xiàn)智能的增長。這種系統(tǒng)通常以機器人的形式存在,能夠進行環(huán)境感知、信息處理、自主決策和行動執(zhí)行,并通過經(jīng)驗反饋進行自我學習和適應(yīng)。目前,具身智能的發(fā)展正處在一個多路徑探索的階段,類似于自然語言處理領(lǐng)域中"BERT"模型的發(fā)展期。具身智能技術(shù)體系由感知、決策、行動和反饋四個模塊組成,形成了一個閉環(huán),使系統(tǒng)能夠在與環(huán)境的交互中不斷學習進化。
具身智能的發(fā)展可以分為三個階段:早期的萌芽階段(1950s-1990s),技術(shù)積累階段(1990s-2022),以及技術(shù)突破階段(2022年至今)。在技術(shù)突破階段,以ChatGPT為代表的大型模型為機器人的智能感知、自主決策和擬人化交互帶來了巨大的潛力。
具身智能有望實現(xiàn)"一腦多形"和"一機多用",即一個智能系統(tǒng)能夠適配多種形態(tài)的物理實體,如智能機器人和智能車輛,同時一個機器設(shè)備能夠靈活地執(zhí)行多種任務(wù),適應(yīng)不同的場景。這將推動生產(chǎn)力的躍升和生活方式的變革,具身智能的應(yīng)用將快速擴展至社會經(jīng)濟的各個層面。
然而,具身智能在多個方面面臨著挑戰(zhàn)。在算法層面,系統(tǒng)實現(xiàn)通用智能時需要人類智能的介入,并且尚未實現(xiàn)從感知到行動的認知映射。在數(shù)據(jù)層面,缺乏廣泛、高質(zhì)量和多樣化的真實數(shù)據(jù),以及仿真合成數(shù)據(jù)與現(xiàn)實世界之間的差異。軟件層面缺乏統(tǒng)一的操作系統(tǒng)和標準化的軟件開發(fā)工具鏈。硬件層面的挑戰(zhàn)包括耐用性、能源效率和與軟件的深度集成。另外,標準與合規(guī)層面也存在缺失,面臨信息安全和個人隱私等一系列社會學和倫理問題。
總的來說,具身智能是一個正在快速發(fā)展的領(lǐng)域,它將深刻影響AC米蘭的生活和工作方式。然而,要實現(xiàn)其潛力,還需要克服一系列技術(shù)和倫理上的挑戰(zhàn)。
京公網(wǎng)安備11011202100775號