8 月 20 日,在 2026 世界機器人大會主論壇上,宇樹科技創始人及董事長王興興發表了題為「展品到產品:人形機器人產業的下一個十年」的主題演講。作為宇樹科技上市後的首場公開演講,王興興對具身智能的「ChatGPT 時刻」給出了明確的時間判斷:快則兩到三年,慢則五到十年。 在演講中,王興興為具身智能的「ChatGPT 時刻」給出了一個可量化的定義:在 80% 的陌生場景中,通過語音或文字指令,機器人能夠順利完成大約 80% 的任務。
他進一步闡述道:「當我們可以將一台機器人帶入任意陌生的家庭環境,它能夠依靠語音指令,自主完成 80% 左右的日常任務,這就意味著具身智能實現了實質性突破,也是通用機器人產業迎來爆發的重要臨界點。」
具身智能的發展將改變家庭生活
這一標準意味著機器人不再侷限於工廠產線上的固定工位,而是能夠在真實家庭環境中靈活應對各類非標準化任務,真正實現從「展品」到「產品」的跨越。儘管前景廣闊,王興興也直面當前的技術困境。他指出:「當前全球多數 AI 模型,在固定場景中經過充足的數據採集和專項訓練後,任務成功率基本可以接近 100%。但只要更換操作物品,或是稍微改變環境,機器人的任務成功率就會出現大幅下降。」
他將此歸結為具身智能泛化能力不足,這是當前通用機器人領域最大的發展瓶頸。在實現「ChatGPT 時刻」的道路上,王興興認為最核心的挑戰在於 AI 模型的輸入輸出與真實機器人的對齊。大語言模型在數字世界中已展現出強大的推理與生成能力,但如何將這些能力無縫、可靠地轉化為物理世界中機器人的精確動作,仍是行業亟待攻克的關鍵難題。這不僅涉及算法的突破,更關乎數據採集、仿真訓練與真實環境驗證的全鏈條閉環。

