人民網
人民網>>經濟·科技

ROSS Harness:以全自主模式突破工業具身智能落地瓶頸

2026年08月28日09:59 | 來源:環球網222
訂閱已訂閱已收藏收藏小字號

點擊播報本文,約

原標題:ROSS Harness 以全自主模式突破工業具身智能落地瓶頸

在2026世界人形機器人運動會工業場景賽“裝配上料崗”賽項中,一台機器人需要連續完成搬運上架、揀選上料、物料裝配三項任務:從搬運10kg物料箱,到7類零件揀選,再到發動機18個氣門的亞毫米級裝配。最終,靈犀智涌機器人純自主完成整套任務,三項分別取得84分、65分及21分,在計入10分專項扣分后,以總分160分的成績順利完賽。按企業維度排名,僅次於行業頭部機器人企業旗下的兩支隊伍,也是首次參賽即沖入全國前三的初創公司。

對於正在從Demo走向真實產線的具身行業來說,這場比賽的意義遠不止分數。相較於其他賽場上歌舞喧囂,場景賽上的20分鐘,濃縮了工業具身智能機器人當下真正需要解決的問題:不僅要在真實場景裡“會做”,還要在工業級時間窗口內連續做對﹔不僅要完成一個動作,還要把多個動作串聯成穩定執行的完整任務﹔更要可交付、可驗收的工業生產結果。

這也是靈犀智涌想解決的問題。這家由98后中科大博士段逸凡在上海創立的工業級自進化具身智能機器人公司,沒有把核心競爭力僅僅押在模型上,而是選擇了一條不同的路線:CONWAY工業原生模型+ROSS Harness自主進化引擎。模型負責想“怎麼做”,ROSS Harness負責“怎麼把模型真正用好,把活真正干好”。

工業具身智能 正在進入“第二道考題”

過去兩年,具身智能行業最核心的技術敘事,始終圍繞一個問題展開:如何讓機器人擁有更強的“大腦”?VLA、World Action Model、強化學習、第一人稱視頻數據……模型能力不斷向前推進。

實驗室裡,一個機器人成功完成一次抓取、搬運或裝配,就足以說明模型具備相應能力﹔工廠卻不是這樣——這裡沒有完全可控的光照,沒有始終固定的工位,也沒有一成不變的物料。機器人需要面對夾具誤差、物料變化、設備狀態變化和長尾異常,還要滿足真實生產節拍。

當前工業具身智能的落地問題,可以概括為四個層面:成功率不夠、吞吐率不夠、運行成本高,以及遷移困難。工業現場要求接近100%的良率,容不下長尾出錯﹔機器人不是“做出來一次”就行,而是要接近甚至超過人工節拍﹔更現實的是,“三個工程師服務一台機器人”並不罕見——若一台機器后面要站幾個工程師,商業賬就算不過來。

這幾個問題實際上對應著同一個斷層:模型的能力,不等於工業系統的交付能力。一個模型可以擁有很強的Zero-shot能力,但進入真實產線后,仍然可能需要場景數據、后訓練以及大量工程約束﹔而工業任務往往是長程任務,不可能讓模型在每一步都自由發揮。

於是,當行業還在追問“誰的模型更強”時,工業現場其實已經提出了第二道考題:誰能把模型真正用好?

從“模型會不會”到“系統能不能做好” 中間差的是Harness

這個問題並不隻屬於具身智能。在數字世界裡,大模型從“會回答問題”走向“真正干活”,已經經歷過類似的變化。今天的Coding Agent並不是簡單把一個大模型放進代碼編輯器,模型之外,還有上下文管理、任務規劃、工具調用、工作流編排、安全校驗、多輪執行和結果驗証。真正讓模型成為Agent的,不只是模型本身,而是圍繞模型構建起來的Harness。

一個有力的佐証是:同樣的基座模型,放進不同的Coding Agent Harness,其任務表現可能判若兩人——模型決定它會不會,Harness決定它能不能真正把事做好做成。

靈犀智涌試圖把這套邏輯進一步帶到物理世界:數字世界Agent=LLM+Harness﹔物理世界Embodied Agent=Embodied Model+Embodied Harness+Hardware。

區別在於,機器人面對的是一個連續、開放、不可完全預測的物理世界。數字Agent調用了一個錯誤的API,最多重新執行一次﹔機器人執行了錯誤動作,卻可能意味著碰撞、物料損壞,甚至安全風險。

所以,具身Harness不能只是“調用工具”的軟件層。它必須同時理解:模型什麼時候應該被調用,一個長任務應該如何拆解,多個Skill如何組合,模型輸出是否安全,任務是否仍在正常推進,出現異常后應該重試、回退還是重新規劃,以及一次失敗如何沉澱為下一次執行可以使用的經驗。

這也構成了ROSS Harness的基本邏輯:它不是在模型外面再加一層工程代碼,而是在模型與機器人之間建立一條能夠持續運行的執行閉環。

CONWAY與ROSS:兩條能力鏈的協同

這裡也是靈犀智涌技術體系最值得關注的地方。強調Harness,並不意味著模型不重要——恰恰相反,如果不理解模型,就很難真正做好Harness。靈犀智涌的路線因此不是“放棄模型”,而是同時構建CONWAY工業原生模型與ROSS Harness,並讓二者協同演進。

CONWAY解決的是:機器人「如何形成高質量的局部動作決策」。

它的定位並不是與通用基座模型比參數規模,而是圍繞工業任務本身,研究模型在真實工業環境中需要具備什麼能力。團隊圍繞力觸覺增強、快速推理、動作對齊、少樣本適配、強化學習后訓練等方向持續研究,形成了若干項已有論文支撐的自研成果:FAVLA引入6D力覺,提升機器人在插拔、裝配等工業接觸任務中的穩定性與響應速度﹔DBPO把多步生成壓縮為原生單步策略,並支持強化學習后訓練,滿足工業機器人對高頻、實時控制的要求﹔CAC-VLA通過顯式latent action 對齊視覺語言理解與連續動作控制,提升工業操作中的動作精度與泛化能力﹔VLA-Stem在不改動原有VLA的情況下增加輕量級安全層,使機器人能夠在工業現場處理空間約束和動態避障。

這些工作指向同一個問題:機器人如何從“看懂”進一步走向“做好”。

ROSS Harness解決的是:機器人如何讓這些動作在真實工業現場被正確組織、可靠執行,並持續形成閉環

模型給出動作,並不意味著機器人就應該直接執行,工業環境需要在模型和硬件之間增加一整套確定性的組織機制,正是靈犀智涌ROSS Harness。ROSS Harness將不同具身模型統一到模型抽象層之上,再通過Skill把導航、抓取、力控等底層工具與現場工程經驗封裝為可復用能力,由Agentic AI完成任務拆解、技能編排和異常恢復,並通過分層安全監控保証機器人在不同時間尺度下可靠執行。更重要的是,每一次真實執行中的環境變化、失敗案例、人工接管和恢復過程,都會進一步沉澱為Skill、任務編排、長期記憶和訓練數據,讓系統在持續執行中不斷積累工業Know-how,並形成面向真實場景的數據飛輪。

圍繞上述任務編排、安全約束、多機協同和實時執行,團隊同樣形成了多項論文成果:CLMASP讓大模型負責語義理解與粗粒度規劃,再用形式化邏輯對任務步驟、環境狀態和機器人約束進行校驗與補全,把開放式推理轉化為確定、可執行的任務﹔Safe-BeAl在大模型規劃與真實執行之間加入安全評估與對齊,把物理世界的安全知識轉化為模型必須遵守的邊界,避免“任務邏輯正確、實際執行危險”﹔DynaHMRC把不同機器人的能力抽象為可調度的Agent,動態完成任務拆解、角色分工與多機重組﹔STDArm則在模型輸出與硬件執行之間加入動作管理、運動補償和時延校准,把模型動作轉化為能在真實動態環境中穩定執行的控制指令。

這意味著:模型可以換,Harness不必推倒重來。模型越強,Harness能調用的能力邊界越大﹔而Harness積累的真實工業經驗,又可以反過來幫助模型更好地理解工業任務。

從“本體-大腦競爭”到“系統能力競爭”

過去幾年,具身智能行業的競爭主要集中在兩個方向:一端是模型,誰擁有更多更好的數據、更強的模型、更高的Benchmark分數﹔另一端是本體,誰的機器人更靈活、更穩定、更便宜、更容易量產。但當行業真正進入工業現場后,中間出現了一層越來越難以忽視的能力:模型如何進入機器人,機器人如何進入任務,任務如何進入產線。這正是Harness的位置。

靈犀智涌並不認為傳統自動化會被具身智能整體替代。對於大批量、單一品種、長期不變的生產任務,傳統自動化在效率和穩定性上依然有優勢﹔具身智能真正適合切入的,是多品種、小批量、變化頻繁的柔性制造場景。一個真實例証是某汽車零部件廠商:因為訂單品種變化快,它反而把部分自動化產線拆回了“單工位+人+緩沖區”的模式——這類工位相對獨立、有容錯緩沖、核心動作是毫米級抓放的場景,恰好適合當前階段的具身智能切入。

這也決定了靈犀智涌選擇工業場景時,並不是優先尋找“最復雜、最炫技”的任務,而是尋找那些變化足夠多、但又能夠被系統化承接的柔性工位。機加工上下料正是其中的典型:不同訂單會帶來零件、料框、機床和工藝流程的持續變化,但任務的基本結構相對穩定,工位之間又具有較強獨立性。對這樣的場景而言,真正的挑戰不是讓機器人完成某一次抓取,而是當對象、流程、模型甚至機器人本體發生變化時,能否通過模型適配、Skill復用、任務重編排和異常恢復,快速完成新的部署,而不是重新做一套自動化工程。這恰好提供了一個驗証ROSS Harness能否把“單點能力”轉化為“可復制系統能力”的工業入口。

從這個角度看,ROSS Harness真正想解決的是:當工位變化、物料變化、模型變化甚至硬件變化時,機器人還能不能繼續工作?如果答案是肯定的,工業具身智能才真正擁有了規模化的可能。

賽場是試金石 工廠才是考場

160分,全國第三名是靈犀智涌在世界人形機器人運動會上初次亮相即收獲的戰績﹔面對真正的工業現場,還有更長的運行時間、更多的物料變化、更復雜的異常狀況,以及更嚴格的成本和交付要求。

這正是靈犀智涌選擇“模型+Harness”路線的原因。CONWAY繼續提升模型的物理智能,ROSS把這些智能變成穩定執行能力,真實任務產生的數據再反過來推動Skill、策略、記憶和模型共同進化。一條完整的閉環由此形成。

這和唯模型論,是兩種不同的Scaling邏輯:前者關注“模型還能變得多強”,后者關注“每部署一台機器人,整個系統能不能因此變得更強”。而這也暗含團隊一個反復強調的判斷——基座模型越強,Harness能釋放的威力越大,因為無論基座多強,它在物理世界執行中永遠需要安全兜底、經驗管理、工作流編排和數據回流,這些不是基座模型能替代的。

賽場是技術的試金石,工廠才是最終的考場。對工業具身智能而言,下一步要証明的已經不是機器人“能不能做”,而是是否真正可交付、可驗收、可持續迭代。而這,也正是靈犀智涌希望用CONWAY與ROSS Harness回答的問題。

(責編:董童、李源)
關注公眾號:人民網財經關注公眾號:人民網財經

分享讓更多人看到

推薦閱讀
返回頂部