來源於:躋身世界人形機器人運動會工業場景賽全國前三 ROSS Harness 以全自主模式突破工業具身智能落地瓶頸-開雲手機在線官網入口
發布時間:2026-08-29 00:03:08
文章摘要:
躋身世界人形機器人運動會工業場景賽全國前三 ROSS Harness 以全自主模式突破工業具身智能落地瓶頸-開雲手機在線官網入口:躋身世界人形機器人運動會工業場景賽全國前三 ROSS Harness 以全自主模式突破工業具身智能落地瓶頸-開雲手機在線官網入口 躋身世界人形機器人運動會工業場景賽全國前三 ROSS Harness 以全自主模式突破工業具身智能落地瓶頸-開雲手機在線官網入口
在2026世界人形機器人運動會-工業場景賽-「裝配上料崗」賽項中,躋身機器具身一台機器人需要連續完成搬運上架、世界賽全揀選上料、人形人運開雲手機網頁登陸物料裝配三項任務:從搬運10kg物料箱,工業國前工業到七類零件揀選,場景再到發動機18個氣門的自主智亞毫米級裝配。最終,模式靈犀智湧機器人純自主完成整套任務,突破三項分別取得84分、落地65分及21分,瓶頸在計入10分專項扣分後,躋身機器具身以總分160分的世界賽全成績順利完賽。按企業維度排名,人形人運僅次於行業頭部機器人企業旗下的工業國前工業兩支隊伍,也是場景首次參賽即衝入全國前三的唯一初創公司。 對於正在從Demo走向真實產線的具身行業來說,這場比賽的意義遠不止分數。相較於其他賽場上歌舞喧囂,場景賽上的2 0分鍾,濃縮了工業具身智能機器人當下真正需要解決的問題:不僅要在真實場景裏「會做」,還要在工業級時間窗口內連續做對;不僅要完成一個動作,還要把多個動作串聯成穩定執行的完整任務;更要可交付、可驗收的工業生產結果。 這也是靈犀智湧想解決的問題。這家由98後中科大博士段逸凡在上海創立的工業級自進化具身智能機器人公司,沒有把核心競爭力僅僅押在模型上,而是選擇了一條不同的路線:CONWAY工業原生模型+ ROSS Harness自主進化引擎。模型負責想「怎麽做」,ROSS Harness負責「怎麽把模型真正用好,把活真正幹好」。 工業具身智能,正在進入「第二道考題」 過去兩年,具身智能行業最核心的技術敘事,始終圍繞一個問題展開:如何讓機器人擁有更強的「大腦」?VLA、World Action Model、開雲手機網頁登陸強化學習、第一人稱視頻數據……模型能力不斷向前推進。 但一個基本事實是:從2025年至今,行業還沒有一家公司完整跑通工業場景的產品閉環。 實驗室裏,一個機器人成功完成一次抓取、搬運或裝配,就足以說明模型具備相應能力;工廠卻不是這樣——這裏沒有完全可控的光照,沒有始終固定的工位,也沒有一成不變的物料。機器人需要麵對夾具誤差、物料變化、設備狀態變化和長尾異常,還要滿足真實生產節拍。 因此,工業真正關心的不是「這個任務能不能做出來」,而是「能不能持續高質量交付」。 當前工業具身智能的落地問題,可以概括為四個層麵:成功率不夠、吞吐率不夠、運行成本高,以及遷移困難。工業現場要求接近100%的良率,容不下長尾出錯;機器人不是「做出來一次」就行,而是要接近甚至超過人工節拍;更現實的是,「三個工程師服務一台機器人」並不罕見——若一台機器後麵要站幾個工程師,商業賬就算不過來。 這幾個問題實際上對應著同一個斷層:模型的能力,不等於工業係統的交付能力。一個模型可以擁有很強的Zero-shot能力,但進入真實產線後,仍然可能需要場景數據、後訓練以及大量工程約束;而工業任務往往是長程任務,不可能讓模型在每一步都自由發揮。 於是,當行業還在追問「誰的模型更強」時,工業現場其實已經提出了第二道考題:誰能把模型真正用好? 從「模型會不會」到「係統能不能做好」,中間差的是Harness 這個問題並不隻屬於具身智能。在數字世界裏,大模型從「會回答問題」走向「真正幹活」,已經經曆過類似的變化。今天的Coding Agent並不是簡單把一個大模型放進代碼編輯器,模型之外,還有上下文管理、任務規劃、工具調用、工作流編排、安全校驗、多輪執行和結果驗證。真正讓模型成為Agent的,不隻是模型本身,而是圍繞模型構建起來的Harness。 一個有力的佐證是:同樣的基座模型,放進不同的Coding Agent Harness,其任務表現可能判若兩人——模型決定它會不會,Harness決定它能不能真正把事做好做成。 靈犀智湧試圖把這套邏輯進一步帶到物理世界:數字世界Agent = LLM + Harness;物理世界Embodied Agent = Embodied Model + Embodied Harness + Hardware。 區別在於,機器人麵對的是一個連續、開放、不可完全預測的物理世界。數字Agent調用了一個錯誤的API,最多重新執行一次;機器人執行了錯誤動作,卻可能意味著碰撞、物料損壞,甚至安全風險。 所以,具身Harness不能隻是「調用工具」的軟件層。它必須同時理解:模型什麽時候應該被調用,一個長任務應該如何拆解,多個Skill如何組合,模型輸出是否安全,任務是否仍在正常推進,出現異常後應該重試、回退還是重新規劃,以及一次失敗如何沉澱為下一次執行可以使用的經驗。 這也構成了ROSS Harness的基本邏輯:它不是在模型外麵再加一層工程代碼,而是在模型與機器人之間建立一條能夠持續運行的執行閉環。 CONWAY與ROSS:兩條能力鏈的協同 這裏也是靈犀智湧技術體係最值得關注的地方。強調Harness,並不意味著模型不重要——恰恰相反,如果不理解模型,就很難真正做好Harness。靈犀智湧的路線因此不是「放棄模型」,而是同時構建CONWAY工業原生模型與ROSS Harness,並讓二者協同演進。 CONWAY解決的是:機器人「如何形成高質量的局部動作決策」。 它的定位並不是與通用基座模型比參數規模,而是圍繞工業任務本身,研究模型在真實工業環境中需要具備什麽能力。團隊圍繞力觸覺增強、快速推理、動作對齊、少樣本適配、強化學習後訓練等方向持續研究,形成了若幹項已有論文支撐的自研成果:FAVLA引入6D力覺,提升機器人在插拔、裝配等工業接觸任務中的穩定性與響應速度;DBPO把多步生成壓縮為原生單步策略,並支持強化學習後訓練,滿足工業機器人對高頻、實時控製的要求;CAC-VLA通過顯式latent action對齊視覺語言理解與連續動作控製,提升工業操作中的動作精度與泛化能力; VLA-Stem在不改動原有VLA的情況下增加輕量級安全層,使機器人能夠在工業現場處理空間約束和動態避障。 這些工作指向同一個問題:機器人如何從「看懂」進一步走向「做好」。 ROSS Harness解決的是:機器人如何讓這些動作在真實工業現場被正確組織、可靠執行,並持續形成閉環。 模型給出動作,並不意味著機器人就應該直接執行,工業環境需要在模型和硬件之間增加一整套確定性的組織機製,正是靈犀智湧ROSS Harness。ROSS Harness將不同具身模型統一到模型抽象層之上,再通過Skill把導航、抓取、力控等底層工具與現場工程經驗封裝為可複用能力,由Agentic AI完成任務拆解、技能編排和異常恢複,並通過分層安全監控保證機器人在不同時間尺度下可靠執行。更重要的是,每一次真實執行中的環境變化、失敗案例、人工接管和恢複過程,都會進一步沉澱為Skill、任務編排、長期記憶和訓練數據,讓係統在持續執行中不斷積累工業Know-how,並形成麵向真實場景的數據飛輪。 圍繞上述任務編排、安全約束、多機協同和實時執行,團隊同樣形成了多項論文成果:CLMASP 讓大模型負責語義理解與粗粒度規劃,再用形式化邏輯對任務步驟、環境狀態和機器人約束進行校驗與補全,把開放式推理轉化為確定、可執行的任務;Safe-BeAl 在大模型規劃與真實執行之間加入安全評估與對齊,把物理世界的安全知識轉化為模型必須遵守的邊界,避免「任務邏輯正確、實際執行危險」;DynaHMRC 把不同機器人的能力抽象為可調度的Agent,動態完成任務拆解、角色分工與多機重組;STDArm 則在模型輸出與硬件執行之間加入動作管理、運動補償和時延校準,把模型動作轉化為能在真實動態環境中穩定執行的控製指令。 這意味著:模型可以換,Harness不必推倒重來。 模型越強,Harness能調用的能力邊界越大;而Harness積累的真實工業經驗,又可以反過來幫助模型更好地理解工業任務。這才是真正的「協同演進」。 全國第三背後,是從「能做」到「做得又快又好」 評價機器人是否真正具備工業價值,也不應該隻看「成功率」。因為工業生產還有一個同樣重要的變量:速度。 靈犀智湧因此提出了一個更接近工業生產的評價思路:有效產出=成功率 x 吞吐率。 在相關測試中,ROSS Harness對應的量化結果是有效產出提升3.6倍——這正是Harness對模型能力進行係統化放大的量化表達。 這個指標背後的意義在於:機器人不是「做出來一次」就夠了,它需要穩定地做、持續地做、在規定時間內做。這也是工業具身智能與傳統機器人Demo之間最本質的差別。 從「本體-大腦競爭」到「係統能力競爭」 過去幾年,具身智能行業的競爭主要集中在兩個方向:一端是模型,誰擁有更多更好的數據、更強的模型、更高的Benchmark分數;另一端是本體,誰的機器人更靈活、更穩定、更便宜、更容易量產。但當行業真正進入工業現場後,中間出現了一層越來越難以忽視的能力:模型如何進入機器人,機器人如何進入任務,任務如何進入產線。這正是Harness的位置。 靈犀智湧並不認為傳統自動化會被具身智能整體替代。對於大批量、單一品種、長期不變的生產任務,傳統自動化在效率和穩定性上依然有優勢;具身智能真正適合切入的,是多品種、小批量、變化頻繁的柔性製造場景。一個真實例證是某汽車零部件廠商:因為訂單品種變化快,它反而把部分自動化產線拆回了「單工位+人+緩衝區」的模式——這類工位相對獨立、有容錯緩衝、核心動作是毫米級抓放的場景,恰好適合當前階段的具身智能切入。 這也決定了靈犀智湧選擇工業場景時,並不是優先尋找“最複雜、最炫技”的任務,而是尋找那些變化足夠多、但又能夠被係統化承接的柔性工位。機加工上下料正是其中的典型:不同訂單會帶來零件、料框、機床和工藝流程的持續變化,但任務的基本結構相對穩定,工位之間又具有較強獨立性。對這樣的場景而言,真正的挑戰不是讓機器人完成某一次抓取,而是當對象、流程、模型甚至機器人本體發生變化時,能否通過模型適配、Skill複用、任務重編排和異常恢複,快速完成新的部署,而不是重新做一套自動化工程。這恰好提供了一個驗證ROSS Harness能否把“單點能力”轉化為“可複製係統能力”的工業入口。 從這個角度看,ROSS Harness真正想解決的是:當工位變化、物料變化、模型變化甚至硬件變化時,機器人還能不能繼續工作?如果答案是肯定的,工業具身智能才真正擁有了規模化的可能。 為什麽是段逸凡和靈犀智湧 這條路線最終落到靈犀智湧,並不是偶然。具身Harness作為複雜的係統性工程,它要求團隊同時理解模型、機器人、控製、安全、任務規劃以及真實工業現場。 而靈犀智湧聯合創始人、CTO段逸凡博士,正是站在這些領域交叉點上的人。段逸凡作為中國科學技術大學機器人方向博士,讀博期間聚焦具身智能、空間智能等方向,相關成果發表於RSS、IJRR、TRO、ICRA、IROS等機器人領域會議和期刊,CONWAY模型和ROSS Harness正是其學術研究向工程係統轉化的核心產物。段逸凡博士師從中科大機器人權威專家吉建民教授,此次創立靈犀智湧,吉建民教授以聯合創始人、首席科學家的身份加入,負責前沿技術指導、長期技術路線和底層方法論;段逸凡則帶領工程團隊推進ROSS Harness的架構設計、工程實現與產品定義。 更重要的是,靈犀智湧的壁壘不是某一項單點技術,而是雙層複合:一層是技術壁壘——團隊自2018年以來長期機器人技術,已形成覆蓋感知、決策、規劃、控製及工程部署的全棧機器人研發能力,CONWAY模型和ROSS Harness的每一個細節設計都有頂級論文成果和實際驗證,同時Harness作為係統工程,背後是多年工程積累和對基座模型的深度理解;另一層是場景數據壁壘——在真實工廠跑數月積累的高價值、多模態、覆蓋長尾異常與恢複過程的真實交互數據。 這形成了一種特別的組合:一端是機器人與具身智能的長期學術積累,另一端是把算法真正落地為真實場景的工程能力。 而這恰恰對應了工業具身智能目前最難的一步——不是再做一個Demo,而是把Demo背後的能力抽象出來,形成可複用、可遷移、可驗證、可持續進化的係統。 賽場是試金石,工廠才是考場 160分,全國第三名是靈犀智湧在世界人形機器人運動會上初次亮相即收獲的戰績;麵對真正的工業現場,還有更長的運行時間、更多的物料變化、更複雜的異常狀況,以及更嚴格的成本和交付要求。 這正是靈犀智湧選擇「模型+ Harness」路線的原因。CONWAY繼續提升模型的物理智能,ROSS把這些智能變成穩定執行能力,真實任務產生的數據再反過來推動Skill、策略、記憶和模型共同進化。一條完整的閉環由此形成。 這和唯模型論,是兩種不同的Scaling邏輯:前者關注「模型還能變得多強」,後者關注「每部署一台機器人,整個係統能不能因此變得更強」。而這也暗含團隊一個反複強調的判斷——基座模型越強,Harness能釋放的威力越大,因為無論基座多強,它在物理世界執行中永遠需要安全兜底、經驗管理、工作流編排和數據回流,這些不是基座模型能替代的。 賽場是技術的試金石,工廠才是最終的考場。對工業具身智能而言,下一步要證明的已經不是機器人「能不能做」,而是是否真正可交付、可驗收、可持續迭代。而這,也正是靈犀智湧希望用CONWAY與ROSS Harness回答的問題。
返回首頁