2026年7月科技綜述:信任成為瓶頸
2026年7月產出的機器人基礎模型數量超越了以往任何一個月,技術重心也隨之轉移:資源稀缺的環節已不再是模型或數據,而是評估、認證與標準。 中國工信部召開了人形機器人標準化全體會議並成立了數據工作組;歐洲的 ISO 10218:2025 標準過渡期已開始篩選準備充分與準備不足的供應商;同時,一波又一波的基準測試紛紛湧現,用以衡量這股模型洪流實際能帶來什麼。信任層正逐漸成為產品本身。

2026年7月機器人技術的結構性轉變,並非源於新機型的問世——儘管當月確實推出了大量新機型。真正的轉變在於,工程資源正悄然從「開發能力」轉向「驗證能力」。一年前,具身人工智慧的瓶頸在於訓練數據,業界則以數據工廠、遙操作農場及合成數據管道作為回應。 七月的紀錄顯示,這套解決方案運作得相當順利,以至於催生了下一個瓶頸:大量模型、平台及功能宣稱如潮水般湧現,而買家、監管機構與系統整合商目前尚無法獨立驗證這些內容。當前最稀缺的技術層面在於「量測」,因此本月最具影響力的公告並非機器人本身,而是基準測試、認證機制與標準制定機構。
模型洪流本身不難記錄。七月見證了 Mistral 推動機器人模型、OpenBMB 推出 MiniCPM-Robot 緊湊型開放模型家族、昆侖科技的 Riemann 1.0 連同三款多模態模型,以及威瑞德(WeRide)的 WITT, 小米基於 10 萬小時營運數據訓練的 Robotics-1,以及螞蟻集團開源的 LingBot 深度與視覺基礎模型。 這些模型無一例外都附帶了供應商聲稱的功能,卻幾乎沒有經過獨立驗證。這種不對稱性,在一個月內不斷累積,正是促使評估基礎設施躍升為技術議程首要議題的主因。
7月,基準測試變得更具實戰力
中國評估新創公司「大肖機器人」(Daxiao Robotics)推出了「Physical IQ」,作為物理人工智慧的真實場景評估層,透過實際部署環境中的任務來評分機器人,而非經過精心設計的實驗室環境。 七月發表於 arXiv 的 RoboDojo,提出了一套針對通用機器人策略的統一模擬與實境基準測試,彌補了模型在模擬環境中表現優異,但在硬體上卻悄然退化的漏洞。RoboLab 則將機器人策略評估的範圍,從單純的成功率擴展至穩健性與一致性等維度。一場關於機器人基礎模型訓練後處理的研討會於
其第一階段完全圍繞一套標準化的真實機器人雙手操作基準進行,要求各團隊提交操作策略,並在共享的實體硬體上進行評估。定於十二月在聖塔克拉拉舉行的 IEEE 類人機器人會議,設計了「Loco-Manipulation Challenge」挑戰賽,旨在針對相同的公開任務流程,對商用平台與學術研究機器人進行評分,且在評分標準中,自主操作的權重高於遙控操作。單就這些項目而言,每項皆屬研究成果;若綜合來看,則標誌著該領域公開評估體系的開端——該領域的商業宣稱早已超越其驗證工具所能達到的程度。從這些宣稱本身,便可窺見其中的商業利害關係。 總部位於倫敦的輪式工業機器人製造商 Humanoid,於七月完成 1.52 億美元的 A 輪融資,該公司聲稱其 KinetIQ Ascend 框架下雙手任務的可靠性可達 99%。 UBTech的創辦人則在同月承認,已投入運作的人形機器人效率僅約人類工人的半數。這兩項聲明皆可能屬實,而兩者之間的差距,正是獨立基準測試存在的意義所在。在獨立基準測試確立之前,該產業的每項採購決策都必須為這種不確定性定價。
評估層面的經濟效益值得單獨探討,因為測量正逐漸從公共利益轉變為一門生意。 評估新創公司同時向三類截然不同的客戶出售評分:需要可信賴第三方數據來進行銷售和募資的機器人製造商;需要符合審計標準的採購準則的買家;以及若無關於故障頻率的合理估算便無法為機器人車隊定價的保險公司和金融機構。 這些客戶無一例外地都在為同一項基礎資產——即值得信賴的測量結果——付費,這使得評估層軟體在實驗室成本之上還能獲得利潤。這種模式在半導體產業中有過熟悉的先例:當晶片複雜度超越任何
買方能否自行驗證相關聲明。7 月份的基準調查顯示,機器人技術今年已達到相當的門檻。認證成為競爭利器
本月,標準議題已從諮詢性質轉變為商業層面的嚴峻課題。經修訂的工業機器人安全標準 ISO 10218:2025,預計將在 2027 年 1 月《歐洲機械法規》正式生效時,成為 CE 標誌產品的強制性要求;而 7 月發布的分析師訪談顯示,各方的準備程度存在顯著差距: 成熟的全球供應商普遍已做好準備,而中型供應商及新興的亞洲業者則存在顯著差距,且系統性地低估了合規成本。對於進軍歐洲市場的中國機器人製造商而言,認證這道高牆如今直接擋在出口擴張的道路上,而該標準在《歐盟官方公報》(OJEU)刊登的時間表,將決定市場排除產品的速度有多快。 庫卡(KUKA)搶先行動,為其作業系統和控制器取得 IEC 62443-4-2 第 2 級安全認證,成為首家獲得此認證的機器人製造商,並在同週將這項合規里程碑轉化為針對重視安全的工業買家的銷售賣點。
中國的制度性回應並非與之對立,而是與之並行。工業和信息化部於七月在紹興召開了人形機器人與具身智能標準化技術委員會2026年全體會議,並同步舉辦了「標準週」活動。 工業和資訊化部副部長柯繼新指出,該產業正從單機原型和階段性展示邁向批量交付,這一轉變提高了研究、生產、測試、應用及安全治理各環節的協調要求。該委員會正式成立了WG7數據工作組,以規範全行業的數據流通與合規利用。 與此同時,根據工業和信息化部相關數據顯示,中國已生產超過400台類人型
2026年上半年,全球將有超過半數的機器人機型投入生產;此一時序安排是經過深思熟慮的:在10萬台機器人送入工作場所和家庭之前,先將測量與數據層面標準化。對於任何規劃2027年產品路線圖的人來說,大西洋兩岸在方法上的差異至關重要。歐洲透過強制性合規來進行監管,設有明確的法律截止日期,並以市場排除作為遲延的懲罰。中國則透過協調委員會工作來推動標準化,此過程早於大規模部署展開,在機器大量到貨前,便已協調廠商統一數據格式與測試協議。 美國則一如既往,讓基準規範、保險公司及採購合約來發揮事實上的監管作用。目前,若供應商要同時進軍這三個市場,就必須針對同一台機器制定三套不同的驗證策略,而維持這些策略的成本正逐漸成為大型企業的結構性優勢。
感測器與元件層級也加入了這股趨勢。Sonair 的 ADAR 超音波感測器已完成認證,成為首款經獨立驗證、符合 SIL 2 及 PL d 完整性等級的人機安全協作 3D 感測器,該感測器採用聲音而非光線,這項認證正是針對必須在人群中運作的人形機器人而設計。 中國的「國家與地方共建類人型機器人創新中心」將實境數據基礎設施置於其部署路線圖的核心位置。 就連本月外科機器人領域的里程碑也符合這一趨勢:美國食品藥物管理局(FDA)對一款與手術台整合的外科機器人頒發的授權,本質上是一項「信任事件」——監管機構認證具備自主能力的機器可對人體進行手術。
「信任層」帶來的變革
同時也請觀察「信任層」對開源策略產生的影響。螞蟻集團決定將其 LingBot 視覺與深度模型開源,加上 OpenBMB 的緊湊型 MiniCPM-Robot 系列,讓任何系統整合商都能以零授權成本取得功能強大的具身模型。開放的權重檔案改變了競爭格局
問題的焦點已從「誰擁有該模型」轉變為「誰能證明其部署既安全、可靠且可通過認證」,這使得價值在技術堆疊中再次向上提升了一層。在這個機器人大腦自由流通的世界裡,真正的差異化資產在於圍繞這些大腦所建構的測試、認證及營運數據體系。對技術策略師而言,七月的紀錄顯示持久價值的所在正經歷重新排序。視覺-語言-動作模型使機器人能夠透過軟體升級,這意味著機器人的能力現已成為一個動態目標,唯有透過持續評估才能追蹤。 認證決定了哪些供應商可向哪些司法管轄區銷售產品,這使得合規體系成為營收的門檻,而非成本中心。標準制定機構決定哪些數據格式和安全架構將成為預設標準,這將委員會席位轉化為供應鏈中的話語權。那些曾將這些視為次要考量的事項的公司,在七月期間發現,這些因素正是市場的關鍵。
這個月以一個微小卻精準捕捉這股轉變的場景畫下句點。在紹興,數百名工程師、官員和高階主管在「標準週」期間,針對全球多數人仍視為科幻小說的機器,就測試協議、資料格式及安全治理展開辯論。沒有任何機器人走上舞台。 現場沒有任何示範。桌上擺放著草案文件,詳細規定人形機器人必須如何證明自身能力,才能讓他人信服;而在這個以壯觀示範為標誌的一年裡,業界最重要的場所,竟是那個要求機器人必須靜坐不動、接受測量的房間。












