News
Loading market feed...
News 快訊

智在无界 Being-H-Flash 月費 150 元落地端側,隐式路線把世界模型成本打到英伟达 Cosmos 的 2%

智在无界發布隐式世界模型產品 Being-H-Flash,在單台機器人每日掃碼千件的流水線場景中,月算力成本僅需 150 元,相當於一張 GPT Plus 訂閱費,是英伟达 Cosmos 方案的 2%、比 VLA 架構的 Pi0.

DeltaMedia 編輯部 1 min 2026年6月4日
智在无界 Being-H-Flash 月費 150 元落地端側,隐式路線把世界模型成本打到英伟达 Cosmos 的 2%

智在无界 Being-H-Flash 月費 150 元落地端側,隐式路線把世界模型成本打到英伟达 Cosmos 的 2%

智在无界發布隐式世界模型產品 Being-H-Flash,在單台機器人每日掃碼千件的流水線場景中,月算力成本僅需 150 元,相當於一張 GPT Plus 訂閱費,是英伟达 Cosmos 方案的 2%、比 VLA 架構的 Pi0.5 便宜 70%。更關鍵的是,它能在類似 Orin NX 的百 TOPS 級端側芯片上以接近 20FPS 實時運行,同時兼容國產 AI 芯片與英伟达平台。以上數字為廠商宣稱,尚未經第三方驗證。

Being-H-Flash 採隐式路線:不在像素空間逐幀生成未來畫面,而是在感知與動作之間構建潛空間(Latent Space)進行推演,有別於英伟达 Cosmos-Policy 先「畫出未來」再規劃動作的顯式路線,省去大量視頻生成開銷。訓練資料含逾 20 萬小時第一人稱人類視頻與逾 1.5 萬小時機器人示教數據;推理側自研 Universal Async Chunking(UAC)異步技術進一步壓縮控制延遲。

真正的訊號是部署成本與閉環延遲兩道關卡同時有解。雲端世界模型在工廠斷網或網路抖動環境下,那根連回數據中心的網線是控制系統最脆弱的一環;端側實時推理才能做毫秒級閉環,應對接高速滑落物件、操作液體或柔性物等動態任務。對做具身的團隊,這是一把量尺:顯式還是隐式,先把算力帳和延遲帳算清楚再選邊。

繼續閱讀