这个工具是做什么的

做机器人的团队通常不只有一个算力问题,而是三个:策略在数据中心 GPU 集群上训练,在 Isaac Sim 里用 RTX 工作站做仿真与传感器渲染,最后装进真机上的 Jetson 做硬件在环验证。三层各有各的集群、调度器和胶水脚本,交接处最容易堆积一次性代码。OSMO 是英伟达对这个碎片化问题的答案:一个 Kubernetes 原生的工作流编排器,用一份 YAML 描述整条流水线,跨三层运行而不用碰基础设施代码。关键设计是工作流不写集群名,只写平台(例如 gb200、rtx-pro-6000、jetson-agx-thor),由 OSMO 路由到提供该平台的资源池;依赖来自 inputs、持久化来自 outputs、放置来自 platform。仓库的示例是三段式:仿真在 rtx-pro-6000 上跑 Isaac Sim 容器,训练在 gb200 上以 8 卡跑 PyTorch 并吃仿真输出,评估在 jetson-agx-thor 上跑 ROS 应用。默认用英伟达 KAI Scheduler 调度,支持串行与并行任务组、Jinja 参数化、重试策略与带抢占的优先级;随附 Helm chart 与 NGC 容器,可以用 KIND 在工作站上跑起完整控制面,也支持 EKS、AKS、GKE 与离线集群。仓库里带 AGENTS.md、skills 目录与 MCP 部署指南,官方称已与 Claude Code、Codex、Cursor 集成,编码智能体可以提交、监控与调试流水线。

基本信息

  • 分类:开发者工具
  • 厂商 / 团队:NVIDIA(开源,Apache 2.0)
  • 价格:免费(开源,Apache 2.0)
  • 收录日期:2026-09-16
  • 官网:github.com

适用场景

物理 AI · Kubernetes · 工作流编排 · 机器人 · 仿真 · Helm

官方入口

github.com ↗

同类工具