orx instance完整教程:创建、列出与销毁计算实例
【免费下载链接】OpenResearchTurn your coding agents into research agents项目地址: https://gitcode.com/GitHub_Trending/op/OpenResearch
在 OpenResearch 中,orx instance是管理独立计算实例的核心命令组:你可以一键创建 GPU 或 CPU 云实例(OpenResearch managed compute)、列出组织内所有实例的状态与 SSH 接入点,用完后随时销毁,避免按小时计费白烧钱。与实验运行(orx exp run)不同,orx instance创建的机器不绑定任何实验,适合 SSH 进去做手动调试、临时跑训练等"自由工作"场景。本教程带你完整走完「创建 → 列出 → 销毁」全流程。
什么是 orx instance?
OpenResearch 把算力分成了两种用法:
| 命令 | 场景 | 生命周期 |
|---|---|---|
orx exp run | 跑一次实验,自动开机 → 执行 → 关机 | 与实验绑定 |
orx instance create | 要一台长期可用的机器,自己 SSH 进去干活 | 手动控制 |
orx instance等价于网页控制台的 "Spin up" 面板:它在**组织(Organization)**层面开机器,而不是项目层面。它的实现位于 instance.rs,命令定义见 main.rs。
官方内置的技能文档 SKILL.md 也建议:当你需要一台持久机器做手动或临时工作时,就用orx instance create;跑实验则走orx exp run。
准备工作:登录与获取组织 ID
orx instance所有命令都要求已登录,且创建/列出都需要组织 ID(orgId):
orx login # 首次使用先登录 orx orgs # 列出账号可用的组织,第一列就是 orgIdorx orgs以表格输出 ID 和名称(实现见 orgs.rs)。另外建议提前注册好 SSH 公钥,否则实例开机后你 SSH 不进去:
orx ssh-key add # 复用或创建 ~/.ssh/id_ed25519一键创建计算实例:GPU 与 CPU 两种模式
创建 GPU 实例
--gpu和--cpu二选一(同时传会直接报错)。GPU 型号 ID 必须先查目录表:
orx compute # 列出全部 GPU 报价(按价格升序) orx compute --gpu H100_SXM # 只看 H100注意要用orx compute里的精确 ID(如H100_SXM),而不是H100这种系列名。查好之后创建:
orx instance create <orgId> --gpu H100_SXM --count 1 --disk 100常用可选参数(详见 SKILL.md):
| 参数 | 说明 | 默认值 |
|---|---|---|
--count N | 每个实例的 GPU 数量 | 1 |
--disk GB | 磁盘容量(仅 GPU 实例) | 100 |
--provider P | 指定供应商(如 runpod、vast、lambda) | 省略=跨供应商自动选最便宜报价 |
💡 不写--provider时,服务端会在所有供应商中自动挑最便宜的匹配报价;想锁定某家供应商再显式指定即可。
创建 CPU 实例
CPU 实例有三种规格档位(flavor):cpu5c(计算型)、cpu5g(通用型)、cpu5m(内存优化型):
orx instance create <orgId> --cpu cpu5g --vcpus 8--vcpus只支持2、8、32三档,默认 8。CPU 报价可用orx compute --cpu查看(实现见 compute.rs)。
异步开机:创建后耐心等待
创建是异步的:命令会立即返回实例 ID 和初始状态,但 SSH 主机名(user@host:port)要等机器真正开机完成后才会出现:
✓ Instance requested id: sbx_abc123 status: provisioning gpu: H100_SXM x1 price: $2.99/hr The box is provisioning; its SSH host appears once it's online.稍后用orx instance list轮询即可看到在线状态和 SSH 端点(此逻辑见 instance.rs)。
列出实例:状态、价格与 SSH 端点一览
orx instance list <orgId>输出每行一台机器,包含实例 ID、状态(如online)、规格(H100_SXM x1或8 vcpus)、每小时价格,以及就绪后的 SSH 连接信息user@host:port(实现见 instance.rs)。
⚠️ 这个命令还是手动清理入口:如果某次orx exp run --backend openresearch实验结束后自动关机(teardown)失败,遗留在组织里的"孤儿机器"也会出现在这里——按小时计费,一定要记得手动删掉(下面讲)。
销毁实例:手动关闭计费
用orx instance delete终止实例,会彻底销毁供应商侧的机器(不可恢复):
orx instance delete <sandboxId> # ✓ Termination requested for instance sbx_abc123.sandboxId就是orx instance list输出的第一列。它的定位就是实验自动关机失败时的手动补救路径——用完即删,是省钱的好习惯(命令实现见 instance.rs)。
常见问题速查
| 问题 | 排查 |
|---|---|
Pass exactly one of --gpu or --cpu. | 两个参数只能传一个,删掉多余的那个 |
--provider only applies with --gpu | --provider只对 GPU 实例生效 |
| GPU 型号报 400 错误 | 用orx compute核对精确 ID(如H100_SXM而非H100) |
| 实例一直连不上 SSH | 先确认已orx ssh-key add,再等状态变为 online |
| 实验结束后发现还在扣费 | orx instance list找到孤儿机器,orx instance delete删掉 |
小结
orx instance create <orgId> --gpu …/--cpu …:在组织下开一台独立机器,异步开机orx instance list <orgId>:查状态、价格、SSH 端点,兼作孤儿机器排查orx instance delete <sandboxId>:销毁实例,停止计费
三个命令覆盖独立计算实例的完整生命周期,配合orx orgs、orx compute、orx ssh-key add即可把云算力用得又快又省心。🚀
【免费下载链接】OpenResearchTurn your coding agents into research agents项目地址: https://gitcode.com/GitHub_Trending/op/OpenResearch
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考