RunWhere 使用手册
从接入云账号到提交第一个 GPU 任务,RunWhere 文档帮助团队把训练、推理和 Notebook 跑在自己的云资源上。
RunWhere 是面向 AI 团队的多云 GPU 任务平台。你完成云资源接入后,可以用 Web 控制台或 runwhere CLI 提交任务;平台负责选择合适的 GPU、同步代码和环境、拉起任务、收集日志、统计用量,并在任务结束后释放资源。
适合谁读
- 第一次使用 RunWhere 的工程师:从快速开始、安装 CLI、编写 YAML 开始。
- 团队管理员:阅读控制台、云账号接入、API Keys、账务和配额。
- 平台/运维负责人:阅读控制台常见问题、任务排查和资源释放策略。
推荐阅读路径
- 概览:理解 RunWhere 的文档结构和核心工作流。
- 准备工作:创建账号、接入云资源、生成 API Token、安装 runwhere。
- 控制台概览:认识 Web 控制台的工作台、导航和管理入口。
- runwhere 快速开始:用 CLI 跑通最短路径。
- 编写任务 YAML:声明任务、镜像、资源、存储和常用模板。
- 运行任务:同步、提交、日志、停止、恢复和删除。
- 账务与配额:提交前查价,提交后看用量、账单和配额。
RunWhere 的工作方式
RunWhere 把任务提交、资源选择、环境同步、日志和用量统计收敛到一个统一入口。你不需要在每次训练前手动申请机器、配置环境和整理日志。
核心链路是:
接入云账号 -> 生成 API Token -> runwhere sync -> runwhere submit -> 查看日志 -> 自动释放资源 -> 查看用量第一版文档聚焦 MVP 主链:云账号接入、CLI、代码同步、任务提交、日志、用量、安全和故障排查。API Reference 和 SDK 文档会在公开 API 稳定后补齐。