FabricCloud 产品使用手册
发布版本:FabricCloud
v0.1.0-rc.75
公网入口:fabriccloud.fabricintelligence.com.au
角色:客户(Customer)与平台运营人员(Operator)
更新日期:2026-09-22
1. 产品定位与价值
FabricCloud 是托管式 AI 推理交付平台。客户面对的核心产品对象是 Endpoint,而不是 GPU、虚拟机、集群或 Provider 账号。
FabricCloud 解决四个直接问题:
- 更快获得可用模型服务:从已发布的 Service Offer 创建 Endpoint, 无需自行安装驱动、Runtime、网关和监控组件。
- 稳定的接入边界:应用使用 FabricCloud URL、模型标识和 API key, Provider、硬件和运行细节保留在平台内部。
- 可见的运行与费用状态:客户可查看 Endpoint 状态、用量、小时价格、 余额、运行账单和发票;Operator 可查看底层证据和清理状态。
- 可审计的资源生命周期:发布前需要与精确模型、Runtime、硬件和区域 绑定的验证证据;暂停、重启和删除都需要确认资源清理结果。
FabricCloud 不是通用 GPU 云、Kubernetes 控制台或 SSH 主机销售平台。客户不会 获得 Provider 凭据、Provider 实例 ID、宿主机地址或 dstack 管理权限。
2. 两个角色及权限边界
| 能力 | 客户 | Operator |
|---|---|---|
| 登录和切换工作区 | 进入所属组织 | 可切换有权管理的组织 |
| 查看 Service Offer | 仅查看当前已发布 Offer | 查看当前及历史 Offer |
| 创建和管理 Endpoint | 是,仅限本组织 | 查看部署与执行证据 |
| 使用 Studio 和 API | 是,仅限本组织和已授权模型 | 不查看客户提示词或响应正文 |
| 创建 API key | Owner/Admin 按组织权限操作 | 不读取客户 key 明文 |
| 查看用量与账单 | 是,仅限本组织 | 查看运营、结算及风险元数据 |
| 管理团队 | Owner/Admin 邀请和调整成员 | 管理客户状态和平台访问边界 |
| 导入模型、选择 Runtime | 否 | 是 |
| 刷新 Provider 库存 | 否 | 是,只读操作,不创建资源 |
| 启动付费认证 | 否 | 是,必须显式确认预算与成本 |
| 发布 Offer | 否 | 是,且必须已有精确认证和清理证据 |
| 管理 Provider 凭据 | 否 | 仅通过受保护部署配置;浏览器不显示密钥 |
客户资源按组织隔离。客户账号不能打开 Operator 页面,也不能访问其他组织的 Endpoint、API key、用量或账单。Operator 的平台视图可以跨其有权管理的组织切换, 但不应暴露客户提示词、响应正文或 Provider 密钥。
3. 登录与账号
打开公网入口。FabricCloud 当前支持:
- 工作邮箱和密码;
- Google;
- Microsoft;
- GitHub。

当前公网采用邀请制注册。若账号尚未获得邀请,请联系 Operator。受邀用户可以使用 邀请邮箱创建账号,也可以在邀请流程允许时使用对应的 OIDC 账号继续。
3.1 密码登录
- 输入工作邮箱和密码。
- 选择 Sign in。
- 客户进入
/console;Operator 进入/operator。 - 忘记密码时选择 Forgot password?。重置成功后,原有会话会被撤销。
3.2 OIDC 登录
选择 Google、Microsoft 或 GitHub。完成外部身份提供方认证后返回 FabricCloud。 OIDC 只负责用户身份,组织、Endpoint、API key 和账单仍由 FabricCloud 管理。
3.3 Operator MFA
Operator 首次需要 MFA 时,系统显示验证器密钥。将密钥加入验证器应用,输入一次性 验证码,并安全保存恢复码。恢复码只应用于无法使用验证器的情况。
4. 客户使用流程
客户的标准路径是:
登录 -> 查看 Service catalog -> 创建 Endpoint -> 等待 Ready
-> 在 Studio 验证 -> 创建 API key -> 应用调用
-> 查看用量与费用 -> Suspend / Resume / Restart / Delete
4.1 Customer Console
左侧导航包含:
- Overview:Endpoint、请求、延迟、运行支出的摘要;
- Endpoints:Endpoint 状态与生命周期操作;
- Studio:交互式测试已发布模型或工作流;
- Usage & cost:运行时间、推理用量和费用归属;
- API keys:创建和撤销应用凭据;
- Team:管理组织成员与邀请;
- Billing:余额、充值、账单、发票与通知;
- Service catalog:查看可购买的已发布服务。
部分组织可能额外启用 Private capacity。未启用时不会显示该入口。
4.2 选择 Service Offer
打开 Service catalog。客户看到的是产品化服务,而不是未经验证的库存。一个 Offer 通常显示:
- 模型和服务名称;
- 数据边界和实际运行区域;
- 已认证硬件规格;
- On-Demand、Spot 或其他容量类型;
- 当前可用性及观测时间;
- 客户小时价格;
- 暂停、恢复和重新定价说明。

截图中的 Offer、价格、区域和可用状态是当时的真实验证快照,不构成永久报价。 实际合同以页面创建时的最新报价和确认内容为准。
4.3 创建 Endpoint
- 在 Offer 卡片输入 Endpoint 名称。
- 选择启动方式:
- Save endpoint:只保存为
Suspended,不会分配付费资源; - Check price and deploy now:重新检查容量与价格后立即部署。
- Save endpoint:只保存为
- 阅读计费和生命周期说明。
- 提交创建请求。

创建时没有自动跨 Offer 或跨 Provider 回退。若所选服务不可用,FabricCloud 保留 明确的不可用状态,不会未经客户确认改用另一种价格、硬件或市场类型。
4.4 Endpoint 状态
| 状态 | 含义 | 客户应做什么 |
|---|---|---|
suspended | 未运行;计算和临时磁盘已清理 | 可在需要时 Resume |
requested / submitted | 请求和价格已记录 | 等待自动处理 |
provisioning | 正在准备容量和 Runtime | 等待,不要重复提交 |
validating | 正在检查模型、网关和请求路径 | 等待验证完成 |
ready | Endpoint 可接收请求 | 使用 Studio 或 API |
degraded | Runtime 暂时不能正常服务 | 查看 Latest activity,联系支持 |
suspend_pending | 正在永久移除运行资源 | 等待清理确认后再 Resume |
restart_pending | 旧运行资源正在清理,随后才可重建 | 等待状态完成 |
deleted | Endpoint 已永久删除,不能恢复 | 如有需要创建新 Endpoint |
页面会自动刷新关键状态。Ready 只在模型加载、网关健康和实际请求路径满足要求后
显示;Provider 创建成功本身不等于 Endpoint 已可用。
下面的完整宽屏示例展示同一 Endpoint 详情界面处于 Suspended 状态时的样子。状态提示、
当前状态、运行位置、价格、API base URL、生命周期操作和客户边界集中显示;可用操作会随
生命周期状态变化。

4.5 使用 Studio 验证服务
- 打开 Studio。
- 在 Catalog 中选择已发布的模型服务或工作流。
- 选择一个与该服务匹配且状态为
Ready的 Endpoint。 - 对 chat-compatible 模型服务输入消息,并在同一 Endpoint 上继续多轮对话; 其他服务按页面表单输入提示词、上传文件或设置参数。
- 提交运行并等待结果。
- 在 Runs 中查看运行历史、状态、耗时和产物。
Studio 根据已发布的服务契约选择交互方式。chat-compatible 服务显示对话,并在每条新 消息中携带有界的历史轮次;图像、视频、音频和工作流服务继续使用 schema-driven 表单。切换模型服务或 Endpoint 会开始新对话,每一轮仍分别保存为可审计的 Run。
下面的示例完整展示 Studio 的 Catalog、精确 Endpoint 选择器、请求表单和实时结果区域。
图中 Runtime 有意处于不可用状态;只有匹配的 Endpoint 达到 Ready 后,提交操作才会
启用。

Studio 是验证和交互工作区。生产应用应使用 API key 调用公开 API,而不是复用浏览器 Cookie。不同模型服务支持的输入、输出、参数和交互方式可能不同,以 Studio 当前展示 和服务说明为准。
4.6 创建 API key
- 打开 API keys。
- 选择 Endpoint API。
- 输入便于识别的 Key name。
- 设置组织允许的月度预算上限。
- 选择 Issue key。
- 立即复制并存入密码管理器或 Secret Manager。
API key 明文只显示一次。FabricCloud 之后只保留必要元数据。泄露、人员离职或应用 停用时,使用 Revoke key 立即撤销,再签发替代 key。
若组织启用了 ComfyUI 集成,页面可额外签发作用域受限的 ComfyUI node key,并 生成对应配置。该 key 不应替代一般 Endpoint API key。
4.7 调用 OpenAI-compatible API
从 Endpoint 页面复制 OpenAI base URL 和精确模型标识。不要使用截图中的示例模型 名代替页面当前值。
export FABRICCLOUD_API_BASE="https://fabriccloud.fabricintelligence.com.au/v1"
export FABRICCLOUD_API_KEY="<your-api-key>"
export FABRICCLOUD_MODEL="<model-id-shown-on-your-endpoint>"
curl "$FABRICCLOUD_API_BASE/chat/completions" \
-H "Authorization: Bearer $FABRICCLOUD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "'"$FABRICCLOUD_MODEL"'",
"messages": [
{"role": "user", "content": "Summarise FabricCloud in one sentence."}
],
"temperature": 0.2
}'
只有声明 OpenAI chat-compatible 接口的服务才使用上述路径。图像、视频或工作流服务 可能使用 Studio 或其服务说明中的专用输入契约。
常见响应:
401:API key 无效、已撤销或未正确传入;403:key 或组织无权访问该模型;404:模型标识错误,或没有匹配的可用 Endpoint;429:预算、并发或速率限制;503:Endpoint 尚未 Ready 或服务暂时中断。
4.8 Endpoint 生命周期操作
Suspend
永久删除当前计算资源和临时运行磁盘,停止后续 Provider 运行计费,同时保留 Endpoint 配置、用量和审计记录。费用停止点以资源清理确认和计费记录为准。
Resume
从 Suspended 创建新的冷启动 Runtime。系统重新检查当前容量和价格;旧报价不会
自动延续。客户必须确认新报价。
Restart
先清理当前计算和临时磁盘,再按当前容量及价格创建新 Runtime。Restart 不是进程内 热重启。
Delete
永久删除 Endpoint,使其不能再次 Resume。历史用量、账单和审计记录仍按保留策略 存在。执行前需要显式确认。
Spot 容量可能被 Provider 中断。中断后页面会显示清理过程,不会把 Provider 中断错误 显示为正常启动。待计算和临时磁盘确认不存在后,才允许新的 Resume。
4.9 查看 Usage & cost
打开 Usage & cost,选择 Endpoint,查看:
- 当前或已记录的 Runtime 区间;
- 请求数、Token 或服务定义的用量指标;
- 当前费用和组织月度预算 guardrail;
- Spot 中断及费用截止说明;
- 工作流来源等附加标签。
FabricCloud 记录计费所需的使用元数据,不在客户或 Operator 用量页展示提示词和响应 正文。
4.10 团队管理
Owner/Admin 可以在 Team:
- 输入受邀人的工作邮箱;
- 选择
member或admin; - 创建七天有效的邀请;
- 查看邀请是否已接受;
- 调整非 Owner 成员角色或移除成员。
Owner 不能被普通角色调整覆盖。邀请信息应通过批准的企业渠道发送。
4.11 Billing
Billing 包含:
- 可用余额和待结算充值;
- 当前 Burn rate 和预计剩余运行时间;
- 卡支付或银行转账充值;
- Runtime billing log;
- Inference usage log;
- AUD 发票和钱包支付;
- Endpoint、账单和安全通知偏好。
卡号由 Stripe 托管页面处理,FabricCloud 不在 Portal 中保存完整卡信息。余额充值只有 在支付结算并由系统或 Operator 确认后才可用于运行服务。
5. Operator 使用流程
Operator 的主流程是:
配置 Provider 与商业 guardrail
-> 导入不可变模型修订
-> 选择兼容 Runtime
-> 生成候选比较(只读)
-> 显式批准有预算上限的真实认证
-> 验证模型加载、推理和永久清理
-> 发布 Offer
-> 监控客户 Endpoint、计费、风险和清理
5.1 Operator 导航
| 页面 | 主要用途 |
|---|---|
| Overview | 平台、Endpoint 和运营状态摘要 |
| Customers | 组织、Endpoint、余额、支出和风险;可暂停新的付费创建 |
| Models | 模型修订、Runtime 匹配、候选、认证和发布 |
| Runtime catalog | 管理受控、digest-pinned Runtime Package/Release |
| Offer catalog | 查看和管理当前及历史 Offer |
| Channels | 管理服务分发和渠道映射 |
| Deployments | 查看客户 Endpoint 背后的部署和生命周期 |
| Host fleet | 管理 ResourcePool、Registered Host 和 Managed Provider 池 |
| Runtime evidence | 查看模型加载、网关、请求和运行证据链 |
| Production readiness | 失败恢复、并发、计费和清理门禁 |
| Access policies | 查看当前组织、凭据和 Operator 安全边界 |
| Billing operations | 确认已结算的人工充值 |
| Platform settings | 价格、认证预算、邮件、Provider 和集成设置 |
工作区下拉框用于切换 Operator 有权管理的组织。平台 Provider 连接属于平台级配置, 不是某一个客户组织的浏览器密钥。
5.2 配置平台 Guardrail 和 Provider
在 Platform settings:
- 设置目标毛利、最高客户小时价格和 24 小时认证预算。
- 输入变更理由后保存。新设置不回写活动运行的已接受报价。
- 检查邮件服务状态,可发送测试邮件。
- 查看 Verda、Nebius 等 Managed Provider 的连接状态。
- 使用 Test connection 做只读认证检查。
- 使用 Refresh inventory 获取实时库存。刷新不会创建 GPU。
Provider 凭据来自受保护部署 Secret,浏览器只显示“已配置”和连接结果,永远不返回 密钥值。Verda 和 Nebius 是独立适配器,不能共享凭据、资源身份、可用性或认证证据。
5.3 导入模型与选择 Runtime
在 Models:
- 选择 Import model,指定模型仓库和不可变 revision。
- 检查解析出的架构、参数规模、精度、许可证和模型限制。
- 在 Runtime 页签中选择与精确模型能力兼容的 Runtime Package/Release。
- 生成不可变 Model Service Release 和 Execution Variant。
导入只创建元数据,不下载权重、不创建 Provider 资源,也不产生 GPU 费用。未知架构或 没有兼容 Runtime Package 时,页面明确显示阻塞原因,不能伪装成可发布状态。

5.4 比较候选资源
打开 Compatible GPUs 并选择 Generate comparison。比较会同时评估:
- 物理容量是否满足显存、GPU 数和存储要求;
- Runtime/kernel 与加速器架构是否兼容;
- 当前库存是否新鲜且可选择;
- 是否已有该精确组合的认证证据;
- 当前成本是否满足平台 guardrail。
候选比较和库存刷新都是只读操作,不会启动 GPU。未知硬件保留为
Compatibility to verify 或不可选择状态,不会从列表消失,也不会被误报为成功。

5.5 运行真实认证
真实认证会产生 Provider 费用,且可能启动 GPU。只有得到明确业务授权后才能执行:
- 选择精确 Candidate、Provider 区域、市场类型和镜像。
- 确认页面显示的成本和预算上限。
- 勾选付费运行授权。
- 启动认证。
- 观察模型加载、网关健康和真实请求结果。
- 等待计算和临时磁盘永久清理。
- 只有清理证据完整时接受
Certified。
不要因为库存存在就自动认证,不要在失败后自动切换另一块付费 GPU,也不要把静态配置 当作 Runtime 成功证据。
5.6 发布 Offer
只有同时满足以下条件时才能发布:
- 模型 revision 和 Runtime Release 不可变;
- Execution Variant 固定;
- Candidate 与 Provider SKU/区域/镜像绑定;
- 模型加载、网关和真实请求已通过;
- 认证资源的计算和临时磁盘已确认不存在;
- 价格、毛利、数据边界和生命周期规则已复核;
- 许可证或其他发布确认已完成。
发布后,Offer 才出现在客户 Service catalog。Spot 与 On-Demand 是不同合同,不能 作为同一 Endpoint 上的无提示开关。
5.7 监控客户与部署
在 Customers 和 Deployments 检查:
- 组织状态、余额、当前支出和活动 Endpoint;
- API key 数量和最近活动时间;
- Endpoint 状态是否与底层 Deployment 一致;
- Provider 操作、实例身份和清理证据;
- degraded、低余额、cleanup 风险和事故;
- 客户 Hold/Frozen 状态是否阻止新的付费创建。
平台级 Emergency stop 只暂停新的 Provider create 和认证任务,资源清理仍继续。 恢复前必须记录原因并确认风险解除。
5.8 Host Fleet 与容量池
Host Fleet 同时支持:
- Managed Provider pool:FabricCloud 通过 Provider adapter 创建和删除资源;
- Registered Host pool:连接已存在的 Agent/Host,不调用 Provider create/delete API;
- 可选客户自有容量:仅在组织和功能已明确启用时显示。
Host 的 origin/ownership 是审计信息,真正的生命周期行为由 ResourcePool 的 execution mode 决定。不要根据名称或描述前缀推断资源所有权。
5.9 Runtime Evidence 与 Production Readiness
Runtime evidence 将 Provider placement、Runtime、Gateway 和请求证据分开记录。 Provider 上“实例运行中”不能代替模型服务可用性证明。
Production readiness 展示自动失败矩阵、并发、成本控制、事故处理和真实 Provider 清理门禁。自动模拟器不会启动付费 Provider 资源;真实 Provider run 必须单独输入预算、 清理预留和确认语句。
5.10 Billing operations
银行转账等人工充值只有在资金已结算后才能选择 Confirm settled。确认会增加对应 组织的 AUD wallet balance。Operator 不在此页面处理卡号,卡支付由 Stripe 托管。
5.11 Provider 清理安全边界
Provider 凭据可见某个资源,不代表 FabricCloud 拥有该资源。清理必须匹配持久化的 Provider 身份、精确 dstack project/run、GPU 数量和 OS volume 关系。
尤其是 Verda:
- FabricCloud 控制面 CPU host 不是可清理 GPU;
- FabricScope 或其他项目/子项目的 GPU 不属于 FabricCloud;
- 缺少所有权证据时必须 fail closed 并进入人工复核;
- 不得用宽泛名称前缀扫描替代精确身份匹配。
Nebius 同样使用独立项目、凭据、实例和磁盘身份。任何一次认证或客户运行结束后,应从 FabricCloud 和 Provider 两侧确认计算和临时磁盘均已删除。
6. 常见问题与处理
Offer 显示 Temporarily unavailable 或 No fresh capacity
当前没有足够新的库存证据。客户不能强行部署。Operator 可执行只读 Provider 连接测试和库存刷新;若仍无结果,应等待容量恢复或发布另一份经过独立认证的 Offer。
Endpoint 长时间停留在 Provisioning
查看 Endpoint 的 Latest activity。Operator 再检查 Deployment、Runtime Worker、 dstack 和 Provider 状态。不要仅因为 Portal 页面可访问就判断后端是最新版本。
Endpoint 显示 Degraded
停止把它当作 Ready 服务使用。记录最近事件和时间,联系 Operator。Operator 应分别 检查 Provider、Runtime、Gateway 和 Control Plane,并优先执行安全清理或恢复。
Suspend 后仍不能 Resume
旧计算或临时磁盘尚未确认不存在。FabricCloud 在清理证据完整前 fail closed,避免同一 Endpoint 同时运行两套资源或继续产生不可见费用。
API 请求返回 401/403
确认使用 API key 而不是浏览器 Cookie;检查 key 是否撤销、预算是否耗尽、模型标识是否 与 Endpoint 一致,以及该组织是否有权访问服务。
价格为什么与上次不同
新的 Deploy、Resume 或 Restart 都会检查当前容量和价格。一次已接受运行的小时费率在 该运行周期内固定;结束后不会自动继承旧报价。
如何联系支持
提交以下信息,不要提交密码、API key、Provider 凭据、提示词或响应正文:
- 组织名;
- Endpoint ID 和名称;
- 页面显示的状态;
- 最近事件及时间;
- 请求 ID 或 Studio run ID;
- 浏览器截图和可复现步骤。
7. 上线前检查清单
客户
- 账号和组织正确,成员角色符合预期。
- Offer 的模型、区域、数据边界、容量类型和价格已确认。
- Endpoint 为
Ready,Studio 测试成功。 - API key 已存入 Secret Manager,未写入源码或聊天记录。
- 应用使用 Endpoint 显示的精确模型标识。
- 月度预算、余额和通知已配置。
- 明确 Suspend、Resume、Restart、Delete 的计费和清理影响。
Operator
- Provider 凭据和资源身份彼此独立,连接测试通过。
- Offer 绑定不可变模型、Runtime Release 和 Execution Variant。
- Candidate 静态兼容、实时可用性和成本 guardrail 均有证据。
- 真实认证有显式批准和预算上限。
- 模型加载、网关、请求和永久清理证据完整。
- 客户价格、毛利、数据边界和市场类型正确。
- 发布后客户目录可见,未发布 Draft 不可购买。
- 事故、清理和付费创建的停止条件已明确。
8. 当前产品边界
以下能力不是当前客户自助承诺:
- 原始 GPU、VM、SSH 或 Provider Console 访问;
- 客户自行修改 dstack、Runtime 镜像或 Provider 凭据;
- 未经认证的自动硬件或 Provider 回退;
- 把过期、未知或缺失容量证据当作可用;
- 把 Provider 实例创建成功当作 Endpoint Ready;
- 未经明确批准启动真实 GPU 认证;
- 跨组织共享 API key、Endpoint、账单或运行数据。
平台会继续扩展 Provider、Runtime 和服务类型,但客户的稳定对象仍是 Endpoint。新增 Provider 不应要求客户改变应用接入方式,也不能改变现有 Verda 或 Nebius 的独立凭据、 库存、资源身份和清理边界。
9. 截图说明
本手册截图来自公网页面或真实 E2E/浏览器回归证据。截图用于解释操作位置和状态语义; Offer 名称、客户名称、价格、区域、时间和容量状态可能随环境变化。涉及付费、数据边界 或可用性的决策,应始终以当前页面及最终确认对话框为准。