跳到主要内容

FabricCloud 产品使用手册

发布版本:FabricCloud v0.1.0-rc.75
公网入口:fabriccloud.fabricintelligence.com.au
角色:客户(Customer)与平台运营人员(Operator)
更新日期:2026-09-22

1. 产品定位与价值​

FabricCloud 是托管式 AI 推理交付平台。客户面对的核心产品对象是 Endpoint,而不是 GPU、虚拟机、集群或 Provider 账号。

FabricCloud 解决四个直接问题:

  1. 更快获得可用模型服务:从已发布的 Service Offer 创建 Endpoint, 无需自行安装驱动、Runtime、网关和监控组件。
  2. 稳定的接入边界:应用使用 FabricCloud URL、模型标识和 API key, Provider、硬件和运行细节保留在平台内部。
  3. 可见的运行与费用状态:客户可查看 Endpoint 状态、用量、小时价格、 余额、运行账单和发票;Operator 可查看底层证据和清理状态。
  4. 可审计的资源生命周期:发布前需要与精确模型、Runtime、硬件和区域 绑定的验证证据;暂停、重启和删除都需要确认资源清理结果。

FabricCloud 不是通用 GPU 云、Kubernetes 控制台或 SSH 主机销售平台。客户不会 获得 Provider 凭据、Provider 实例 ID、宿主机地址或 dstack 管理权限。

2. 两个角色及权限边界​

能力客户Operator
登录和切换工作区进入所属组织可切换有权管理的组织
查看 Service Offer仅查看当前已发布 Offer查看当前及历史 Offer
创建和管理 Endpoint是,仅限本组织查看部署与执行证据
使用 Studio 和 API是,仅限本组织和已授权模型不查看客户提示词或响应正文
创建 API keyOwner/Admin 按组织权限操作不读取客户 key 明文
查看用量与账单是,仅限本组织查看运营、结算及风险元数据
管理团队Owner/Admin 邀请和调整成员管理客户状态和平台访问边界
导入模型、选择 Runtime否是
刷新 Provider 库存否是,只读操作,不创建资源
启动付费认证否是,必须显式确认预算与成本
发布 Offer否是,且必须已有精确认证和清理证据
管理 Provider 凭据否仅通过受保护部署配置;浏览器不显示密钥

客户资源按组织隔离。客户账号不能打开 Operator 页面,也不能访问其他组织的 Endpoint、API key、用量或账单。Operator 的平台视图可以跨其有权管理的组织切换, 但不应暴露客户提示词、响应正文或 Provider 密钥。

3. 登录与账号​

打开公网入口。FabricCloud 当前支持:

  • 工作邮箱和密码;
  • Google;
  • Microsoft;
  • GitHub。

FabricCloud 公网登录页

当前公网采用邀请制注册。若账号尚未获得邀请,请联系 Operator。受邀用户可以使用 邀请邮箱创建账号,也可以在邀请流程允许时使用对应的 OIDC 账号继续。

3.1 密码登录​

  1. 输入工作邮箱和密码。
  2. 选择 Sign in。
  3. 客户进入 /console;Operator 进入 /operator。
  4. 忘记密码时选择 Forgot password?。重置成功后,原有会话会被撤销。

3.2 OIDC 登录​

选择 Google、Microsoft 或 GitHub。完成外部身份提供方认证后返回 FabricCloud。 OIDC 只负责用户身份,组织、Endpoint、API key 和账单仍由 FabricCloud 管理。

3.3 Operator MFA​

Operator 首次需要 MFA 时,系统显示验证器密钥。将密钥加入验证器应用,输入一次性 验证码,并安全保存恢复码。恢复码只应用于无法使用验证器的情况。

4. 客户使用流程​

客户的标准路径是:

登录 -> 查看 Service catalog -> 创建 Endpoint -> 等待 Ready
-> 在 Studio 验证 -> 创建 API key -> 应用调用
-> 查看用量与费用 -> Suspend / Resume / Restart / Delete

4.1 Customer Console​

左侧导航包含:

  • Overview:Endpoint、请求、延迟、运行支出的摘要;
  • Endpoints:Endpoint 状态与生命周期操作;
  • Studio:交互式测试已发布模型或工作流;
  • Usage & cost:运行时间、推理用量和费用归属;
  • API keys:创建和撤销应用凭据;
  • Team:管理组织成员与邀请;
  • Billing:余额、充值、账单、发票与通知;
  • Service catalog:查看可购买的已发布服务。

部分组织可能额外启用 Private capacity。未启用时不会显示该入口。

4.2 选择 Service Offer​

打开 Service catalog。客户看到的是产品化服务,而不是未经验证的库存。一个 Offer 通常显示:

  • 模型和服务名称;
  • 数据边界和实际运行区域;
  • 已认证硬件规格;
  • On-Demand、Spot 或其他容量类型;
  • 当前可用性及观测时间;
  • 客户小时价格;
  • 暂停、恢复和重新定价说明。

客户 Service catalog 与当前价格、容量和硬件

截图中的 Offer、价格、区域和可用状态是当时的真实验证快照,不构成永久报价。 实际合同以页面创建时的最新报价和确认内容为准。

4.3 创建 Endpoint​

  1. 在 Offer 卡片输入 Endpoint 名称。
  2. 选择启动方式:
    • Save endpoint:只保存为 Suspended,不会分配付费资源;
    • Check price and deploy now:重新检查容量与价格后立即部署。
  3. 阅读计费和生命周期说明。
  4. 提交创建请求。

选择立即部署时,系统明确提示将开始运行和计费

创建时没有自动跨 Offer 或跨 Provider 回退。若所选服务不可用,FabricCloud 保留 明确的不可用状态,不会未经客户确认改用另一种价格、硬件或市场类型。

4.4 Endpoint 状态​

状态含义客户应做什么
suspended未运行;计算和临时磁盘已清理可在需要时 Resume
requested / submitted请求和价格已记录等待自动处理
provisioning正在准备容量和 Runtime等待,不要重复提交
validating正在检查模型、网关和请求路径等待验证完成
readyEndpoint 可接收请求使用 Studio 或 API
degradedRuntime 暂时不能正常服务查看 Latest activity,联系支持
suspend_pending正在永久移除运行资源等待清理确认后再 Resume
restart_pending旧运行资源正在清理,随后才可重建等待状态完成
deletedEndpoint 已永久删除,不能恢复如有需要创建新 Endpoint

页面会自动刷新关键状态。Ready 只在模型加载、网关健康和实际请求路径满足要求后 显示;Provider 创建成功本身不等于 Endpoint 已可用。

下面的完整宽屏示例展示同一 Endpoint 详情界面处于 Suspended 状态时的样子。状态提示、 当前状态、运行位置、价格、API base URL、生命周期操作和客户边界集中显示;可用操作会随 生命周期状态变化。

处于 Suspended 状态的完整 Endpoint 详情页

4.5 使用 Studio 验证服务​

  1. 打开 Studio。
  2. 在 Catalog 中选择已发布的模型服务或工作流。
  3. 选择一个与该服务匹配且状态为 Ready 的 Endpoint。
  4. 对 chat-compatible 模型服务输入消息,并在同一 Endpoint 上继续多轮对话; 其他服务按页面表单输入提示词、上传文件或设置参数。
  5. 提交运行并等待结果。
  6. 在 Runs 中查看运行历史、状态、耗时和产物。

Studio 根据已发布的服务契约选择交互方式。chat-compatible 服务显示对话,并在每条新 消息中携带有界的历史轮次;图像、视频、音频和工作流服务继续使用 schema-driven 表单。切换模型服务或 Endpoint 会开始新对话,每一轮仍分别保存为可审计的 Run。

下面的示例完整展示 Studio 的 Catalog、精确 Endpoint 选择器、请求表单和实时结果区域。 图中 Runtime 有意处于不可用状态;只有匹配的 Endpoint 达到 Ready 后,提交操作才会 启用。

Runtime 不可用时的完整 Studio 界面

Studio 是验证和交互工作区。生产应用应使用 API key 调用公开 API,而不是复用浏览器 Cookie。不同模型服务支持的输入、输出、参数和交互方式可能不同,以 Studio 当前展示 和服务说明为准。

4.6 创建 API key​

  1. 打开 API keys。
  2. 选择 Endpoint API。
  3. 输入便于识别的 Key name。
  4. 设置组织允许的月度预算上限。
  5. 选择 Issue key。
  6. 立即复制并存入密码管理器或 Secret Manager。

API key 明文只显示一次。FabricCloud 之后只保留必要元数据。泄露、人员离职或应用 停用时,使用 Revoke key 立即撤销,再签发替代 key。

若组织启用了 ComfyUI 集成,页面可额外签发作用域受限的 ComfyUI node key,并 生成对应配置。该 key 不应替代一般 Endpoint API key。

4.7 调用 OpenAI-compatible API​

从 Endpoint 页面复制 OpenAI base URL 和精确模型标识。不要使用截图中的示例模型 名代替页面当前值。

export FABRICCLOUD_API_BASE="https://fabriccloud.fabricintelligence.com.au/v1"
export FABRICCLOUD_API_KEY="<your-api-key>"
export FABRICCLOUD_MODEL="<model-id-shown-on-your-endpoint>"

curl "$FABRICCLOUD_API_BASE/chat/completions" \
-H "Authorization: Bearer $FABRICCLOUD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "'"$FABRICCLOUD_MODEL"'",
"messages": [
{"role": "user", "content": "Summarise FabricCloud in one sentence."}
],
"temperature": 0.2
}'

只有声明 OpenAI chat-compatible 接口的服务才使用上述路径。图像、视频或工作流服务 可能使用 Studio 或其服务说明中的专用输入契约。

常见响应:

  • 401:API key 无效、已撤销或未正确传入;
  • 403:key 或组织无权访问该模型;
  • 404:模型标识错误,或没有匹配的可用 Endpoint;
  • 429:预算、并发或速率限制;
  • 503:Endpoint 尚未 Ready 或服务暂时中断。

4.8 Endpoint 生命周期操作​

Suspend​

永久删除当前计算资源和临时运行磁盘,停止后续 Provider 运行计费,同时保留 Endpoint 配置、用量和审计记录。费用停止点以资源清理确认和计费记录为准。

Resume​

从 Suspended 创建新的冷启动 Runtime。系统重新检查当前容量和价格;旧报价不会 自动延续。客户必须确认新报价。

Restart​

先清理当前计算和临时磁盘,再按当前容量及价格创建新 Runtime。Restart 不是进程内 热重启。

Delete​

永久删除 Endpoint,使其不能再次 Resume。历史用量、账单和审计记录仍按保留策略 存在。执行前需要显式确认。

Spot 容量可能被 Provider 中断。中断后页面会显示清理过程,不会把 Provider 中断错误 显示为正常启动。待计算和临时磁盘确认不存在后,才允许新的 Resume。

4.9 查看 Usage & cost​

打开 Usage & cost,选择 Endpoint,查看:

  • 当前或已记录的 Runtime 区间;
  • 请求数、Token 或服务定义的用量指标;
  • 当前费用和组织月度预算 guardrail;
  • Spot 中断及费用截止说明;
  • 工作流来源等附加标签。

FabricCloud 记录计费所需的使用元数据,不在客户或 Operator 用量页展示提示词和响应 正文。

4.10 团队管理​

Owner/Admin 可以在 Team:

  1. 输入受邀人的工作邮箱;
  2. 选择 member 或 admin;
  3. 创建七天有效的邀请;
  4. 查看邀请是否已接受;
  5. 调整非 Owner 成员角色或移除成员。

Owner 不能被普通角色调整覆盖。邀请信息应通过批准的企业渠道发送。

4.11 Billing​

Billing 包含:

  • 可用余额和待结算充值;
  • 当前 Burn rate 和预计剩余运行时间;
  • 卡支付或银行转账充值;
  • Runtime billing log;
  • Inference usage log;
  • AUD 发票和钱包支付;
  • Endpoint、账单和安全通知偏好。

卡号由 Stripe 托管页面处理,FabricCloud 不在 Portal 中保存完整卡信息。余额充值只有 在支付结算并由系统或 Operator 确认后才可用于运行服务。

5. Operator 使用流程​

Operator 的主流程是:

配置 Provider 与商业 guardrail
-> 导入不可变模型修订
-> 选择兼容 Runtime
-> 生成候选比较(只读)
-> 显式批准有预算上限的真实认证
-> 验证模型加载、推理和永久清理
-> 发布 Offer
-> 监控客户 Endpoint、计费、风险和清理

5.1 Operator 导航​

页面主要用途
Overview平台、Endpoint 和运营状态摘要
Customers组织、Endpoint、余额、支出和风险;可暂停新的付费创建
Models模型修订、Runtime 匹配、候选、认证和发布
Runtime catalog管理受控、digest-pinned Runtime Package/Release
Offer catalog查看和管理当前及历史 Offer
Channels管理服务分发和渠道映射
Deployments查看客户 Endpoint 背后的部署和生命周期
Host fleet管理 ResourcePool、Registered Host 和 Managed Provider 池
Runtime evidence查看模型加载、网关、请求和运行证据链
Production readiness失败恢复、并发、计费和清理门禁
Access policies查看当前组织、凭据和 Operator 安全边界
Billing operations确认已结算的人工充值
Platform settings价格、认证预算、邮件、Provider 和集成设置

工作区下拉框用于切换 Operator 有权管理的组织。平台 Provider 连接属于平台级配置, 不是某一个客户组织的浏览器密钥。

5.2 配置平台 Guardrail 和 Provider​

在 Platform settings:

  1. 设置目标毛利、最高客户小时价格和 24 小时认证预算。
  2. 输入变更理由后保存。新设置不回写活动运行的已接受报价。
  3. 检查邮件服务状态,可发送测试邮件。
  4. 查看 Verda、Nebius 等 Managed Provider 的连接状态。
  5. 使用 Test connection 做只读认证检查。
  6. 使用 Refresh inventory 获取实时库存。刷新不会创建 GPU。

Provider 凭据来自受保护部署 Secret,浏览器只显示“已配置”和连接结果,永远不返回 密钥值。Verda 和 Nebius 是独立适配器,不能共享凭据、资源身份、可用性或认证证据。

5.3 导入模型与选择 Runtime​

在 Models:

  1. 选择 Import model,指定模型仓库和不可变 revision。
  2. 检查解析出的架构、参数规模、精度、许可证和模型限制。
  3. 在 Runtime 页签中选择与精确模型能力兼容的 Runtime Package/Release。
  4. 生成不可变 Model Service Release 和 Execution Variant。

导入只创建元数据,不下载权重、不创建 Provider 资源,也不产生 GPU 费用。未知架构或 没有兼容 Runtime Package 时,页面明确显示阻塞原因,不能伪装成可发布状态。

没有兼容 Runtime 时,发布流程保持阻塞

5.4 比较候选资源​

打开 Compatible GPUs 并选择 Generate comparison。比较会同时评估:

  • 物理容量是否满足显存、GPU 数和存储要求;
  • Runtime/kernel 与加速器架构是否兼容;
  • 当前库存是否新鲜且可选择;
  • 是否已有该精确组合的认证证据;
  • 当前成本是否满足平台 guardrail。

候选比较和库存刷新都是只读操作,不会启动 GPU。未知硬件保留为 Compatibility to verify 或不可选择状态,不会从列表消失,也不会被误报为成功。

Operator 选择精确验证资源并确认成本

5.5 运行真实认证​

真实认证会产生 Provider 费用,且可能启动 GPU。只有得到明确业务授权后才能执行:

  1. 选择精确 Candidate、Provider 区域、市场类型和镜像。
  2. 确认页面显示的成本和预算上限。
  3. 勾选付费运行授权。
  4. 启动认证。
  5. 观察模型加载、网关健康和真实请求结果。
  6. 等待计算和临时磁盘永久清理。
  7. 只有清理证据完整时接受 Certified。

不要因为库存存在就自动认证,不要在失败后自动切换另一块付费 GPU,也不要把静态配置 当作 Runtime 成功证据。

5.6 发布 Offer​

只有同时满足以下条件时才能发布:

  • 模型 revision 和 Runtime Release 不可变;
  • Execution Variant 固定;
  • Candidate 与 Provider SKU/区域/镜像绑定;
  • 模型加载、网关和真实请求已通过;
  • 认证资源的计算和临时磁盘已确认不存在;
  • 价格、毛利、数据边界和生命周期规则已复核;
  • 许可证或其他发布确认已完成。

发布后,Offer 才出现在客户 Service catalog。Spot 与 On-Demand 是不同合同,不能 作为同一 Endpoint 上的无提示开关。

5.7 监控客户与部署​

在 Customers 和 Deployments 检查:

  • 组织状态、余额、当前支出和活动 Endpoint;
  • API key 数量和最近活动时间;
  • Endpoint 状态是否与底层 Deployment 一致;
  • Provider 操作、实例身份和清理证据;
  • degraded、低余额、cleanup 风险和事故;
  • 客户 Hold/Frozen 状态是否阻止新的付费创建。

平台级 Emergency stop 只暂停新的 Provider create 和认证任务,资源清理仍继续。 恢复前必须记录原因并确认风险解除。

5.8 Host Fleet 与容量池​

Host Fleet 同时支持:

  • Managed Provider pool:FabricCloud 通过 Provider adapter 创建和删除资源;
  • Registered Host pool:连接已存在的 Agent/Host,不调用 Provider create/delete API;
  • 可选客户自有容量:仅在组织和功能已明确启用时显示。

Host 的 origin/ownership 是审计信息,真正的生命周期行为由 ResourcePool 的 execution mode 决定。不要根据名称或描述前缀推断资源所有权。

5.9 Runtime Evidence 与 Production Readiness​

Runtime evidence 将 Provider placement、Runtime、Gateway 和请求证据分开记录。 Provider 上“实例运行中”不能代替模型服务可用性证明。

Production readiness 展示自动失败矩阵、并发、成本控制、事故处理和真实 Provider 清理门禁。自动模拟器不会启动付费 Provider 资源;真实 Provider run 必须单独输入预算、 清理预留和确认语句。

5.10 Billing operations​

银行转账等人工充值只有在资金已结算后才能选择 Confirm settled。确认会增加对应 组织的 AUD wallet balance。Operator 不在此页面处理卡号,卡支付由 Stripe 托管。

5.11 Provider 清理安全边界​

Provider 凭据可见某个资源,不代表 FabricCloud 拥有该资源。清理必须匹配持久化的 Provider 身份、精确 dstack project/run、GPU 数量和 OS volume 关系。

尤其是 Verda:

  • FabricCloud 控制面 CPU host 不是可清理 GPU;
  • FabricScope 或其他项目/子项目的 GPU 不属于 FabricCloud;
  • 缺少所有权证据时必须 fail closed 并进入人工复核;
  • 不得用宽泛名称前缀扫描替代精确身份匹配。

Nebius 同样使用独立项目、凭据、实例和磁盘身份。任何一次认证或客户运行结束后,应从 FabricCloud 和 Provider 两侧确认计算和临时磁盘均已删除。

6. 常见问题与处理​

Offer 显示 Temporarily unavailable 或 No fresh capacity​

当前没有足够新的库存证据。客户不能强行部署。Operator 可执行只读 Provider 连接测试和库存刷新;若仍无结果,应等待容量恢复或发布另一份经过独立认证的 Offer。

Endpoint 长时间停留在 Provisioning​

查看 Endpoint 的 Latest activity。Operator 再检查 Deployment、Runtime Worker、 dstack 和 Provider 状态。不要仅因为 Portal 页面可访问就判断后端是最新版本。

Endpoint 显示 Degraded​

停止把它当作 Ready 服务使用。记录最近事件和时间,联系 Operator。Operator 应分别 检查 Provider、Runtime、Gateway 和 Control Plane,并优先执行安全清理或恢复。

Suspend 后仍不能 Resume​

旧计算或临时磁盘尚未确认不存在。FabricCloud 在清理证据完整前 fail closed,避免同一 Endpoint 同时运行两套资源或继续产生不可见费用。

API 请求返回 401/403​

确认使用 API key 而不是浏览器 Cookie;检查 key 是否撤销、预算是否耗尽、模型标识是否 与 Endpoint 一致,以及该组织是否有权访问服务。

价格为什么与上次不同​

新的 Deploy、Resume 或 Restart 都会检查当前容量和价格。一次已接受运行的小时费率在 该运行周期内固定;结束后不会自动继承旧报价。

如何联系支持​

提交以下信息,不要提交密码、API key、Provider 凭据、提示词或响应正文:

  • 组织名;
  • Endpoint ID 和名称;
  • 页面显示的状态;
  • 最近事件及时间;
  • 请求 ID 或 Studio run ID;
  • 浏览器截图和可复现步骤。

7. 上线前检查清单​

客户​

  • 账号和组织正确,成员角色符合预期。
  • Offer 的模型、区域、数据边界、容量类型和价格已确认。
  • Endpoint 为 Ready,Studio 测试成功。
  • API key 已存入 Secret Manager,未写入源码或聊天记录。
  • 应用使用 Endpoint 显示的精确模型标识。
  • 月度预算、余额和通知已配置。
  • 明确 Suspend、Resume、Restart、Delete 的计费和清理影响。

Operator​

  • Provider 凭据和资源身份彼此独立,连接测试通过。
  • Offer 绑定不可变模型、Runtime Release 和 Execution Variant。
  • Candidate 静态兼容、实时可用性和成本 guardrail 均有证据。
  • 真实认证有显式批准和预算上限。
  • 模型加载、网关、请求和永久清理证据完整。
  • 客户价格、毛利、数据边界和市场类型正确。
  • 发布后客户目录可见,未发布 Draft 不可购买。
  • 事故、清理和付费创建的停止条件已明确。

8. 当前产品边界​

以下能力不是当前客户自助承诺:

  • 原始 GPU、VM、SSH 或 Provider Console 访问;
  • 客户自行修改 dstack、Runtime 镜像或 Provider 凭据;
  • 未经认证的自动硬件或 Provider 回退;
  • 把过期、未知或缺失容量证据当作可用;
  • 把 Provider 实例创建成功当作 Endpoint Ready;
  • 未经明确批准启动真实 GPU 认证;
  • 跨组织共享 API key、Endpoint、账单或运行数据。

平台会继续扩展 Provider、Runtime 和服务类型,但客户的稳定对象仍是 Endpoint。新增 Provider 不应要求客户改变应用接入方式,也不能改变现有 Verda 或 Nebius 的独立凭据、 库存、资源身份和清理边界。

9. 截图说明​

本手册截图来自公网页面或真实 E2E/浏览器回归证据。截图用于解释操作位置和状态语义; Offer 名称、客户名称、价格、区域、时间和容量状态可能随环境变化。涉及付费、数据边界 或可用性的决策,应始终以当前页面及最终确认对话框为准。