当 Omnissa Horizon Cloud Service 发生故障时,预计该故障可能会影响您的部署。
您可以在 https://status.workspaceone.com 中检查 Horizon Cloud Service 的状态。
在部署 Horizon Cloud 时,应仔细考虑灾难恢复规划。 如需了解相关信息,请参阅为 Horizon 提供灾难恢复和容量提供程序。
下图提供了 Horizon Cloud 部署方式的概览。该图包含构成部署的一些关键组件,并提示特定组件发生故障可能会产生的影响。

有关 Horizon Cloud 架构及其组件的更多信息,请参阅 Horizon Cloud 架构。
有关 Omnissa 服务级别协议 (Service Level Agreement, SLA) 的信息,请参阅 Omnissa 服务级别协议。
以下关键故障场景提供了有关每种故障类型的潜在影响的一些详细信息。
授权、管理和代理功能故障
Horizon Cloud 向用户和管理员提供三项关键功能:授权、管理和代理。如果其中任何功能已降级或不可用,则可能表示特定区域中的 Horizon Cloud 组件出现问题。
对于 Horizon Cloud,灾难恢复是 Omnissa 与客户的共同职责。如需了解相关信息,请参阅灾难恢复共同职责。
| 函数 | 范围 | 恢复 |
|---|---|---|
| 授权 | 全局分布 — 实例分布在美国、欧盟和日本 | 自动 — 请求会重新路由到可用区域 |
| 管理 | 全局 — 在每个区域内执行部署和配置;某个区域的故障仅影响该区域 | 区域功能恢复后自动执行 |
| 代理 | 区域 — 范围仅限于资源所在的区域 | 需要恢复区域功能 |
授权
通过授权功能,最终用户可以使用配置的身份提供程序登录,并查看他们有权访问的桌面和应用程序。授权以全局方式运行,实例分布在多个地理区域(美国、欧盟和日本),以便在一个区域不可用时,请求会自动由另一个区域处理。
如果用户遇到登录问题或无法查看其授权,则可能表明特定区域中的授权功能已降级。
- 连接到虚拟桌面的现有活动会话不受影响。
- Horizon Cloud 会自动将新的登录请求定向到其他区域中的可用功能。
- 只要授权功能在至少一个区域中可用,用户便可以继续登录和查看其授权。
管理
通过管理功能,管理员可以部署基础架构、创建和更新桌面池、分配授权,以及管理 Active Directory (AD)、Edge 网关、Unified Access Gateway (UAG) 和池等资源。管理操作的范围仅限于资源所在的区域。每个区域的置备功能拥有为其本地 Edge 和容量提供程序部署和配置基础架构所需的上下文知识,因此,如果该区域变得不可用,这些操作将无法自动重新路由到另一个区域。
如果管理员在特定区域中部署资源或更改配置时遇到问题,则可能表示该区域中的置备功能不可用。
- 管理更改仍可通过 Horizon Universal Console 提交,并记录为预期状态,而无需重新提交。
- 需要在受影响区域中执行的更改(例如置备新池、部署 UAG 或更新基础架构)不会立即生效。该区域中的置备功能回复后,将自动接受并处理这些请求。
- 在功能恢复之前,管理员对受影响区域中的资源进行管理、监控或故障排除的能力可能受到限制。其他区域中的管理操作不受影响。
代理
通过代理功能,用户可以选择授权并连接到其桌面或已发布的应用程序。代理功能按区域运行;每个地理区域对位于其中的资源运行自身的代理功能。与授权不同,如果本地代理功能变得不可用,则无法自动将代理请求重新路由到另一个区域。
如果用户无法对特定区域中的资源启动会话,则可能表示该区域中的代理功能不可用。
- 现有活动会话将继续运行而不受影响。
- 在受影响区域中的代理功能恢复之前,对该区域中的资源启动新会话将失败。
- 如果您为浮动池组配置了多个区域中的池,Horizon Control Plane 会自动通过代理连接到可用区域中的桌面。
容量提供程序故障
容量提供程序是受支持的 Hypervisor 或云平台,可提供资源容量以交付桌面和应用程序。任何容量提供程序发生故障都会产生一些共同的影响。
对用户访问的影响:
- 用户无法在受影响的提供程序中访问其虚拟桌面和已发布的应用程序。
- 活动会话断开连接。
- 新会话启动失败。
- 在其他提供程序中拥有资源的用户仍可继续访问。
对管理的影响:
- 无法置备新的桌面池或 RDSH 场。
- 无法修改现有桌面分配。
- 其他提供程序仍可管理。
影响范围和您的职责因提供程序类型而异:
云原生提供程序
云提供程序管理底层基础架构。您无法直接控制或修复基础架构问题。对于云原生提供程序,容量由云基础架构服务 API 管理,通过这些 API,可以对服务中的资源执行各项操作。
由云提供程序管理的基础架构:
- 存储和计算容量分配。
- 硬件故障和更换。
- 网络基础架构和负载均衡器。
- 区域数据中心操作。
您的职责:
- 构建多区域冗余(如果需要高可用性)。
- 根据需要监控消耗和请求配额增加。
数据中心提供程序(内部部署)
您负责所有基础架构管理和容量规划。对于数据中心提供程序,容量由 Hypervisor 管理器(例如,VMware vCenter、Nutanix Prism 或 OpenStack Nova)管理,通过该管理器,可以对服务中的资源执行各项操作。
您必须管理的基础架构:
- 存储性能 - 降低会导致桌面引导时间延长和应用程序启动缓慢。
- 计算容量 - 耗尽会阻止新桌面置备和池扩展。
- 硬件故障 - 您必须维护和更换出现故障的组件。
- 网络基础架构 - 发生故障会断开用户与资源的连接。
- 灾难恢复 - 您必须实施备份和灾难恢复策略。
- 单个虚拟机故障 - 您负责保持足够的容量和冗余。
云电脑提供程序
云电脑提供程序包括 Amazon WorkSpaces Core 和 Microsoft Windows 365。通过这些提供程序,Cloud Service 可以代表客户管理虚拟桌面服务。这些部署的 Horizon Edge Gateway 和 Unified Access Gateway 在底层基础架构服务(对于 Amazon WorkSpaces Core 为 Amazon EC2,或对于 Windows 365 为 Microsoft Azure)上运行,但最终用户桌面虚拟机作为云电脑服务本身的一部分单独进行托管和管理。
Horizon Edge Gateway 和 UAG 组件会保持联机状态并完全正常运行,而不依赖于云电脑服务的运行状况,同时云电脑服务也不依赖于 Horizon Edge 的可用性。
如果云电脑服务已降级或不可用,则可能会出现以下一种或两种情况:
- 云电脑服务提供的最终用户桌面虚拟机无法访问或无法启动,即使周围的 Horizon Edge 基础架构显示没有问题也是如此。
- 在云电脑服务恢复之前,用户无法访问其虚拟桌面。
Horizon Edge Gateway 故障
Horizon Edge 部署在客户容量提供程序内的特定站点中。Horizon Edge 包含 Edge 网关和 Unified Access Gateway,以及用于映像、桌面和应用程序的可扩展计算容量,并且还包含所有组件进行通信所需的内部网络连接。
Horizon Edge Gateway 管理和监控 Unified Access Gateway,处理最终用户通过身份提供程序和目录服务进行的身份验证 (SSO),以及将资源监控数据从 Horizon 工作负载转发到 Omnissa Intelligence。Horizon Edge Gateway 发生故障会影响身份验证服务、监控数据中继和管理功能。
有关 Horizon Edge Gateway 的更多信息,请参阅 Horizon Edge。
对单点登录的影响:
- 最终用户失去 SSO 功能,必须手动输入凭据。
- 用户会遇到多个身份验证提示。
- 影响范围仅限于受影响的 Horizon Edge。
会话访问:
- 现有活动会话将继续而不中断。
- 新会话可成功启动,但需要输入凭据。
- 协议流量继续直接流经 UAG 设备。
监控和遥测:
- 来自受影响 Horizon Edge 的监控数据将停止流向 Omnissa Intelligence。
- 桌面运行状况将可见,但故障间隔期间的历史数据将丢失。
- 受影响资源的仪表板衡量指标将失效。
- 活动会话遥测信息将不可用。
管理:
- 受影响的 Horizon Edge 的管理功能会受到影响。
- 其他 Horizon Edge 仍然完全可管理。
Unified Access Gateway 故障
Omnissa Unified Access Gateway (UAG) 是虚拟设备,可提供从外部网络到内部 Horizon 资源(包括虚拟桌面和已发布的应用程序)的安全远程访问。它们通过在客户端设备和代理虚拟机之间代理 Horizon 显示协议,将经过身份验证的用户请求路由到相应的资源。UAG 由 Horizon Edge Gateway 部署在 Horizon Edge 内,且位于同一容量提供程序中。
外部访问:
- 外部用户无法连接到受影响的 Horizon Edge 中的内部资源。
- 连接到受影响的容量提供程序的用户将无法访问其 Horizon Cloud 虚拟桌面和 RDSH 场(基于会话的桌面和已发布的应用程序)。
- 外部用户的新会话启动失败。
- 通过出现故障的 UAG 设备进行的活动会话将断开连接。
内部访问:
- 内部用户可能会保持连接,具体取决于网络架构。
- 直接连接仍然可用(如果已配置)。
网络和连接故障
最终用户与 Horizon Cloud 环境之间的网络问题可能会导致服务部分或完全中断。常见的网络相关问题包括 DNS 解析失败、负载均衡器故障,以及阻止所需端口或协议的防火墙配置错误。
DNS 解析失败:
- 用户无法找到 Horizon 服务以启动连接。
- 连接尝试失败,并显示主机名解析错误。
- 可能会影响单个用户或整个站点,具体取决于 DNS 范围。
负载均衡器故障:
- 外部用户无法访问 UAG 设备。
- 连接尝试失败或挂起。
- 内部负载均衡器故障可能会影响内部连接。
防火墙或安全组配置错误:
- 连接失败或被拒绝。
- 空白屏幕或连接超时。
- 可能会影响特定端口或协议。
标识和身份验证系统故障
身份验证服务是 Horizon Cloud 的关键依赖项。Horizon Cloud 平台将用户身份与计算机标识分开,从而能够与客户管理的第三方身份提供程序 (Identity Provider, IdP) 集成,同时保持平台的安全性和功能。
有关更多信息,请参阅身份和访问管理。
身份提供程序不可用:
- 用户无法向 Horizon 服务进行身份验证。
- 登录尝试失败。
- 无法启动新会话。
- 活动会话将继续,但用户无法启动新会话。
目录服务基础架构故障:
- 计算机置备和域操作可能会失败。
- 用户身份验证可能会失败或降级。
- 无法应用策略实施和更新。
- 具体影响因身份验证基础架构中的冗余和缓存机制而异。
安全证书问题:
-
证书过期或无效:
- 过期或无效的证书会立即阻止用户身份验证并显示安全警告。
- 在续订证书之前,会话启动失败。
-
证书颁发机构 (Certification Authority, CA) 服务器不可用:
- 不影响使用现有的有效证书进行的身份验证。
- 阻止新证书颁发和续订操作。
- 必须进行主动的证书生命周期管理。
此页面对您有帮助吗?