Azure API Management Standard v2 新增区域冗余,起价 700 美元/月
微软为 Azure API Management Standard v2 引入区域冗余功能,支持跨可用区部署与自动故障恢复,起步价 700 美元/月,但 SLA 为 99.95%,且需新建实例才能启用。
区域冗余下放至 Standard v2
微软近期为 Azure API Management 的 Standard v2 层级加入了区域冗余能力,将原本属于 Premium 层级的可用区支持扩展至 v2 产品线。这一变更由 Sreekanth Thirthala 对外公布,核心变化在于价格门槛的降低。区域冗余指在支持的区域内把服务容量分散到多个可用区,由平台统一负责容量分配、运行状况监控与故障恢复,用户无需自行管理底层容灾逻辑。官方强调,启用后无需升级至企业级套餐即可获得抵御数据中心级故障的防护能力。
可用区支持并非首次出现。去年 12 月 Premium v2 正式发布时,该能力已随入站 Private Link 和自定义 CA 证书一同推出。本次更新主要围绕定价展开,使 Standard v2 用户也能以更低成本获得跨可用区部署能力。
成本与 SLA 的权衡
价格是最直观的对比维度。Standard v2 单个单元起步价为每月 700 美元,Premium v2 为 2801 美元,经典版 Premium 为 2795 美元。但 SLA 层面存在差异:两个 Premium 层级均提供 99.99% 的 SLA,微软定价页面脚注说明该指标的前提是至少将一个单元部署在两个及以上可用区或区域。Standard v2 的 SLA 为 99.95%。这意味着,若要在 Standard v2 上达到 Premium 对应的 SLA 要求,需要部署两个单元,同等条件下成本约为每月 5600 美元,不过二者所保障的服务能力并不对等。
另一个关键限制在于部署时机。微软最有价值专家、Azure 集成架构师 Stephen W. Thomas 在回应公告时指出:无法在现有 APIM 实例上启用区域冗余,该功能必须在创建新的 Standard v2 实例时进行配置。微软文档显示,Premium v2 也存在同样限制。对于已在运行 Standard v2 的团队而言,这意味着需要新建实例,并重新导入 API 和策略、迁移自定义域名和证书、重新指向 DNS,以及处理订阅密钥。
微软的 API Management 可靠性指南尚未同步更新,文档依旧写明必须使用 Premium(经典版)或 Premium v2 层级来配置可用性区域支持,且 Basic v2 和 Standard v2 不支持可用性区域。经典版 Premium 的行为有所不同:在支持可用区的区域新建实例时,可用区功能会自动启用,同时也可在已有实例上配置,无需停机,更改在 15 到 45 分钟内生效,期间网关可持续处理请求。代价是寻址问题——更改现有 Premium 实例的可用性区域配置会改变公共虚拟 IP 地址,内部虚拟网络模式下私有 VIP 也会改变。微软列出需要更新的项目包括 DNS 记录、私有 DNS 区域、防火墙规则、访问白名单、路由规则以及应用网关后端设置。两种方案均存在运维工作量:v2 版本需要重建实例,经典版 Premium 则会变更底层寻址,所有依赖该实例的组件都会受到影响。
机制细节与功能取舍
区域冗余机制并不要求配置两个扩展单元。根据微软可靠性文档,自动可用区支持会将单个单元内部的两套计算资源分别部署到两个可用区,在区域中断期间预计不会停机,因为未受影响的区域中的资源会继续工作。部署两个单元是 Premium 版本达到 99.99% SLA 的前提条件,并非实现跨可用区分布本身的硬性要求。
该功能不保证容量。微软声明,当某可用区故障时,无法保证在其他可用区扩容的请求能够成功,对故障损失单元的补容仅尽最大努力执行,建议需要保证容量的团队进行超额配置。同时存在一定的数据丢失风险:配置变更跨可用区复制大约存在 10 秒时延,尚未完成复制的变更可能丢失;内部缓存数据是非持久化的,故障期间可能丢失;限流计数器在存活可用区中也可能出现数据不一致。
正在评估从 Premium 版本降级的团队需要确认还会丧失哪些功能。定价表标明,多区域部署、自托管网关、虚拟网络注入、多自定义域名以及工作空间均属于 Premium 专属能力,Standard v2 并不支持。Standard v2 虽然提供虚拟网络集成,允许实例访问部署在关联虚拟网络内的后端服务,但不支持虚拟网络注入,而注入可以实现入站与出站流量的完全隔离。
请求量计费指标也有所不同。Standard v2 每月包含 5000 万次 API 请求,额外请求按每百万次 2.50 美元计费,内置缓存为 1 GB。Premium v2 包含无限请求和 5 GB 缓存。横向扩容成本方面,Standard v2 为每个额外单元 500 美元,Premium v2 为 1401 美元。
微软将本次发布的部分内容围绕 AI 工作负载进行宣传,指出如今 API 越来越多地连接模型、智能体、业务系统和数据平台,API 层的停机会直接影响应用程序可用性。启用区域冗余是创建实例时的一项门户配置选项:选择 Standard v2,挑选支持可用区的区域,在可用区配置板块打开区域冗余开关,之后再执行审阅并创建。公告没有说明该功能是正式发布还是预览版,也没有列出支持的区域。当 Premium v2 在 12 月正式发布时,它在六个公共区域可用,官方表示后续会新增更多区域。
Thomas 提供了实用建议:如果正在规划高可用的 APIM 部署,在默认选择更高层级之前,先比较 Standard v2 和 Premium。微软官方的建议则是审视整体弹性架构,包括后端冗余、流量管理和容灾恢复需求,而不能仅依靠网关的区域冗余就认为高可用已经足够。
趋势观察
此次调整反映出云厂商正在将高可用能力逐步下沉至中端产品线,以更低价格吸引对容灾有需求但预算有限的团队。然而,SLA 差异、实例重建限制以及功能取舍意味着选型并非简单的价格比较。对于 API 平台工程师和 SRE 而言,在成本与弹性之间做出决策时,需要综合评估现有架构、迁移成本以及业务对停机时间的容忍度。区域冗余提供了多可用区部署的入口,但完整的容灾体系仍依赖后端冗余、流量调度与数据一致性策略的协同。