2026年9月上旬,Kubernetes v1.37正式发布。在其官方博客关于DRA(动态资源分配,Dynamic Resource Allocation)的更新中,团队披露DRA的Extended Resource支持达成GA。对云原生基础设施的建设者而言,这是异构硬件在Kubernetes上走向规模化、可被生产使用的关键信号。本文从云原生基础设施视角,解读DRA的演进脉络与落地价值。
DRA是什么:从“静态配额”到“动态分配”
传统上,Kubernetes通过静态的Resource Request/Limit为容器预留资源,面对GPU、SR-IOV网卡、FPGA等异构专用硬件时往往力有不逮——这些设备需要更细粒度的生命周期管理(分配、挂载、回收)。DRA机制改变了这一局面,它让资源分配从“node上预留配额”演变为“按需声明并动态分配设备”,并由独立的资源插件负责设备的管理与回收,从而将异构硬件纳入统一调度语义。
Extended Resource迈向GA:稳定与兼容的承诺
本次DRA Extended Resource支持的GA,是DRA团队“连续三个版本持续推进”后达成的里程碑。GA意味着该能力的API与行为进入稳定状态,社区对其投入与运维兼容性有更明确的保障。对使用加速器与专用设备的团队而言,这降低了把异构资源调度能力引入生产的顾虑,也让补齐到GPU等头部场景的调度、分配与故障回收变得更有据可依。
v1.37的配套推进:多项特性同步晋级
除DRA外,v1.37整体延续了“多特性集中成熟”的节奏:一批此前处于Beta或Alpha的能力在本版晋级到Beta或GA,同时也有新的Alpha特性进入评估。官方博客建议集群维护者结合自身功能需求,查阅释放说明与特性达标表,规划版本升级与特性启用的节奏。对云原生团队,建议在测试集群先行验证DRA等对CNI、存储与调度器的兼容性,再逐步推向生产。
小结
DRA Extended Resource的GA,是Kubernetes把“异构资源调度”推向生产可用的一次重要晋级。对依赖GPU等专用硬件、又希望保有平台可移植性的云原生团队,这是值得持续跟进的关键能力更新。