全部资讯

重置筛选
Kubernetes
Kubernetes
Kubernetes v1.36:云控制器管理器中的路由同步新指标

本文最初发布时日期有误。后来重新发布,日期为 2026 年 5 月 15 日。 Kubernetes v1.36 在位于 k8s.io/cloud-provider 的云控制器管理器(CCM)路由控制器实现中引入了一个新的 Alpha 计数器指标 route_controller_route_sync_total。此指标在每次与云提供商同步路由时递增。 基于监视的路由调谐的 A/B 测试 添加此指标是为了帮助运维人员验证在 Kubernetes v1.35 中引入的 CloudControllerManagerWatchBasedRoutesReconciliation 特性门控。 此特性门控将路由控制器从固定间隔循环切换为基于监视的方法,仅在节点实际发生变化时进行调谐。 这减少了对基础设施提供商的不必要 API 调用,降低了速率限制 API 的压力, 并允许运维人员更高效地使用其可用配额。 要对此进行 A/B 测试,请比较特性门控禁用(默认)与启用时的 route_controller_route_sync_total。 在节点变化不频繁的集群中,开启特性门控后,你应该会看到同步速率

Kubernetes
Kubernetes
Kubernetes v1.36:混合版本代理升级到 Beta

早在 Kubernetes 1.28 中, 我们在之前的博客文章中引入了 Mixed Version Proxy (MVP) 作为 Alpha 特性(在特性门控 UnknownVersionInteroperabilityProxy 下)。 目标简单但关键:通过确保对旧版 API 服务器尚不了解的资源请求被正确路由到较新的对等 API 服务器, 而不是返回不正确的 404 Not Found,从而使集群升级更安全。 我们很高兴地宣布,Mixed Version Proxy 将在 Kubernetes 1.36 中升级到 Beta 版本, 并将默认启用!该特性自首次发布以来有了显著发展,解决了关键差距并实现了架构现代化。 以下介绍该特性的发展历程以及在集群中使用它需要了解的内容。 我们正在解决什么问题? 在正在升级的高可用控制平面中,你通常会有运行不同版本的 API 服务器。 这些服务器可能提供不同的 API 集(Groups、Versions、Resources)。 没有 MVP,如果客户端请求落在不提供所请求资源的 API 服务器上(例如,升级中引入的新 API 版本), 该服务器会

Kubernetes
Kubernetes
Kubernetes v1.36:Service ExternalIPs 的弃用和移除

Service 的 .spec.externalIPs 字段是为非云集群提供类似云负载均衡器功能的早期尝试。 不幸的是,该 API 假设集群中的每个用户都是完全可信的, 而在任何不满足此条件的情况下,它会导致各种安全漏洞, 如 CVE-2020-8554 中所述。 自 Kubernetes 1.21 起,Kubernetes 项目建议所有用户禁用 .spec.externalIPs。 为了简化这一过程,Kubernetes 还添加了一个准入控制器(DenyServiceExternalIPs), 可以启用它来实现此目的。当时,SIG Network 认为默认阻止该特性是一个太大的破坏性变更,不予考虑。 然而,安全问题仍然存在,作为一个项目,我们对该特性"默认不安全"的状态越来越不满意。 此外,对于想要类似负载均衡器功能的非云集群,现在有几种更好的替代方案。 因此,Service 的 .spec.externalIPs 字段现在在 Kubernetes 1.36 中正式弃用。 我们预计 Kubernetes 的未来次要版本将从 kube-proxy 中删除该行为的实现, 并更新 Kube

Kubernetes
Kubernetes
Kubernetes v1.36:工作负载感知调度再进一步

AI/ML 和批处理工作负载带来了独特的调度挑战,已经超出了简单逐个 Pod 调度的范畴。 在 Kubernetes v1.35 中,我们引入了首批工作负载感知调度改进, 其中包括基础性的 Workload API、基于 Pod 框架构建的基本编组调度支持, 以及用于高效处理相同 Pod 的机会性批处理特性。 Kubernetes v1.36 通过清晰分离 API 关注点,引入了一项重要的架构演进: Workload API 充当静态模板,而新的 PodGroup API 负责处理运行时状态。 为了支持这一点,kube-scheduler 提供了新的 PodGroup 调度周期, 支持以原子方式处理工作负载,并为未来增强铺平道路。 此版本还首次推出了拓扑感知调度和工作负载感知抢占的初始迭代,以推进调度能力。 此外,工作负载的 ResourceClaim 支持为 PodGroup 解锁了动态资源分配 (DRA)。 最后,为了展示其面向真实场景的就绪程度,v1.36 交付了 Job 控制器与新 API 集成的第一阶段。 Workload 和 PodGroup API 更新 Workload