CNCF(Cloud Native Computing Foundation,云原生计算基金会)是 Linux Foundation 旗下的非营利组织,致力于推动云原生计算普及,并支持 Kubernetes、Prometheus 等开源项目的发展。CNCF 为托管项目提供社区资源和支持,但各项目仍由自己的维护者和社区按照既有治理方式独立运作,并非基金会统一开发的一套产品。更多信息可参阅CNCF 官方介绍和常见问题。
项目成熟度分为三档:**Graduated(毕业)**代表项目已达到 CNCF 的成熟度要求;**Incubating(孵化中)**表示项目已进入持续治理和生产采用阶段;**Sandbox(沙箱)**用于较早期的项目。成熟度是治理和社区信号,不是功能、性能或受欢迎程度的排名。下文按分类挑选有代表性的 CNCF 托管项目,不是完整名单;各分类纳入的项目数量会因托管项目数量和领域发展情况而不同,不刻意凑成相同数量,也不代表热度排名。
应用定义与开发(App Definition and Development)
这一类覆盖应用打包、构建、交付、服务开发框架和数据基础组件。
| 子领域 | CNCF 托管项目 | 主要用途 |
|---|---|---|
| 应用定义与交付 | Helm(毕业)、Argo(毕业)、Flux(毕业)、KubeVela(孵化中) | Helm 管理 Kubernetes 应用包;Argo 和 Flux 提供 GitOps 与持续交付;KubeVela 把应用交付抽象成更高层的应用模型 |
| 镜像构建 | Buildpacks(2026 年 7 月毕业) | 从源代码构建可移植的 OCI 镜像,减少手工维护 Dockerfile 的工作 |
| CI/CD | Tekton(孵化中) | 用 Kubernetes 原生资源定义可组合的构建与交付流水线 |
| 应用运行框架 | Dapr(毕业) | 通过 API 和 sidecar 提供服务调用、状态、发布订阅等分布式应用能力 |
| 开发者门户 | Backstage(孵化中) | 构建内部开发者门户和软件目录 |
| 虚拟机工作负载 | KubeVirt(孵化中) | 在 Kubernetes 上定义和管理虚拟机 |
| 消息系统 | NATS(孵化中) | 提供轻量消息传递、请求响应和流式消息能力 |
| 数据库 | TiKV(毕业)、Vitess(毕业) | TiKV 是分布式事务键值存储;Vitess 为 MySQL 提供水平扩展和集群管理能力 |
Argo 和 Flux 都能实现 GitOps,但资源管理和工作流方式不同;Tekton 是流水线框架。先看团队已有的发布流程,再决定是否需要同时引入多套工具。
编排与管理(Orchestration & Management)
这是 Kubernetes 周边项目最集中的分类,覆盖集群调度、服务发现、RPC、代理和服务网格。
- 调度与编排:Kubernetes(毕业)负责容器编排;Karmada(2026 年 9 月毕业)管理多集群和多云工作负载;Volcano(孵化中)面向批处理、AI 和高性能计算任务。
- 服务发现与协调:CoreDNS(毕业)是 Kubernetes 常用 DNS 服务;etcd(毕业)提供一致性键值存储,也是 Kubernetes 控制面的关键状态存储。
- 远程过程调用:gRPC(孵化中)提供跨语言 RPC 框架和协议。
- 代理与服务网格:Envoy(毕业)是云原生服务代理;Contour(孵化中)是基于 Envoy 的 Kubernetes Ingress 控制器;Istio和Linkerd(均已毕业)在 Kubernetes 上提供服务间流量、安全和遥测治理。
资源供给与安全(Provisioning)
这一类关注基础设施控制、网络、边缘计算、镜像仓库、策略、证书和工作负载身份。
- 基础设施编排与治理:Crossplane(2025 年 10 月毕业)以 Kubernetes API 构建声明式云资源控制平面;Cloud Custodian(孵化中)用策略规则治理云资源、安全和成本。
- 云原生网络:Container Network Interface(CNI)(孵化中)定义容器运行时与网络插件之间的接口;Cilium(毕业)基于 eBPF 提供 Kubernetes 网络、安全策略和网络可观测能力。
- 边缘计算:KubeEdge(毕业)把 Kubernetes 的应用编排能力扩展到边缘节点。
- 镜像仓库与分发:Harbor(毕业)管理私有镜像、权限和签名;Dragonfly(2025 年 10 月毕业)通过 P2P 分发加速镜像和其他制品。
- 运行时安全:Falco(毕业)根据内核事件检测容器和云原生环境中的异常行为;KubeArmor(Sandbox)为 Kubernetes 工作负载提供运行时安全观测与策略执行。
- 策略治理:Kyverno(2026 年 3 月毕业)以 Kubernetes 原生方式编写和执行策略;Open Policy Agent(OPA)(毕业)提供通用策略引擎。
- 证书与工作负载身份:cert-manager(毕业)自动签发和续期证书;SPIFFE和SPIRE(均已毕业)为工作负载建立可验证身份。
运行时(Runtime)
运行时分类包括容器运行时和云原生存储。
- 容器运行时:containerd和CRI-O(均已毕业)实现容器镜像与容器生命周期管理;CRI-O 专注于 Kubernetes 的容器运行时接口。
- 存储编排:Rook(毕业)通过 Kubernetes Operator 管理存储系统;Longhorn(孵化中)提供 Kubernetes 分布式块存储;CubeFS(毕业)提供分布式文件和对象存储。
可观测性与分析(Observability and Analysis)
CNCF 托管项目覆盖指标、遥测规范、Tracing、日志采集、混沌工程和特性开关。
- 指标和告警:Prometheus(毕业)是云原生指标采集、查询和告警系统;OpenCost(孵化中)分析 Kubernetes 资源使用和成本分摊。
- 遥测规范:OpenTelemetry(2026 年 5 月毕业)提供采集 traces、metrics 和 logs 的通用 API、SDK、协议与工具。
- 分布式追踪:Jaeger(毕业)用于追踪和排查分布式请求。
- 日志采集:Fluentd和Fluent Bit(均已毕业)负责收集、处理和转发日志数据。
- 指标长期存储:Thanos(孵化中)扩展 Prometheus 的高可用和长期存储能力。
- 混沌工程:Litmus(孵化中)和ChaosBlade(Sandbox)通过可控故障实验验证系统韧性。
- 特性开关规范:OpenFeature(孵化中)提供供应商无关的特性开关 API 和 SDK 规范。
平台(Platform)
Landscape 的 Platform 分类以 Kubernetes 发行版、托管服务和平台产品为主,其中不少条目是厂商产品,并非 CNCF 托管项目。可关注 CNCF Sandbox 项目 Cozystack,它用于在裸金属基础设施上构建私有云和托管服务。
Serverless
这一类关注事件驱动应用、按需运行和自动扩缩容。
- Knative(2025 年 9 月毕业)提供 Kubernetes 上的 Serverless 应用层,包含请求驱动的服务和事件处理能力。
- KEDA(毕业)根据队列、流和外部指标驱动 Kubernetes 工作负载扩缩容。
- Dapr(毕业)也被 Landscape 交叉列在 Serverless 路径中,可作为构建分布式应用的运行时积木。
Wasm
Wasm 分类围绕运行时和应用编排。CNCF 托管项目中,WasmEdge Runtime(Sandbox)是面向云原生和边缘场景的 WebAssembly 运行时;wasmCloud(孵化中)提供构建和运行分布式 Wasm 应用的平台;SpinKube(Sandbox)把 Spin 应用接入 Kubernetes 编排。
Data
Data 分类里 CNCF 托管项目不多,但有几个代表项目值得了解:TiKV(毕业)提供分布式事务键值存储;Vitess(毕业)面向 MySQL 水平扩展;Fluid(孵化中)管理 Kubernetes 环境中的弹性数据访问和缓存加速。其他常见数据项目即使出现在 Landscape 中,也不一定属于 CNCF 托管项目。
AI Agent
目前 CNCF 托管项目中,kagent(Sandbox)是这个分类下值得关注的代表。它让平台和运维团队可以在 Kubernetes 中运行 AI Agent,用于了解、安装、配置和排查云原生项目。kagent 在 Landscape 中也出现在 Provisioning 路径。
AI Native Infra
AI Native Infra 关注模型服务、GPU 资源调度和推理工作负载编排,是近年增长很快的一类。
- 模型服务:KServe(孵化中)为 Kubernetes 上的预测式和生成式模型提供统一部署接口;llm-d(Sandbox)面向 Kubernetes 上的分布式大模型推理与调度;KAITO(Sandbox)简化 Kubernetes 上的模型推理和调优工作流。
- 资源与作业调度:Volcano(孵化中)支持批处理和 AI/HPC 作业队列;HAMi(2026 年 7 月进入孵化)提供异构 AI 计算虚拟化;KAI Scheduler(Sandbox)聚焦 Kubernetes 集群的 GPU 资源调度;Karmada(毕业)可跨集群编排 AI 工作负载。
小规模模型部署可以先从 KServe 或单集群方案开始。只有遇到 GPU 争用、多集群调度或分布式推理瓶颈时,再增加调度和推理编排组件。
Special:认证与服务伙伴
Special 主要收录 Kubernetes 一致性认证、服务提供商、培训伙伴和云原生网络功能认证。它是认证与服务目录,不是 CNCF 托管软件项目类别,因此本文不把其中的厂商产品列入项目清单。
怎么按成熟度做初筛
- 想优先采用成熟且有广泛生产使用的项目,可从毕业项目开始评估,例如 Kubernetes、Prometheus、OpenTelemetry、containerd、Argo、Flux 和 Cilium。
- 孵化项目已进入 CNCF 治理和社区发展流程,但选型时仍要评估版本节奏、兼容性和维护能力,例如 NATS、Longhorn、KServe 和 Volcano。
- Sandbox 项目适合关注新方向或做验证;上线前要额外评估项目活跃度和自身承接维护的能力,例如 kagent、llm-d 和 WasmEdge。
CNCF 托管状态能帮助判断项目治理成熟度,但不能替代架构适配、生产验证和运维评估。先按分类找到候选,再结合团队已有平台选出实际需要的组件。