小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
How to Build Kubernetes Operators: A Handbook for Devs

Kubernetes ships with controllers that manage a fixed set of built-in resources: Deployments, Services, Nodes, and so on. An operator extends the same pattern to resources Kubernetes doesn't know abou

How to Build Kubernetes Operators: A Handbook for Devs

freeCodeCamp.org
freeCodeCamp.org · 2026-07-29T14:11:02Z
Welcome CoHDI to the CNCF: Evolving Kubernetes into composable disaggregated infrastructures

We are thrilled to announce that CoHDI has officially been accepted as a Cloud Native Computing Foundation (CNCF) Sandbox project! This acceptance into the CNCF Sandbox marks an important...

Welcome CoHDI to the CNCF: Evolving Kubernetes into composable disaggregated infrastructures

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-29T00:00:00Z

Every multi-region setup eventually meets the same awkward moment: a whole cluster goes away, and the identical copy of your service running two regions over might as well not exist, because...

Federating clusters for zero-downtime Kubernetes

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-27T11:00:00Z

nodeSelector 是什么:它如何在 kube-scheduler 的 Filter 阶段用节点标签硬约束落点,与 nodeAffinity、taint/toleration、topologySpread 的职责边界,以及 Pending 与过度约束的常见踩坑。

【Kubernetes 网络深度系列】nodeSelector 与节点放置:Filter、亲和性与拓扑打散

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-27T00:00:00Z

Amazon EKS has recently introduced support for Kubernetes version rollbacks, letting practitioners revert a cluster's control plane to its previous Kubernetes version within 7 days of an upgrade...

Amazon EKS Adds Kubernetes Version Rollback within 7 Days of an Upgrade

InfoQ
InfoQ · 2026-07-26T06:04:00Z
When Kubeflow meets Cilium: Debugging 60% idle GPUs in Kubernetes

The symptom that made no sense The first time we saw it, we didn’t trust the dashboard. A distributed training job was scheduled and healthy — every pod was running, no crashes, no OOMKills, nothing in...

When Kubeflow meets Cilium: Debugging 60% idle GPUs in Kubernetes

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-23T11:33:00Z
How to Build Kubernetes Networking Without Kubernetes: Do What the CNI Does By Hand

In this article, you'll build an accurate mental model of what a Container Network Interface (CNI) actually does. Not by reading YAML, but by doing every single step it does by hand with raw Linux ker

How to Build Kubernetes Networking Without Kubernetes: Do What the CNI Does By Hand

freeCodeCamp.org
freeCodeCamp.org · 2026-07-22T23:15:29Z
Multi-Cluster databases on Kubernetes: Architecture and deployment

Introduction Running a database on Kubernetes is well understood. Running one that survives a complete regional failure, a corrupted control plane, or a severed network requires a fault-resistant...

Multi-Cluster databases on Kubernetes: Architecture and deployment

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-22T11:42:00Z

1. 磁盘处理 1.1 查看磁盘 查看新磁盘 1 fdisk -l Disk /dev/nvme1n1: 3.91 TiB, 4294967296000 bytes, 8388608000 sectors 1.2 组建 RAID0 如果有多块小盘,更好的方式是组建一个 RAID0,这样不仅能获得更大的存储目录,还能获得更快的速度。 创建 RAID 1 mdadm --create...

如何添加 Huawei NPU 节点到 Kubernetes 集群

陈少文的博客
陈少文的博客 · 2026-07-22T00:00:00Z
Kubernetes made deploying easy. Nobody warned you about the databases.

The DevOps movement, set in motion nearly 20 years ago, broke down the traditional divide between software developers and IT The post Kubernetes made deploying easy. Nobody warned you about the...

Kubernetes made deploying easy. Nobody warned you about the databases.

The New Stack
The New Stack · 2026-07-21T15:00:00Z
Self-healing GPU nodes in Kubernetes: What we learned building the EKS node monitoring agent

When you run Kubernetes at the scale we do on Amazon EKS, nodes break constantly. GPUs fall off the PCIe The post Self-healing GPU nodes in Kubernetes: What we learned building the EKS node...

Self-healing GPU nodes in Kubernetes: What we learned building the EKS node monitoring agent

The New Stack
The New Stack · 2026-07-19T13:00:00Z

kubernetes-goat学习笔记

像清水一般清澈透明
像清水一般清澈透明 · 2026-07-18T08:05:58Z
从意图到执行:在大规模操作 Kubernetes 控制器的经验教训

Kubernetes 控制器在 Amazon EKS 中管理网络流量和安全组。网络策略控制器决定 Pod 之间的通信,而 VPC 资源控制器分配安全组以控制对 AWS 资源的访问。随着集群规模扩大,控制器的内存占用和正确性变得至关重要,优化策略需确保状态完整,避免在不完整状态下执行不可逆操作。

从意图到执行:在大规模操作 Kubernetes 控制器的经验教训

The New Stack
The New Stack · 2026-07-17T12:00:00Z
云原生计算基金会与博通加强合作,成为铂金会员以推动AI就绪的云原生基础设施

博通公司将其在云原生计算基金会(CNCF)的会员等级提升至铂金,进一步承诺支持开源创新和云原生技术。博通向CNCF沙箱贡献了Kubernetes原生备份和迁移平台Velero,旨在帮助企业在AI时代构建弹性基础设施。该公司在CNCF生态系统中长期积极参与,并在Kubernetes项目中贡献突出。

云原生计算基金会与博通加强合作,成为铂金会员以推动AI就绪的云原生基础设施

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-16T16:00:00Z
在Kubernetes中使用vLLM运行自托管的大型语言模型(LLM)

本文介绍了在Kubernetes环境中自托管大型语言模型(LLM)的设置,使用vLLM作为推理引擎,LINSTOR提供持久存储。自托管可降低成本、提高控制力,并满足数据合规要求。通过创建持久卷声明和密钥,部署vLLM推理服务器,确保模型权重缓存以加快重启速度,支持高并发请求,适合混合AI应用。

在Kubernetes中使用vLLM运行自托管的大型语言模型(LLM)

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-16T11:00:00Z
Kubernetes赢得了容器的十年。谷歌的Agent Substrate希望赢得下一个十年。

谷歌在2026年推出了GKE Agent Sandbox和Agent Substrate,以解决Kubernetes在AI代理管理中的不足。Agent Sandbox为代理提供安全的运行环境,而Agent Substrate优化调度,避免Kubernetes控制平面成为瓶颈。这两个项目共同提升了代理的性能和安全性,更适合处理短暂的、状态保持的会话。

Kubernetes赢得了容器的十年。谷歌的Agent Substrate希望赢得下一个十年。

The New Stack
The New Stack · 2026-07-15T18:17:02Z
HAMi成为CNCF孵化项目

HAMi被CNCF技术监督委员会接受为孵化项目,旨在解决Kubernetes中的异构加速器资源调度问题。该项目提供开源的GPU虚拟化中间件,支持多种设备,促进了社区的快速发展。项目已发布多个版本,吸引了大量贡献者和用户,未来将继续扩展功能和设备支持。

HAMi成为CNCF孵化项目

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-15T16:00:00Z
2026年本地数据库即服务(DBaaS):平台、标准与差距

到2026年,尽管平台工程和Kubernetes的采用有所进展,但数据库供应仍然分散。开发团队在自主管理与依赖平台之间面临权衡。目前的解决方案缺乏标准化,导致重复构建相似的数据库即服务(DBaaS)能力。因此,需要一个统一的标准,以简化跨环境的数据库管理和自助服务体验。

2026年本地数据库即服务(DBaaS):平台、标准与差距

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-15T11:00:00Z
HAMi社区演变:当AI编写代码时,开源社区的价值何在?

HAMi的成长故事探讨了在AI编程时代开源社区的价值。HAMi是Kubernetes的GPU虚拟化和共享中间件,经历了从2021年开源到2024年CNCF沙箱,再到2026年CNCF孵化的演变。尽管AI降低了代码生产成本,但共识的建立成本未减,开源社区的护城河正从代码生产转向共识与信任。

HAMi社区演变:当AI编写代码时,开源社区的价值何在?

云原生
云原生 · 2026-07-15T09:17:07Z
Kueue + HAMi vGPU 实战:显存与算力配额管理

本文讨论了Kueue与HAMi vGPU的结合,重点在于GPU显存和算力配额的管理。通过环境准备、资源模型和演示,展示了在Kubernetes中有效切分和管理GPU资源的方法,确保多个任务合理使用GPU,避免资源冲突,实现GPU集群的多租户管理能力。

Kueue + HAMi vGPU 实战:显存与算力配额管理

探索云原生
探索云原生 · 2026-07-14T22:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码