小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
从意图到执行:在大规模操作 Kubernetes 控制器的经验教训

Kubernetes 控制器在 Amazon EKS 中管理网络流量和安全组。网络策略控制器决定 Pod 之间的通信,而 VPC 资源控制器分配安全组以控制对 AWS 资源的访问。随着集群规模扩大,控制器的内存占用和正确性变得至关重要,优化策略需确保状态完整,避免在不完整状态下执行不可逆操作。

从意图到执行:在大规模操作 Kubernetes 控制器的经验教训

The New Stack
The New Stack · 2026-07-17T12:00:00Z
从Kubernetes Dashboard迁移至Headlamp:一步一步的指南

Headlamp与Kubernetes Dashboard都是集群管理工具,但工作方式不同。Headlamp可在桌面或集群内运行,支持插件,并使用现有的kubeconfig连接集群,适合多集群操作,允许用户根据身份和RBAC权限访问资源。用户可以直接应用YAML,查看日志和资源使用情况,简化日常调试。迁移至Headlamp后,可移除Dashboard,减少冗余访问路径。

从Kubernetes Dashboard迁移至Headlamp:一步一步的指南

Kubernetes Blog
Kubernetes Blog · 2026-07-13T18:00:00Z
etcd-operator加入Cozystack,发布新版本v1alpha2 API

etcd-operator项目已捐赠给Cozystack,并发布了新版本etcd-operator.cozystack.io/v1alpha2。新版本直接使用etcd的Membership API,改进了集群成员管理,采用独立的EtcdMember资源,支持按需备份和TLS通信,旨在满足多租户需求,具备零规模和内存存储等新特性。

etcd-operator加入Cozystack,发布新版本v1alpha2 API

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-06-29T10:46:12Z
介绍Headlamp的Cluster API插件

Headlamp是一个开源的Kubernetes用户界面项目,Cluster API插件为其提供可视化的集群管理功能,简化了集群生命周期管理,允许用户通过直观界面查看集群状态、机器信息和健康状况,并支持在Headlamp中进行操作和调试,提升了平台团队的工作效率。

介绍Headlamp的Cluster API插件

mongona news
mongona news · 2026-06-25T22:00:00Z
在 Amazon EKS 上使用 NVIDIA GPU Operator 管理自定义 GPU 驱动与 CUDA 工作负载

在Amazon EKS上,使用NVIDIA GPU Operator可以有效管理自定义GPU驱动和CUDA工作负载。EKS通过EC2节点支持GPU工作负载,GPU Operator简化了驱动的安装和管理,确保容器的稳定运行。选择EKS托管节点组可以降低运维负担。同时,结合Kiro和AWS MCP,平台团队能够通过自然语言进行集群巡检和问题排查,从而提升运维效率。

在 Amazon EKS 上使用 NVIDIA GPU Operator 管理自定义 GPU 驱动与 CUDA 工作负载

亚马逊AWS官方博客
亚马逊AWS官方博客 · 2026-06-03T09:22:40Z
KubeClipper 1.6.0 发布:kcctl 优化与 K8s 1.36 支持

KubeClipper 1.6.0 发布,支持 Kubernetes 1.36,升级 Containerd 至 2.x,Calico 更新至 v3.31.5。kcctl 命令行工具进行了优化,新增集群管理命令,提升了稳定性并修复了多个问题。用户可以通过简单命令快速部署 K8s 集群,实现多集群管理。

KubeClipper 1.6.0 发布:kcctl 优化与 K8s 1.36 支持

探索云原生
探索云原生 · 2026-06-02T20:00:00Z
基于Kairos、k0rdent和bindy从零开始构建云原生平台

RBC资本市场在现代化Kubernetes平台过程中,成功管理了50多个集群,解决了节点不可变性、集群生命周期管理和DNS集成等挑战。通过Kairos、k0rdent和bindy等项目,构建了可审计、自动化的基础设施,确保合规性和高效性,实现了无手动状态的持续协调,显著提高了操作效率。

基于Kairos、k0rdent和bindy从零开始构建云原生平台

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-05-13T11:30:00Z
微软如何在无需人工干预的情况下管理数千个Kubernetes集群

Kubernetes的复杂性在于管理大规模集群。微软的Azure Kubernetes Fleet Manager通过定义可重用策略,简化了集群更新和跨集群连接,提高了管理效率。Cilium Cluster Mesh技术支持跨集群的无缝连接,帮助团队高效利用GPU资源,确保工作负载顺畅迁移。

微软如何在无需人工干预的情况下管理数千个Kubernetes集群

The New Stack
The New Stack · 2026-05-07T22:07:21Z
开赟与IBM合作推出内存资源优化方案

上海开赟与IBM合作推出基于IBM Spectrum LSF平台的内存资源优化方案,旨在帮助企业降低算力成本。该方案通过AI预测需求和优化内存调度,提升集群内存利用率。某芯片设计企业应用后,内存利用率超过78%,作业等待时间缩短30%,每年节省数百万元硬件成本。未来版本将增强内存使用统计能力。

开赟与IBM合作推出内存资源优化方案

全球TMT-美通国际
全球TMT-美通国际 · 2026-04-24T10:09:05Z
在本地基础设施上以GitOps方式使用K3s:从头开始编写自定义k0rdent模板

K3s与k0rdent结合在Proxmox上实现轻量级Kubernetes集群管理。k0rdent通过自定义Helm图表简化虚拟机创建和集群生命周期管理,使Kubernetes在本地基础设施上的部署变得可重复和易于维护,提升了集群的可扩展性和可管理性。

在本地基础设施上以GitOps方式使用K3s:从头开始编写自定义k0rdent模板

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-04-17T11:59:00Z
2026年KubeCon + CloudNativeCon欧洲大会上的Metal3:CNCF新孵化的裸金属项目

Metal3是CNCF的新项目,专注于Kubernetes裸金属集群管理。2026年,Metal3在KubeCon + CloudNativeCon Europe展现活跃,举办多场讲座和互动,促进社区参与与反馈,推动项目发展。

2026年KubeCon + CloudNativeCon欧洲大会上的Metal3:CNCF新孵化的裸金属项目

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-03-23T08:00:00Z
肖恩·托马斯:Patroni如何为Postgres带来高可用性

Patroni因其高可用性设计而在Postgres集群管理工具中脱颖而出。它通过维护节点共识和路由连接,确保集群稳定,并能自动处理节点故障和重建失效节点,是Postgres高可用性的理想选择。

肖恩·托马斯:Patroni如何为Postgres带来高可用性

Planet PostgreSQL
Planet PostgreSQL · 2026-02-27T05:33:52Z

本文介绍了如何使用FoundationDB创建和管理集群,包括生成集群ID、清理旧数据、配置环境变量、启动服务器节点、初始化集群、调整副本数量、备份与恢复数据,以及监控集群状态。

容器化部署多节点 FoundationDB 及运维

陈少文的博客
陈少文的博客 · 2026-02-10T00:00:00Z
一款现代化、跨平台、实用的 Kafka GUI 客户端

Kafka-King 是一款易用的跨平台 Kafka GUI 客户端,支持集群管理、主题管理和消息查看,兼容多版本 Kafka,提供安全连接和多语言支持。

一款现代化、跨平台、实用的 Kafka GUI 客户端

dotNET跨平台
dotNET跨平台 · 2026-02-08T02:17:05Z

本文介绍了MinIO集群的部署与管理,包括环境准备、节点配置、数据盘格式化与挂载、时间同步、集群管理、用户与策略设置、文件管理以及备份与恢复等步骤,重点在于节点一致性和数据安全。

MinIO 多节点多盘部署与运维

陈少文的博客
陈少文的博客 · 2026-02-07T00:00:00Z
为什么你应该停止手动管理Kafka – Kafka UI和Cruise Control指南

超过80%的财富100强公司使用Apache Kafka,但管理其集群面临挑战。手动管理繁琐且易出错,集群规模扩大后操作复杂度增加。本文介绍Kafka UI和Cruise Control两种工具,以简化集群管理,提高效率。

为什么你应该停止手动管理Kafka – Kafka UI和Cruise Control指南

freeCodeCamp.org
freeCodeCamp.org · 2026-01-14T15:58:54Z
加布里埃尔·巴托利尼:CNPG 配方 22 - 利用新的供应链和镜像目录

CloudNativePG改进了PostgreSQL镜像管理,采用新构建流程以确保安全性和可靠性。新流程包括漏洞扫描、镜像签名和软件材料清单,简化了集群管理和升级,并通过优化的镜像目录提升了数据库的模块化和灵活性。

加布里埃尔·巴托利尼:CNPG 配方 22 - 利用新的供应链和镜像目录

Planet PostgreSQL
Planet PostgreSQL · 2025-10-06T10:23:56Z
AutoOps:现已推出简单的Elasticsearch集群监控和管理服务,支持本地部署

AutoOps现已推出,支持自管理的Elasticsearch集群,提供实时问题检测、性能建议和资源利用洞察,简化集群管理。用户可快速设置将集群连接至Elastic Cloud,享受免费的监控和管理服务,帮助识别性能瓶颈,优化资源使用,降低硬件成本,提升系统可靠性。

AutoOps:现已推出简单的Elasticsearch集群监控和管理服务,支持本地部署

Elastic Blog - Elasticsearch, Kibana, and ELK Stack
Elastic Blog - Elasticsearch, Kibana, and ELK Stack · 2025-09-30T22:00:00Z
Umut TEKIN:探索 CNPG Kubectl 插件

CloudNativePG的kubectl插件简化了PostgreSQL集群的日常操作,提供统一命令集,便于检查状态、备份、切换管理、访问psql、部署pgAdmin4及配置逻辑复制,提升操作效率。

Umut TEKIN:探索 CNPG Kubectl 插件

Planet PostgreSQL
Planet PostgreSQL · 2025-09-04T04:30:14Z
宣布 k0rdent v1.0.0:利用 Kubernetes 管理大规模分布式基础设施

k0rdent v1.0.0发布,增强了多云环境的可观察性和成本优化。新增集群管理、服务模板链和IP地址管理自动化功能,提高了稳定性和操作效率。kOF模块集成监控与财务透明度,支持GPU监控和多集群管理。

宣布 k0rdent v1.0.0:利用 Kubernetes 管理大规模分布式基础设施

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2025-08-07T19:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码