小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

kube-apiserver无leader选举,多实例并发运行共享etcd,与controller-manager等不同。运维要点包括:滚动升级逐实例替换、处理409冲突、APF容量为各实例之和。核心flag有--etcd-servers、--etcd-servers-overrides(分集群events)、--request-timeout、--shutdown-delay-duration(需≥LB健康检查间隔×失败阈值)、--encryption-provider-config。升级顺序:etcd→apiserver→controller-manager→scheduler→kubelet,版本偏差不超过2个minor。健康检查中/readyz反映etcd连通性,/healthz不等价于etcd健康。

【kube-apiserver】运维与升级:HA、flags、graceful shutdown 与 etcd 联检

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-08-28T00:00:00Z

本文介绍HAProxy健康检查机制与数据面调度分离的架构。探活通过TCP/HTTP/agent-check更新服务器状态,影响候选集而非客户端路径。默认TCP检查仅验证端口,httpchk/tcp-check支持L7多步探测,agent-check提供平行控制通道。disable-on-404、drain等可将探活用于发布排空。排障时需区分检查失败与队列问题,注意检查风暴风险。

【HAProxy 数据面】Health-check 引擎:探活调度、httpchk/tcp-check 与 agent-check 边界

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-08-12T00:00:00Z

Envoy中Cluster是上游逻辑分组,路由选定名字后,主机选择按优先级、本地性、子集和负载均衡算法逐层收窄。优先级用超额配置健康分数渗漏流量,子集依赖元数据匹配,错误回退会伪装成无上游。选中主机后,连接池、熔断和异常检测决定是否返回503。

【Envoy 数据面】Cluster 与负载均衡:优先级、Locality、Subset 与健康检查入口

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-08-10T00:00:00Z
你的Kubernetes健康检查正在意外唤醒服务。这是解决方案。

KubeElasti的ProbeResponse功能解决了Kubernetes服务缩容至零时健康检查误触发扩容的问题。该功能在解析器层匹配探针规则,直接响应健康检查请求,不触发扩容,使服务保持真正空闲。它支持方法、路径、头和查询参数匹配,仅在代理模式生效,无额外开销,特别适合GPU工作负载和许可软件场景。

你的Kubernetes健康检查正在意外唤醒服务。这是解决方案。

Cloud Native Computing Foundation Cloud Native Computing Foundation · 2026-07-29T11:00:00Z

服务端负载均衡(LB)和客户端LB的健康检查机制不同。服务端LB通过中心代理主动探测后端实例,而客户端LB由每个客户端独立探测。健康检查方式包括主动探测、客户端主动探测和被动检测,选择方式取决于系统规模、调用频率和运维能力。服务端LB适合大多数团队,客户端LB在高负载时更有效,两者可结合使用以优化性能。

TIL:服务端 vs 客户端负载均衡的健康检查机制

暗无天日 暗无天日 · 2026-07-09T00:00:00Z
对您的Heroku Connect数据管道进行15秒健康检查

Heroku提供了一种AI PaaS平台,简化应用程序的部署和扩展。开发者可以使用Heroku Connect CLI插件进行数据同步诊断,快速识别配置问题,优化数据管道,并实时检查Salesforce与Heroku Postgres的连接健康状况。

对您的Heroku Connect数据管道进行15秒健康检查

Heroku Heroku · 2026-06-24T15:35:14Z

本文讨论了ClickHouse的监控与健康检查,强调了system表的重要性。建议监控system.parts、system.merges和system.replicas,以确保数据存储和查询的健康。提供了监控分层结构和常用查询示例,帮助识别潜在问题,如parts过多、merge堵塞和副本延迟,并提到与Prometheus集成的监控方法,以确保系统性能符合SLA要求。

【列存引擎内核】监控与系统表

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-06-18T00:00:00Z

pgagroal 2.1.0版本发布,新增监控Prometheus指标的网页控制台、改进的故障转移支持和健康检查进程。用户可定义故障转移后的脚本,实时通知备用服务器。健康检查进程定期查询主服务器状态,确保备用服务器正常运行。此外,新增pgagroal-config命令,支持交互式创建和修改配置文件,整体代码质量和测试套件也有所提升。

卢卡·费拉里:pgagroal 2.1.0版本发布!

Planet PostgreSQL Planet PostgreSQL · 2026-04-30T00:00:00Z

某电商平台因机房迁移导致库存服务IP变更,订单服务超时,造成损失。传统静态IP配置不适应微服务和容器化环境,需引入服务发现机制。服务发现分为客户端和服务端两种模式,主流注册中心有Consul、Eureka和Nacos,各具优缺点。健康检查机制重要,需避免假阳性和假阴性。服务网格架构简化了应用代码,优化了服务发现逻辑。

【系统架构设计】服务发现与注册:动态拓扑的基础设施

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-04-13T00:00:00Z
肖恩·托马斯:使用Patroni构建高可用性Postgres集群——第三部分:HAProxy

本文介绍了如何使用HAProxy作为路由层来构建高可用性Postgres集群,确保新连接指向主节点并提供健康检查功能。HAProxy的配置简单,完成后可通过测试验证其有效性,最终实现高效的Postgres集群解决方案。

肖恩·托马斯:使用Patroni构建高可用性Postgres集群——第三部分:HAProxy

Planet PostgreSQL Planet PostgreSQL · 2026-03-20T06:47:06Z

谷歌在年度健康活动“Check Up”上宣布投资1000万美元用于临床AI培训,旨在通过AI改善疾病检测和医疗服务。研究表明,谷歌AI能够帮助放射科医生更早、更准确地检测乳腺癌。同时,谷歌云利用Gemini驱动的AI代理,推动医疗服务向主动、自动化和以患者为中心的方向发展。

2026年谷歌健康检查

The Keyword The Keyword · 2026-03-17T16:00:00Z
如何在生产工作负载中使用 Docker Compose — 配置文件、监控模式和 GPU 支持

Docker Compose 近年来更新显著,新增配置文件、监控模式和GPU支持,使其适用于复杂部署场景。通过配置文件管理环境、监控模式加速开发及健康检查和依赖管理,Compose 变得更可靠。但仍不具备容器编排功能,适合本地开发和单节点工作负载。

如何在生产工作负载中使用 Docker Compose — 配置文件、监控模式和 GPU 支持

freeCodeCamp.org freeCodeCamp.org · 2026-03-06T14:04:17Z

本文实现了一个简单的L4负载均衡器,包含后端管理、轮询调度算法和健康检查,具备构建流量分发网关的核心要素。

实战:负载均衡器 (Load Balancer)

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2025-11-27T00:00:00Z
修复Prometheus与OpenTelemetry集成所需的问题

OpenTelemetry与Prometheus之间存在兼容性问题,主要由于OpenTelemetry缺乏服务发现和主动拉取功能。Prometheus专注于指标监控,而OpenTelemetry生成多种信号并传递给第三方系统。两者的集成需要在性能和语义约定方面改进,未来可能通过合成上报指标来解决健康检查问题。

修复Prometheus与OpenTelemetry集成所需的问题

The New Stack The New Stack · 2025-11-05T00:00:59Z
简化分布式系统:Jason Taylor展示了如何通过.NET Aspire让复杂变得轻松

在JetBrains .NET Days Online 2025上,Jason Taylor展示了如何通过.NET Aspire简化分布式系统的构建。他强调“无努力”并非无工作,而是减少不必要的摩擦,专注于用户关心的功能。通过简单的操作,.NET Aspire能快速实现服务发现、健康检查和消息传递,提升开发体验,简化团队入职流程。最终,Taylor展示了如何在几分钟内将系统部署到Azure,强调选择合适工具的重要性。

简化分布式系统:Jason Taylor展示了如何通过.NET Aspire让复杂变得轻松

The JetBrains Blog The JetBrains Blog · 2025-10-29T14:28:29Z
7个常见的Kubernetes陷阱(以及我如何学会避免它们)

Kubernetes使用中的七个常见陷阱包括:未设置资源请求和限制、忽视健康检查、仅依赖容器日志、开发与生产环境配置相同、遗留旧资源、过早深入网络和安全配置不足。避免这些问题可以提高集群管理效率,减少故障。

7个常见的Kubernetes陷阱(以及我如何学会避免它们)

Kubernetes Blog Kubernetes Blog · 2025-10-20T15:30:00Z
负载均衡监控组:增强应用程序韧性的多服务健康检查

现代应用程序是复杂的分布式系统,其健康状态依赖多个独立组件的协同工作。Cloudflare推出的监控组功能,允许用户将多个健康监测器整合为一个逻辑实体,从而更智能地评估应用程序的可用性,减少自定义服务的需求。通过全球数据中心的健康检查,确保应用程序在不同地区的稳定性和性能。

负载均衡监控组:增强应用程序韧性的多服务健康检查

The Cloudflare Blog The Cloudflare Blog · 2025-10-17T06:00:00Z
提升Boost.Redis

Boost.Redis 1.90版本新增了通过asio::cancel_after进行每个操作的取消功能,替代了HELLO的自定义启动命令,支持Valkey,处理无竞争的取消,并即将推出Sentinel和健康检查增强功能。

提升Boost.Redis

Boost News Boost News · 2025-10-07T00:00:00Z
Kubernetes (K8s) 故障排除高级技巧 – 第二部分

本文探讨了Kubernetes故障排除的高级策略,包括解决PVC待处理错误、利用事件和审计日志进行深入分析、Kubernetes仪表板的可视化管理、健康检查和探针的实施,以及使用临时容器和kubectl debug命令等高级调试技术。这些技巧帮助工程师有效诊断和解决集群及应用问题,提高Kubernetes环境的稳定性和效率。

Kubernetes (K8s) 故障排除高级技巧 – 第二部分

Cloud Native Computing Foundation Cloud Native Computing Foundation · 2025-09-19T16:00:00Z
Fluent Bit健康检查API端点指南

本文介绍了如何在Kubernetes中配置Fluent Bit进行健康检查。通过设置Fluent Bit的web服务器和健康检查功能,可以监控容器状态。健康状态基于输出插件的错误计数和重试失败计数,若输出插件失败,则返回不健康状态。可通过/api/v1/health端点获取健康状态。

Fluent Bit健康检查API端点指南

The New Stack The New Stack · 2025-09-17T17:00:10Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码