小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
Haki Benita:如何在PostgreSQL中通过非分区列实现修剪

分区表的一个重要优势是修剪,数据库可以根据查询条件排除整个分区。虽然修剪通常依赖于分区键,但通过一些技巧,即使在非分区键列上也能实现修剪。本文展示了如何利用检查约束向优化器传达数据范围,从而提高查询效率。选择合适的分区键具有挑战性,但通过约束排除,可以在非分区键列上实现修剪,简化分区键的选择。

Haki Benita:如何在PostgreSQL中通过非分区列实现修剪

Planet PostgreSQL
Planet PostgreSQL · 2026-07-08T21:00:00Z

本文探讨了Trino的Exchange机制及其在分布式OLAP中的重要性,涵盖了不同的分区方案(如HASH、BROADCAST)、LocalExchange与RemoteExchange的区别、Broadcast join与Shuffle join的比较,以及如何通过EXPLAIN ANALYZE识别数据倾斜。此外,文章还比较了Trino与Spark在处理数据倾斜时的策略,强调了运行时优化与SQL改写的重要性。

【分布式 OLAP 查询引擎】Shuffle 与 Exchange:分区、广播与倾斜

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-07T00:00:00Z

本文探讨了Kafka 3.x(KRaft模式)中日志与分区的内核语义,重点介绍了Topic、Partition和Log Segment的结构及其在磁盘上的表现。Kafka保证同一分区内消息的顺序,但不同分区间无序。文章分析了写路径的顺序追加机制和读路径的fetch过程,强调了offset的单调性与不可回退特性,以及通过分区设计优化吞吐量的方法。最后,讨论了KRaft与ZooKeeper模式的区别。

【流式数据处理】Kafka 日志模型与分区

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-01T00:00:00Z

Iceberg通过隐藏分区和分区演进解决了Hive的分区问题。隐藏分区允许用户在数据列上写谓词,系统自动裁剪分区,避免全表扫描。分区演进则允许在不重写历史数据的情况下修改分区方案,保留旧数据的同时新增分区规范。这些设计提高了数据管理的灵活性和效率。

【数据湖与开放表格式】隐藏分区与分区演进

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-30T00:00:00Z
为什么你的 PostgreSQL 分区键会造成写入瓶颈

文章讨论了在高插入量数据库中,如何通过分析死元组比例和识别热点分区,避免因不均匀的分区键导致的写入瓶颈。建议使用基于时间的分区来优化写入性能,以实现均衡的写入负载和减少延迟。

为什么你的 PostgreSQL 分区键会造成写入瓶颈

Timescale Blog
Timescale Blog · 2026-06-19T11:23:00Z

InnoDB的Buffer Pool机制通过维护LRU、Free和Flush三种列表来管理内存中的数据页。调整innodb_buffer_pool_size至物理内存的80%可能导致TPS下降,因为flush列表无法跟上脏页生成速度。Buffer Pool分为young和old区,优化全表扫描时的热页管理。监控应关注命中率、脏页比例和flush列表长度,以避免性能瓶颈。

【MySQL InnoDB 内核】Buffer Pool 与 LRU:frame、flush 列表与 young/old 分区

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-18T00:00:00Z

文章讨论了MySQL组复制中的高可用性问题,提出了“故障转移棕色化”的概念,并强调在Kubernetes环境下重新思考高可用性。此外,介绍了Percona Operator for MySQL 1.20.0的新功能,包括自动存储调整、TLS证书轮换和对ARM64的支持。

通过分区感知插件扩展pt-archiver以快速执行保留策略

Percona Database Performance Blog
Percona Database Performance Blog · 2026-06-16T11:31:51Z

Dockside 是一款为 macOS 设计的效率工具,能够在程序坞旁创建文件置物架,方便用户快速拖放和整理文件、链接等。它支持多达 8 个分区,自动监控文件夹内容,并提供多种高级功能,帮助用户提高工作效率。

派评|近期值得关注的 App

少数派
少数派 · 2026-06-08T10:16:23Z
桌面零食收纳的 2 个分区

杜老师分享了“零食分区”方法,以提高工作专注力。她将零食分为高频区和低频区,高频区放常吃的坚果、肉干和能量棒,低频区放偶尔吃的水果和零食。此方法使桌面整洁,方便取用,杜老师认为分区比多收纳盒更有效。

桌面零食收纳的 2 个分区

杜老师说
杜老师说 · 2026-06-06T16:00:00Z
揭穿8个数据布局神话:为何液态聚类优于分区

液态聚类是现代湖仓的数据布局标准,解决了传统分区的小文件和过度分区问题。它支持动态调整聚类键和行级并发,优化查询性能。与分区相比,液态聚类在处理高基数列时表现更佳,并支持元数据操作。案例分析表明,液态聚类显著提高了数据处理效率,减少了存储空间。

揭穿8个数据布局神话:为何液态聚类优于分区

Databricks
Databricks · 2026-06-01T15:00:00Z
从行级删除转向即时数据保留

在高数据量环境中,传统的行级删除命令效率低下,影响性能。本文建议采用基于分区的保留策略,将数据按时间段划分,简化清理过程,避免行级删除的开销。利用TimescaleDB的超表功能,可以快速设置保留策略,自动管理数据分区,从而显著提高数据库性能,减少资源消耗。

从行级删除转向即时数据保留

Timescale Blog
Timescale Blog · 2026-04-17T15:39:21Z
肖恩·托马斯:在Postgres分区中强制约束

Postgres的表分区功能在数据管理中非常便利,但在强制唯一约束时存在限制。为确保跨分区的唯一性,可以使用触发器或维护单独的去重表。去重表在性能上更优,尤其是在分区数量增加时。通过对去重表进行分区,可以有效管理大量数据,同时保持高效的唯一性检查。这些方法虽然不如原生唯一约束简单,但在Postgres的限制下是可行的解决方案。

肖恩·托马斯:在Postgres分区中强制约束

Planet PostgreSQL
Planet PostgreSQL · 2026-04-17T05:48:50Z
第六章:分区

本文讨论了分布式系统中的数据存储扩展策略,比较了垂直扩展和水平扩展的优缺点。垂直扩展简单但存在单点故障风险,而水平扩展通过数据分区提高可用性。范围分区适合顺序查询但可能导致数据倾斜,哈希分区则均衡负载但牺牲顺序查询能力。文章还探讨了数据迁移和请求路由机制,强调在动态环境中保持数据一致性的重要性。

第六章:分区

codedump的网络日志
codedump的网络日志 · 2026-03-29T00:00:00Z
大规模表分区的隐性成本

分区能显著提升时间范围查询的性能,主要体现在读取方面,但增加了操作复杂性和监控需求。尽管写入路径和WAL体积未变,分区适合数据保留管理,但对高频写入场景效果有限,需谨慎评估工作负载。

大规模表分区的隐性成本

Timescale Blog
Timescale Blog · 2026-03-05T20:22:43Z

本文介绍了如何通过 extroot 机制将 OpenWrt 系统迁移到 ext4 磁盘,以扩展根分区。该机制利用外部存储设备增加可写空间,用户需将当前系统完整复制到外部磁盘,适用于内置 Flash 空间小的路由器,并需安装 diskman。重启后,根分区成功扩展至外部磁盘空间。

openwrt使用外置根extroot机制扩展根分区大小

Allen Hua 的网络博客
Allen Hua 的网络博客 · 2026-02-01T11:08:00Z

云计算提供商CloudCone在洛杉矶机房多台虚拟机失联,黑客利用Virtualizor控制面板部署勒索软件,导致虚拟机无法启动。团队正在努力恢复数据,但前景不乐观。客户个人信息未泄露。

服务器提供商CloudCone详细说明洛杉矶机房失联问题 引导分区被勒索软件覆盖

蓝点网
蓝点网 · 2026-01-31T03:17:12Z
山海连城,骑乐无穷:深圳市各区精品骑行道分区导览

深圳计划在2025至2035年间建设超过1000公里的高品质骑行道网络,涵盖滨海和山海骑行大环,以提升骑行体验和促进城市发展。各区将打造特色骑行道,连接自然与城市景观。

山海连城,骑乐无穷:深圳市各区精品骑行道分区导览

人言兑
人言兑 · 2025-12-16T09:25:26Z
用“分区”来面对超大数据集和超大吞吐量

分区(sharding)通过将数据均匀分布在多个节点上,提高系统可伸缩性,避免热点和数据倾斜。为确保一致前缀读,需将因果相关的写入放在同一分区。可通过散列分区和在主键后加随机数来缓解热点问题。分区再平衡可手动或自动执行,以确保负载均匀分配。请求路由需解决服务发现问题,可通过协调服务(如Zookeeper)跟踪数据分配变化。

用“分区”来面对超大数据集和超大吞吐量

京东科技开发者
京东科技开发者 · 2025-12-03T09:47:46Z
用“分区”来面对超大数据集和超大吞吐量

分区(sharding)通过将数据分散到多个节点来提升系统可伸缩性,避免热点和数据倾斜。常用的分区方法包括键值范围和散列分区。为消除热点,可以在主键后添加随机数。分区再平衡确保负载均匀,支持手动或自动执行。请求路由需解决服务发现问题,通常使用协调服务(如Zookeeper)跟踪数据分配的变化。

用“分区”来面对超大数据集和超大吞吐量

京东科技开发者
京东科技开发者 · 2025-11-26T09:03:28Z

移除双系统需谨慎,涉及磁盘分区和引导修复。用户应备份数据,确认分区,使用Live USB删除Linux分区,修复引导并回收空间。确保每步操作成功,以避免误删和数据损坏。

详解如何彻底移除 Linux 双系统(Dual Boot):从分区删除到启动修复全指南

极客技术博客’s Blog
极客技术博客’s Blog · 2025-11-25T15:20:38Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码