小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

本文介绍了一个技术专题的总目录,涵盖大模型与AI工程、分布式系统、存储工程、网络工程、密码学、安全、操作系统和算法等多个领域的系列文章,提供详细的主题介绍和入口链接,方便读者深入学习。

全部系列索引

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-22T00:00:00Z

本文介绍了如何从零开始实现LSM-Tree存储引擎,涵盖日志、MemTable、SSTable、Bloom Filter和Compaction等核心概念,并提供完整的C代码、架构图和数学推导,深入探讨LSM-Tree的设计哲学及其在数据库中的应用。

数据库内核实验索引

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-22T00:00:00Z

钉住 covering index 消除的具体开销:第 4 篇 index b-tree 只存 key+rowid,命中后仍要回表这一次二次查找;用本机 3.53.2 实测 SELECT 列是否全部落在索引内如何改变 EQP 输出,并区分语句级自动索引与 sqlite_autoindex_* 约束索引这两个常被混淆的概念。

【SQLite 内核】索引与 covering scan:什么时候真的省掉了第二次查找

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-18T00:00:00Z

钉住 SQLite table b-tree 与 index b-tree 的字节布局差异、cell pointer array 如何做到逻辑有序物理可乱序、overflow 阈值与 balance() 分裂/合并触发条件;源码以 btree.c 函数签名为准,学术锚点是 Bayer & McCreight 1972。

【SQLite 内核】B-Tree 遍历与分裂:表 B-Tree、索引 B-Tree 与 cell 布局

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-17T00:00:00Z

FoundationDB的Record Layer提供有序、事务性的键值API,支持结构化记录和二级索引。通过Protocol Buffers定义记录类型,使用Tuple和Subspace隔离逻辑数据库。二级索引与主记录在同一事务中维护,确保一致性。CloudKit利用Record Layer实现多租户结构化存储,提供强一致性和丰富API,整体设计强调事务性和高并发性能优化。

【FoundationDB 内核】Record Layer:记录与二级索引

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-17T00:00:00Z

本文讨论了Lucene文档模型中分析器对中文分词的影响。不同分析器(如StandardAnalyzer、ICU和IK插件)会导致不同的词项集合,从而影响索引和查询结果。文章强调索引和查询使用相同分析器是确保搜索结果一致性的关键。中文分词依赖于词典和模型,Lucene本身不提供生产级中文分词,常用插件如IK和jieba可热更新词典。分析器的选择和配置对性能和召回率有重要影响。

【全文检索引擎】分析链 Analyzer:从文本到 TokenStream

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-15T00:00:00Z

本文探讨了Elasticsearch 8.x中的索引、主分片、副本及其与Lucene的关系,强调了分片数对集群状态更新的影响,主分片和副本的读写机制,以及通过哈希路由优化数据分布的重要性,最后讨论了分片规划的重要性,以避免过多分片导致的性能问题。

【全文检索引擎】Index · Shard · Replica:路由与 cluster state

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-15T00:00:00Z

Visual Studio Insiders 18.9引入全代码库索引(WCI),显著提升C++项目的符号信息检索效率,优化代码导航和语义文件着色,支持CodeLens引用功能,提升开发体验。WCI通过更深层次的索引加快符号上下文访问速度,特别在大型代码库中提高开发者工作效率。

重新思考C++性能:通过全代码库索引实现更快的代码导航和GitHub Copilot工具

C++ Team Blog
C++ Team Blog · 2026-07-14T22:28:13Z
当Postgres查询规划器失控时

Postgres查询规划器出现问题,导致数据库CPU利用率从20%飙升至100%。客户通过流量控制技术迅速限制了问题查询,恢复了数据库健康。问题源于查询规划器错误选择,导致未使用索引而进行全表扫描。后续需分析查询执行计划,调整索引或重写查询以避免再次发生。

当Postgres查询规划器失控时

PlanetScale - Blog
PlanetScale - Blog · 2026-07-13T00:00:00Z

Knowhere 是 Milvus 的向量索引执行引擎,集成了 Faiss、Hnswlib 和 Annoy 等库,支持软删和多种相似度计算。它通过统一的 VecIndex 接口处理索引构建与查询,优化性能并简化开发流程,同时支持自动 SIMD 选择以提升计算效率。

【向量检索引擎】Knowhere:向量索引执行引擎与插件契约

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-12T00:00:00Z

本文讨论了对象存储在Milvus 2.6.x版本向量检索引擎中的应用。对象存储用于保存日志快照、索引文件和查询结果,布局从按字段拆分转向按段整合,以减少API调用次数和延迟。文章还探讨了数据处理路径、索引对象与数据对象的生命周期差异,以及与湖仓对象布局的对比,强调了优化存储布局的重要性。

【向量检索引擎】对象存储上的 Segment 布局:快照、索引与寻址代价

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-12T00:00:00Z

本文介绍了 Git 的基本命令及其对磁盘的影响,包括 `git add`、`git commit`、`git branch`、`git checkout` 和 `git reset` 的具体操作及其对 `.git` 目录的影响。通过实测,展示了每个命令如何更新对象库、索引和引用,帮助理解 Git 的内部结构和工作原理。

【Git 内部】日常 porcelain 命令改写了哪些文件

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-05T00:00:00Z

本文讨论了 Git 中的索引结构及其与工作区和 HEAD 的关系。介绍了文件的角色、操作对索引的影响、冲突阶段及扩展节。索引记录路径、元数据和对象 SHA,合并冲突时同一路径可出现多个条目。扩展节包含缓存结构和冲突信息,以加速操作。最后提到索引与工作区的一致性及未来版本的参考。

【Git 内部】index 暂存区:dircache v2 与扩展节

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-05T00:00:00Z

本文介绍了Git中的packfile结构及其作用。packfile将多个对象压缩存储,减少小文件带来的压力。通过.git/objects/pack/目录中的.pack和.idx文件,Git能够高效管理对象,idx文件提供对象的索引,支持快速查找。文章还展示了如何使用git verify-pack命令验证pack文件的内容和结构。

【Git 内部】pack 与 idx 文件格式

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-05T00:00:00Z

本文介绍了CUDA kernel的基本构建,包括向量加法的实现、线程索引、同步机制和启动配置。强调了grid-stride loop的优势,使kernel与数据规模解耦,并介绍了__syncthreads()的使用注意事项。建议block大小应为128至512,避免使用过小的block,并强调CUDA错误检查的重要性,以确保程序的稳定性和性能。

【GPU 算子工程】写第一个 CUDA kernel:索引、同步与启动配置

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-27T00:00:00Z

本文介绍了一款适用于Windows 10/11的iOS 27索引进度查看工具。用户需安装iTunes或苹果设备软件并连接手机,通过命令提示符检查索引进度。提供了下载链接和使用方法,帮助用户在iOS 27安装后查看文件索引进度。

[下载] 适用于Windows 10/11的iOS 27索引进度查询工具 可以查看实际索引进度

蓝点网
蓝点网 · 2026-06-19T05:54:31Z

本文讨论了ClickHouse的MergeTree引擎的读路径,重点介绍了如何通过primary.idx和跳数索引来优化查询性能。强调了PREWHERE的使用及其在存储层优先执行的优势,以及并行读取策略。最后,提供了索引类型和优化建议,以提高查询效率。

【列存引擎内核】查询读取路径

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-18T00:00:00Z

ClickHouse 的主键是稀疏排序索引,结合二级跳数索引实现 granule 剪枝。主键需为 ORDER BY 前缀,合理选择排序键可优化索引体积和查询性能。跳数索引类型包括 minmax、set 和 bloom_filter,适用于不同查询场景。设计时应考虑高基数列的索引策略,以提升查询效率。

【列存引擎内核】索引与跳数索引

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-18T00:00:00Z

本文探讨了MySQL InnoDB存储引擎中的B+树索引机制,重点分析了聚簇索引和二级索引的结构与操作。聚簇索引将数据存储在叶节点,二级索引包含主键以支持回表查询。文章还详细讨论了索引的搜索路径、插入与页分裂过程,以及并发控制和覆盖索引的优化策略,强调了随机主键对性能的影响。

【MySQL InnoDB 内核】B+Tree 与索引:聚簇、回表与页分裂

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-18T00:00:00Z
在Databricks上通过全文本搜索索引加速查询

Databricks推出了全文本搜索索引,能够在大数据表中加速查询速度超过100倍,适用于处理数百GB至PB级的数据,优化文本列的子字符串和关键词查询。该功能与液态聚类互补,提升数据检索效率,特别适合安全调查等应用场景。目前已在Databricks Runtime 18.2的Beta版本中提供。

在Databricks上通过全文本搜索索引加速查询

Databricks
Databricks · 2026-06-16T12:45:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码