小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

DoorDash has developed Entity Cache, a transparent proxy caching platform built on Envoy and Valkey to reduce redundant service-to-service requests across its microservices architecture. Operating...

DoorDash Uses Envoy and Valkey for a 1.5M RPS Proxy Cache with 99.99999% Availability

InfoQ
InfoQ · 2026-07-20T13:53:00Z
Purge your Remote Cache's build and CI artifacts

Team Owners can now clear the team's Remote Cache of all artifacts in one click. This is useful when you believe there are poisoned artifacts in your cache.In your team's Build and Deployment...

Purge your Remote Cache's build and CI artifacts

Vercel News
Vercel News · 2026-07-20T00:00:00Z

钉住官方 File Locking And Concurrency 文档定义的 UNLOCKED/SHARED/RESERVED/PENDING/EXCLUSIVE 五态锁阶梯:谁能与谁共存、PENDING 如何防写者饿死、Pager 为何只跟踪四态;用本机 3.53.2 真实双连接冲突实验验证,shared cache 与 WAL 差异只点边界,留给第 8、10 篇。

【SQLite 内核】锁状态与 shared cache:五态锁阶梯与 writer starvation

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-18T00:00:00Z

拆解 Pager 作为 B-Tree 与操作系统文件之间的契约层:page cache 命中/未命中路径、脏页生命周期与提交前的可回滚保证,并与 PG shared_buffers、InnoDB Buffer Pool 的跨进程共享模型对照。

【SQLite 内核】Pager 与 Page Cache

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-17T00:00:00Z
Cloudflare推出Workers Cache前端缓存层 可以显著提升响应速度并降低使用成本

Cloudflare推出Workers Cache前端缓存层,提升响应速度并降低成本。该缓存层分为上下两层,下层位于边缘数据中心,上层通过全球请求聚合。命中缓存时无需执行Workers,未命中时执行并填充缓存。支持HTTP Cache-Control和SWR策略,适合动态内容和多租户场景,现已向所有开发者开放,响应体限制为512MB。

Cloudflare推出Workers Cache前端缓存层 可以显著提升响应速度并降低使用成本

蓝点网
蓝点网 · 2026-07-07T02:30:03Z

本文讨论了RocksDB的读取性能优化,重点在于Table Cache和Block Cache的作用。Table Cache缓存已打开的TableReader,避免重复打开SST文件;Block Cache缓存数据块,减少I/O开销。使用Bloom Filter和Ribbon Filter可以跳过不存在的键的I/O,Partitioned Index则通过分割大型索引降低读取成本。调参时需综合考虑文件数和缓存策略,以优化读取性能。

【RocksDB 内核机制】Block Cache 与 Bloom:读放大裁剪

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-07T00:00:00Z

算子库工程涉及多个kernel的选择与优化,主要包括dispatch和autotune机制。dispatch根据形状、精度和架构选择最佳kernel,autotune通过实测候选配置优化性能。JIT编译按需生成特定kernel,提高效率,但需缓存编译结果以减少延迟。此外,算子库需关注正确性回归和版本管理,以确保稳定性和可维护性。

【GPU 算子工程】算子库工程:dispatch、autotune cache 与 JIT

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-28T00:00:00Z

effective_cache_size doesn't allocate memory, reserve RAM, or control runtime behavior—it merely whispers a number to the query planner to make it smarter…

Christophe Pettus: All Your GUCs in a Row: effective_cache_size

Planet PostgreSQL
Planet PostgreSQL · 2026-06-21T01:00:00Z
在 Amazon Bedrock 上为 Claude 应用设计稳健的 Prompt Cache 策略

本文介绍了在 Amazon Bedrock 上为 Claude 应用设计的 Prompt Cache 策略,旨在降低输入成本和响应延迟,适用于长上下文应用。讨论了 cache checkpoint 的放置、内容块的定义及其限制,并提出了单个尾部 checkpoint 和三 CP 布局两种策略。建议监控使用情况,以优化性能和降低成本。

在 Amazon Bedrock 上为 Claude 应用设计稳健的 Prompt Cache 策略

亚马逊AWS官方博客
亚马逊AWS官方博客 · 2026-05-19T03:48:36Z

Two recent Linux kernel vulnerabilities have been disclosed: Copy Fail (CVE-2026-31431) on April 29, 2026, and Dirty Frag (CVE-2026-43284 and CVE-2026-43500) on May 7, 2026. Both allow local users...

Copy Fail and Dirty Frag: Linux Page-Cache Exploits Target Every Major Distribution

InfoQ
InfoQ · 2026-05-12T08:00:00Z

Netflix improves Apache Druid performance with interval aware caching, serving 84% of analytics results from cache and reducing query load by 33%. The system decomposes rolling window queries into...

Netflix Serves 84% of Query Results from Cache with Interval-Aware Caching in Apache Druid

InfoQ
InfoQ · 2026-05-11T14:36:00Z
理解 KV Cache:Attention、P/D 分离与 vLLM 的页式显存管理

本文探讨了大语言模型中KV Cache的产生与管理及其在推理过程中的重要性。KV Cache通过缓存历史K/V向量,优化生成过程并减少计算复杂度。Prefill阶段处理所有输入,而Decode阶段逐步生成输出,二者需分离以提升性能。vLLM采用页式内存管理,解决内存碎片问题,提升存储效率,确保高效的推理系统。

理解 KV Cache:Attention、P/D 分离与 vLLM 的页式显存管理

Steins;Lab
Steins;Lab · 2026-05-06T16:28:41Z

Cloudflare recently introduced its Gen 13 servers, marking a shift in how its network handles traffic. Instead of relying on large CPU caches for speed, the company redesigned its software to...

Cloudflare Optimizes Edge Stack for High-Core CPUs instead of Large Cache

InfoQ
InfoQ · 2026-04-25T06:06:00Z

Cloudflare and ETH Zurich highlight how AI-driven crawler traffic challenges traditional caching in CDNs and databases. They propose AI-aware strategies including separate cache tiers, adaptive...

Cloudflare and ETH Zurich Outline Approaches for AI-Driven Cache Optimization

InfoQ
InfoQ · 2026-04-08T14:20:00Z

Claude Code的fork子agent通过共享缓存机制优化并行任务成本,确保99%以上的字节一致性,显著降低输入费用。使用Anthropic API的Prompt Cache机制,缓存命中可享受90%折扣,减少并行调用成本。设计强调字节级一致性,确保多个请求共享相同前缀,避免不必要费用。

子Agent省90%费用的Prompt Cache共享机制

Finisky Garden
Finisky Garden · 2026-04-05T12:46:42Z
Fast-WAM——训练时保留视频联合训练(虽同时生成但动作token不看视频token),在推理时则移除显式的未来视频生成,直接在单次前向中,依托得到的潜在世界表征KV Cache预测动作

研究者探讨了世界模型代理(WAM)在测试阶段是否需要显式未来想象,提出了Fast-WAM架构,训练时保留视频共训练,推理时跳过未来预测。结果显示,视频预测主要在训练阶段提升模型性能,而非在推理阶段生成未来观测。

Fast-WAM——训练时保留视频联合训练(虽同时生成但动作token不看视频token),在推理时则移除显式的未来视频生成,直接在单次前向中,依托得到的潜在世界表征KV Cache预测动作

结构之法 算法之道
结构之法 算法之道 · 2026-03-31T15:57:16Z

PostgreSQL的查询规划器在执行预处理语句时,前五次使用自定义计划,第六次可能切换到通用计划。这种切换可能导致性能下降,特别是在数据分布不均时。用户应注意这一行为,并在必要时强制使用自定义计划以优化性能。

理查德·燕:plan_cache_mode的隐秘行为

Planet PostgreSQL
Planet PostgreSQL · 2026-03-30T08:00:00Z
谷歌新论文把内存股价干崩了!KV cache压缩6倍,网友:硅谷成真了 profile-avatar

谷歌的新算法TurboQuant将AI推理中的KV缓存压缩了6倍,且无损精度,导致美光和西部数据股价大跌。该算法通过极坐标量化和量化JL变换,显著降低内存需求并提升速度,可能会改变AI的内存使用方式。

谷歌新论文把内存股价干崩了!KV cache压缩6倍,网友:硅谷成真了 profile-avatar

量子位
量子位 · 2026-03-26T03:03:26Z
穆罕默德·阿基尔:生产环境中的pg_semantic_cache:标签、驱逐、监控与Python集成

本文介绍了PostgreSQL中的语义缓存,强调如何将其应用于生产环境。通过标签组织缓存条目、监控缓存健康状况和实施驱逐策略,确保数据的新鲜度和有效性。示例展示了如何在Python应用中集成语义缓存,以提高查询效率和降低API调用成本。

穆罕默德·阿基尔:生产环境中的pg_semantic_cache:标签、驱逐、监控与Python集成

Planet PostgreSQL
Planet PostgreSQL · 2026-03-03T04:20:12Z
穆罕默德·阿基尔:PostgreSQL中的语义缓存:pg_semantic_cache实用指南

pg_semantic_cache是一个PostgreSQL扩展,通过语义匹配优化缓存,减少API调用。它利用向量嵌入识别不同表述的相同意图,从而提高缓存命中率,降低延迟和成本,适用于AI应用,显著提升查询效率。

穆罕默德·阿基尔:PostgreSQL中的语义缓存:pg_semantic_cache实用指南

Planet PostgreSQL
Planet PostgreSQL · 2026-02-25T06:03:29Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码