小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

本文讨论了FoundationDB的Proxy层,包括Grv Proxy和Commit Proxy的角色与功能。Grv Proxy负责发放读版本并检查日志存活,Commit Proxy处理事务提交和冲突检测。通过拆分这两个角色,系统能够更好地扩展和优化性能。Ratekeeper控制读版本的发放速率,以防止过载,从而提高事务处理的效率和安全性。

【FoundationDB 内核】Proxy:Grv 与 Commit、批处理与 read version

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-17T00:00:00Z
流处理与批处理:数据处理的两种哲学

数据处理主要有两种方法:批处理和流处理。批处理在数据完整后进行计算,适合处理完整数据集;流处理则实时处理不断到来的数据,优先考虑速度。两者在完整性和延迟之间存在权衡,流处理需要估算数据到达情况。

流处理与批处理:数据处理的两种哲学

ByteByteGo Newsletter
ByteByteGo Newsletter · 2026-07-09T15:31:10Z

本文探讨了分布式OLAP查询引擎Trino和DuckDB如何通过批量处理提升性能,强调向量化执行的重要性,指出逐行处理会浪费CPU资源。文章比较了不同引擎的批处理结构和调度机制,介绍了DuckDB的morsel-driven并行模型及其内存数据布局,并通过实验展示了DuckDB在查询性能上的优势。

【分布式 OLAP 查询引擎】向量化批处理与 Morsel-Driven 并行

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-07T00:00:00Z
从批处理到链上 一线工程师拆解衍生品CBDC测试

香港交易及结算所与金融管理局于2026年6月18日启动了衍生品收市后数码港元试点,首次在复杂衍生品场景中应用央行数字货币(CBDC)进行预缴按金支付。

从批处理到链上 一线工程师拆解衍生品CBDC测试

mongona news
mongona news · 2026-06-27T03:46:26Z
动态批处理:实用指南

动态批处理通过实时组合多个推理请求,提高GPU利用率并减少延迟。语义缓存在请求到达推理队列前识别并重用相似查询的响应,从而降低成本和延迟。Redis为AI工作负载提供高效的实时数据平台,优化推理性能。

动态批处理:实用指南

Redis Blog
Redis Blog · 2026-06-21T00:00:00Z
什么是数据管道架构?

数据管道架构是设计数据从源系统到应用和模型的过程,包括数据的收集、处理、存储和交付。架构分为逻辑设计和物理设计,定义数据流动的步骤和工具。数据管道可分为批处理和流处理,适用于不同用例。现代平台如Databricks通过Lakeflow统一这两种处理方式,简化架构,提高数据的可靠性和可用性。

什么是数据管道架构?

Databricks
Databricks · 2026-06-16T21:23:03Z

本文介绍了五个Python脚本,旨在自动化处理PDF文件的常见任务,包括合并与拆分PDF、提取文本和表格、添加水印和页码、删除敏感内容,以及提取元数据生成PDF清单。这些脚本支持批处理,提升了工作效率。

5个实用的Python脚本来自动化处理无聊的PDF任务

KDnuggets
KDnuggets · 2026-06-10T12:00:44Z
同时服务多个用户:连续批处理如何提高大语言模型推理效率

本文探讨了通过动态调度和不规则批处理提高大语言模型(LLM)推理效率的方法。动态调度允许在每个解码步骤后立即接收新请求,避免了静态批处理中短请求等待长请求的问题,从而减少GPU资源浪费。不规则批处理通过合并多个提示,减少填充令牌的浪费,进一步提升推理速度。最终,连续批处理显著提高了LLM的推理效率。

同时服务多个用户:连续批处理如何提高大语言模型推理效率

MachineLearningMastery.com
MachineLearningMastery.com · 2026-05-30T02:54:17Z
Python中的高效数据处理:批处理与流处理管道解析

在编写数据管道代码前,需要选择批处理或流处理。批处理适合处理历史数据,适用于数据新鲜度要求低的场景;流处理则适合实时需求。选择时需考虑数据新鲜度、处理复杂性和操作能力。混合架构(如Lambda和Kappa)结合了两者的优点,适应不同场景。理解这两种模式有助于选择合适的解决方案。

Python中的高效数据处理:批处理与流处理管道解析

freeCodeCamp.org
freeCodeCamp.org · 2026-04-13T13:51:23Z

文章讨论了通过批处理、流水线和并发模型优化系统吞吐量的方法。批处理可以减少固定开销,但过大批量可能增加延迟。流水线技术通过重叠多个处理阶段提高效率,而并发模型则利用多处理单元并行处理提升性能。优化需识别瓶颈,明确目标并进行调整,以实现高效性能。

【系统架构设计】吞吐量优化:批处理、流水线与并发模型

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-04-13T00:00:00Z
什么是数据管道?

数据管道通过收集、处理和交付数据,解决数据孤岛问题,支持自动化、灵活性和实时分析。批处理适用于不需实时数据的场景,而流处理则用于需要即时反应的应用,如欺诈检测。数据管道架构包括数据收集、摄取、准备和消费,确保数据高效流动。

什么是数据管道?

Redis Blog
Redis Blog · 2026-03-30T00:00:00Z
超越批处理:Volcano演变为AI原生统一调度平台

随着大型语言模型的发展,Kubernetes成为智能系统的重要平台。新功能如Volcano v1.14、Kthena v0.3.0和AgentCube提升了资源调度效率,简化了大模型部署,并支持异构自动扩展,推动AI基础设施进步。

超越批处理:Volcano演变为AI原生统一调度平台

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-03-23T08:00:00Z
如何构建高吞吐量系统

在构建软件系统时,确保高吞吐量至关重要。吞吐量是指系统在特定时间内完成的工作量,与延迟不同。高吞吐量意味着在相同时间内处理更多事务,但可能导致延迟增加。通过批处理可以提高吞吐量,但会增加等待时间。本文探讨了构建高效系统的基本概念和策略。

如何构建高吞吐量系统

ByteByteGo Newsletter
ByteByteGo Newsletter · 2026-03-05T16:30:58Z

系统性能优化涉及延迟与吞吐量的平衡。优化措施可提升其中一项,但不当组合可能导致性能下降。批处理和微批处理提高效率,子任务并行化需谨慎调度。低精度计算和缓存平衡也是关键。整体优化需精心设计,以确保系统性能提升。

系统性能优化

Lei Mao's Log Book
Lei Mao's Log Book · 2026-02-16T08:00:00Z
从混乱到规模:使用DLT-META对Spark声明式管道进行模板化

声明式管道通过意图驱动的方式构建批处理和流处理工作流,减少自定义代码,支持可重复的工程模式。随着数据使用的增长,管道数量增加,元编程通过结构化模板解决维护和一致性问题。DLT-META项目自动化管道创建,简化数据源添加和逻辑更新,提高开发效率和一致性。

从混乱到规模:使用DLT-META对Spark声明式管道进行模板化

Databricks
Databricks · 2026-01-07T22:45:00Z
Kubernetes v1.35:Job 管理者功能正式发布

Kubernetes v1.35引入了.spec.managedBy字段,支持外部Job控制器管理Job调度,适用于多集群批处理架构。管理集群负责调度,工作集群执行任务,用户可实时查看Job进度,推动Kubernetes批处理生态系统标准化。

Kubernetes v1.35:Job 管理者功能正式发布

Kubernetes Blog
Kubernetes Blog · 2025-12-18T18:30:00Z
基于令牌计数的批处理:更快、更经济的查询嵌入推理

Voyage AI通过批处理技术提高嵌入模型的推理效率,采用去填充和基于令牌计数的策略,显著降低GPU推理延迟,提升吞吐量和资源利用率。实验表明,GPU推理延迟减少50%,在资源争用情况下,延迟更为稳定。

基于令牌计数的批处理:更快、更经济的查询嵌入推理

MongoDB
MongoDB · 2025-12-18T15:00:00Z
重新定义批处理:工作流编排为何与流处理同样现代

批处理是现代工作流编排的核心,支持关键业务和AI工作负载。它与流处理互补,选择处理方式应基于业务需求,而非技术趋势。

重新定义批处理:工作流编排为何与流处理同样现代

BMC Software | Blogs
BMC Software | Blogs · 2025-12-15T13:18:01Z
人工智能时代批处理的变革

批处理是一种持续的工作流编排,旨在优化正确性、完整性和吞吐量。现代批处理可事件驱动,支持复杂的多步骤依赖,并可实现24/7运行。它与流处理互补,适用于需要时间关联和高吞吐量的业务场景。成功实施需关注平台工程与自助服务的平衡,以及人机协作。

人工智能时代批处理的变革

BMC Software | Blogs
BMC Software | Blogs · 2025-12-15T00:00:37Z

在.NET中,LINQ查询性能可能因数据量增加而下降。为提高效率,建议使用Enumerable.Chunk进行批处理,避免中间调用.ToList(),使用DistinctBy、MaxBy和MinBy简化代码,采用ValueEnumerable流式处理异步序列,并利用ArrayPool减少内存分配。这些方法能提升代码的可读性和性能。

LINQ性能优化实战:从“能用“到“高效“的五大核心模式

dotNET跨平台
dotNET跨平台 · 2025-11-20T00:02:07Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码