小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

Kubernetes v1.37将Workload/PodGroup API及gang调度升级为Beta,引入CompositePodGroup API支持多层级调度和拓扑感知,并扩展抢占与DRA共享。新增控制器集成API和workloadbuilder库,Job控制器原生支持显式调度。这些改进旨在优化AI/ML等复杂批处理工作负载的调度效率。

Kubernetes v1.37:推进工作负载感知调度

Kubernetes Blog Kubernetes Blog · 2026-09-08T18:30:00Z
压箱底办公神器:一键搞定Word、Excel、PDF、PPT、图片的批处理工具,效率翻倍!

鹰迅批量处理工具是一款无需登录的办公软件,支持Word、Excel、PDF、PPT、图片等格式,提供200种功能,如格式转换、批量修改、水印处理等,可离线批量处理数千文件,保障数据安全,旨在提升办公效率,告别繁琐手动操作。

压箱底办公神器:一键搞定Word、Excel、PDF、PPT、图片的批处理工具,效率翻倍!

小众软件 小众软件 · 2026-09-07T07:42:03Z
什么是数据转换?

数据转换是将原始数据清洗、过滤、聚合、连接和标准化为可用数据集的过程,对提升数据质量、支持决策和ETL流程至关重要。它涉及去重、精炼、集成等技术,可通过批处理或流式处理执行,工具选择包括云端、开源或低代码等。Databricks提供Spark声明式管道和Lakeflow Jobs等工具,简化ETL开发,确保数据质量,并支持实时或批量处理,助力企业高效利用数据。

什么是数据转换?

Databricks Databricks · 2026-09-03T19:54:00Z
LLM推理中的静态、动态与连续批处理

静态批处理等待批次满后才运行,延迟高;动态批处理通过超时窗口改善等待,但批次内仍受最慢请求影响;连续批处理以解码步骤为单位调度,序列完成即释放槽位,吞吐量高,适合生产级LLM服务。

LLM推理中的静态、动态与连续批处理

MachineLearningMastery.com MachineLearningMastery.com · 2026-08-04T12:00:10Z

本文讨论了FoundationDB的Proxy层,包括Grv Proxy和Commit Proxy的角色与功能。Grv Proxy负责发放读版本并检查日志存活,Commit Proxy处理事务提交和冲突检测。通过拆分这两个角色,系统能够更好地扩展和优化性能。Ratekeeper控制读版本的发放速率,以防止过载,从而提高事务处理的效率和安全性。

【FoundationDB 内核】Proxy:Grv 与 Commit、批处理与 read version

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-17T00:00:00Z
流处理与批处理:数据处理的两种哲学

数据处理主要有两种方法:批处理和流处理。批处理在数据完整后进行计算,适合处理完整数据集;流处理则实时处理不断到来的数据,优先考虑速度。两者在完整性和延迟之间存在权衡,流处理需要估算数据到达情况。

流处理与批处理:数据处理的两种哲学

ByteByteGo Newsletter ByteByteGo Newsletter · 2026-07-09T15:31:10Z

本文探讨了分布式OLAP查询引擎Trino和DuckDB如何通过批量处理提升性能,强调向量化执行的重要性,指出逐行处理会浪费CPU资源。文章比较了不同引擎的批处理结构和调度机制,介绍了DuckDB的morsel-driven并行模型及其内存数据布局,并通过实验展示了DuckDB在查询性能上的优势。

【分布式 OLAP 查询引擎】向量化批处理与 Morsel-Driven 并行

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-07T00:00:00Z
从批处理到链上 一线工程师拆解衍生品CBDC测试

香港交易及结算所与金融管理局于2026年6月18日启动了衍生品收市后数码港元试点,首次在复杂衍生品场景中应用央行数字货币(CBDC)进行预缴按金支付。

从批处理到链上 一线工程师拆解衍生品CBDC测试

mongona news mongona news · 2026-06-27T03:46:26Z
动态批处理:实用指南

动态批处理通过实时组合多个推理请求,提高GPU利用率并减少延迟。语义缓存在请求到达推理队列前识别并重用相似查询的响应,从而降低成本和延迟。Redis为AI工作负载提供高效的实时数据平台,优化推理性能。

动态批处理:实用指南

Redis Blog Redis Blog · 2026-06-21T00:00:00Z
什么是数据管道架构?

数据管道架构是设计数据从源系统到应用和模型的过程,包括数据的收集、处理、存储和交付。架构分为逻辑设计和物理设计,定义数据流动的步骤和工具。数据管道可分为批处理和流处理,适用于不同用例。现代平台如Databricks通过Lakeflow统一这两种处理方式,简化架构,提高数据的可靠性和可用性。

什么是数据管道架构?

Databricks Databricks · 2026-06-16T21:23:03Z

本文介绍了五个Python脚本,旨在自动化处理PDF文件的常见任务,包括合并与拆分PDF、提取文本和表格、添加水印和页码、删除敏感内容,以及提取元数据生成PDF清单。这些脚本支持批处理,提升了工作效率。

5个实用的Python脚本来自动化处理无聊的PDF任务

KDnuggets KDnuggets · 2026-06-10T12:00:44Z
同时服务多个用户:连续批处理如何提高大语言模型推理效率

本文探讨了通过动态调度和不规则批处理提高大语言模型(LLM)推理效率的方法。动态调度允许在每个解码步骤后立即接收新请求,避免了静态批处理中短请求等待长请求的问题,从而减少GPU资源浪费。不规则批处理通过合并多个提示,减少填充令牌的浪费,进一步提升推理速度。最终,连续批处理显著提高了LLM的推理效率。

同时服务多个用户:连续批处理如何提高大语言模型推理效率

MachineLearningMastery.com MachineLearningMastery.com · 2026-05-30T02:54:17Z
Python中的高效数据处理:批处理与流处理管道解析

在编写数据管道代码前,需要选择批处理或流处理。批处理适合处理历史数据,适用于数据新鲜度要求低的场景;流处理则适合实时需求。选择时需考虑数据新鲜度、处理复杂性和操作能力。混合架构(如Lambda和Kappa)结合了两者的优点,适应不同场景。理解这两种模式有助于选择合适的解决方案。

Python中的高效数据处理:批处理与流处理管道解析

freeCodeCamp.org freeCodeCamp.org · 2026-04-13T13:51:23Z

文章讨论了通过批处理、流水线和并发模型优化系统吞吐量的方法。批处理可以减少固定开销,但过大批量可能增加延迟。流水线技术通过重叠多个处理阶段提高效率,而并发模型则利用多处理单元并行处理提升性能。优化需识别瓶颈,明确目标并进行调整,以实现高效性能。

【系统架构设计】吞吐量优化:批处理、流水线与并发模型

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-04-13T00:00:00Z
什么是数据管道?

数据管道通过收集、处理和交付数据,解决数据孤岛问题,支持自动化、灵活性和实时分析。批处理适用于不需实时数据的场景,而流处理则用于需要即时反应的应用,如欺诈检测。数据管道架构包括数据收集、摄取、准备和消费,确保数据高效流动。

什么是数据管道?

Redis Blog Redis Blog · 2026-03-30T00:00:00Z
超越批处理:Volcano演变为AI原生统一调度平台

随着大型语言模型的发展,Kubernetes成为智能系统的重要平台。新功能如Volcano v1.14、Kthena v0.3.0和AgentCube提升了资源调度效率,简化了大模型部署,并支持异构自动扩展,推动AI基础设施进步。

超越批处理:Volcano演变为AI原生统一调度平台

Cloud Native Computing Foundation Cloud Native Computing Foundation · 2026-03-23T08:00:00Z
如何构建高吞吐量系统

在构建软件系统时,确保高吞吐量至关重要。吞吐量是指系统在特定时间内完成的工作量,与延迟不同。高吞吐量意味着在相同时间内处理更多事务,但可能导致延迟增加。通过批处理可以提高吞吐量,但会增加等待时间。本文探讨了构建高效系统的基本概念和策略。

如何构建高吞吐量系统

ByteByteGo Newsletter ByteByteGo Newsletter · 2026-03-05T16:30:58Z

系统性能优化涉及延迟与吞吐量的平衡。优化措施可提升其中一项,但不当组合可能导致性能下降。批处理和微批处理提高效率,子任务并行化需谨慎调度。低精度计算和缓存平衡也是关键。整体优化需精心设计,以确保系统性能提升。

系统性能优化

Lei Mao's Log Book Lei Mao's Log Book · 2026-02-16T08:00:00Z
从混乱到规模:使用DLT-META对Spark声明式管道进行模板化

声明式管道通过意图驱动的方式构建批处理和流处理工作流,减少自定义代码,支持可重复的工程模式。随着数据使用的增长,管道数量增加,元编程通过结构化模板解决维护和一致性问题。DLT-META项目自动化管道创建,简化数据源添加和逻辑更新,提高开发效率和一致性。

从混乱到规模:使用DLT-META对Spark声明式管道进行模板化

Databricks Databricks · 2026-01-07T22:45:00Z
Kubernetes v1.35:Job 管理者功能正式发布

Kubernetes v1.35引入了.spec.managedBy字段,支持外部Job控制器管理Job调度,适用于多集群批处理架构。管理集群负责调度,工作集群执行任务,用户可实时查看Job进度,推动Kubernetes批处理生态系统标准化。

Kubernetes v1.35:Job 管理者功能正式发布

Kubernetes Blog Kubernetes Blog · 2025-12-18T18:30:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码