小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Kimi K3 模型结构(10):RL 与服务,状态住在哪里

本文介绍Kimi K3模型在1M上下文强化学习与线上服务中的系统设计,核心是状态管理。KV块和KDA状态通过write-back策略在GPU与DRAM池间迁移,训练态让位NVMe,参考模型权重借梯度缓冲槽位流入GPU,沙箱支持pause/fork/snapshot,集群调度采用缓存亲和与预算准入,确保资源高效利用。

Kimi K3 模型结构(10):RL 与服务,状态住在哪里

Java不加糖's Blog Java不加糖's Blog · 2026-09-05T21:00:00Z

本文比较了XState与EffectTS在业务工作流中的工程能力。XState通过显式状态、事件和Actor模型,实现虚拟时间测试、重试、取消、依赖替换、资源清理、可观测性和状态持久化等特性,同时保持普通TypeScript语法。Effect依赖fiber运行时持有续延,而XState将续延展开为数据。两者复杂度位置不同,XState适合UI、订单、支付等流程,无需全面改写为Effect程序。

20260828 使用 XState 实现 EffectTS 宣称的特性,并保持 TS 语法

蒋继发 (ThaddeusJiang) 蒋继发 (ThaddeusJiang) · 2026-08-28T17:12:41Z
每个AI代理部署前应通过的7项回归测试

本文介绍了AI代理部署前应通过的七项回归测试,涵盖上下文丢失、工具幂等性、提示注入、结构化输出、非终止、RAG接地和状态恢复。这些测试针对编排层状态管理问题,而非模型智能,适合CI/CD门控。文章强调状态与记忆的区别,并指出测试的局限性和持续运行的重要性。

每个AI代理部署前应通过的7项回归测试

MachineLearningMastery.com MachineLearningMastery.com · 2026-08-17T12:00:15Z

作者认为数据库比RL更复杂,因为数据库需维护跨事务、会话、崩溃的状态正确性,而RL链路虽长但近乎无状态。他通过绘制数据流图掌控系统,并详细描述了RL训练环:派发、rollout、凑batch、reward、advantage、训练、权重同步。他强调骨架简单但每跳细节复杂,如轨迹树、版本差、切分等,需先理解整体再深入。

RL 其实很简单

学习让我快乐 学习让我快乐 · 2026-08-07T16:00:00Z
集群MQTT血泪史:最蠢的就是不管状态场景,统一用一种一致性算法

该文探讨分布式系统中的状态管理,主张按语义分类状态而非追求统一一致性。通过集群MQTT内存爆炸案例,提出五类状态(连接所有权、离线状态、路由、持久消息、成员关系),每类对应不同保障和机制(如共识、哈希、AP路由、同步存储、Gossip)。核心原则是“语义定保障,保障定机制”,避免过度复制,实现资源高效。

集群MQTT血泪史:最蠢的就是不管状态场景,统一用一种一致性算法

极道 极道 · 2026-08-06T22:04:00Z
使用LangGraph在Python中构建代理工作流

本文介绍如何使用LangGraph在Python中构建代理工作流,涵盖状态、节点和边的基本概念,通过MessagesState管理对话历史,在节点中调用模型,注册工具并路由工具调用,以及使用检查点持久化跨会话的对话。文章从基础图构建到工具使用代理,逐步演示完整流程,并强调LangGraph组件的独立性和可扩展性。

使用LangGraph在Python中构建代理工作流

MachineLearningMastery.com MachineLearningMastery.com · 2026-07-20T11:27:18Z
AI 内存别只当概念看:它其实是状态管理问题

AI内存并非概念,而是工程化的状态管理问题,涉及上下文窗口、会话摘要、向量库等层次,核心难点在于数据边界、删除、隔离和回滚。小团队应保守实现,优先可解释、可删除、可观测的小记忆,并监控检索命中率和成本,避免模型沿旧信息误导。

AI 内存别只当概念看:它其实是状态管理问题

mongona news mongona news · 2026-07-19T22:39:08Z
掌握React Native全栈移动开发

本文介绍了一个新的免费课程,教授如何从零开始构建跨平台的React Native应用程序。课程内容包括开发一个功能丰富的购物清单应用,使用Expo和React Native作为核心框架,集成Neon Postgres数据库和Drizzle ORM进行数据管理,实施安全用户认证,使用NativeWind进行样式设计,以及使用Zustand进行全局状态管理。此外,课程还教你如何集成Sentry以捕获用户反馈。

掌握React Native全栈移动开发

freeCodeCamp.org freeCodeCamp.org · 2026-07-16T11:32:57Z
如何在React中构建Shadcn Sheet组件:购物车和过滤面板示例

本文介绍了如何使用shadcn/ui构建购物车和过滤面板两个Sheet组件。购物车组件支持商品数量调整和实时小计,过滤面板包含类别复选框、价格范围滑块和星级评分过滤。教程涵盖组件的安装、状态管理和布局最佳实践,帮助开发者创建直观且易于维护的侧边面板体验。

如何在React中构建Shadcn Sheet组件:购物车和过滤面板示例

freeCodeCamp.org freeCodeCamp.org · 2026-07-13T14:13:49Z

本文讨论流式数据处理的规划,重点在于Kafka与Flink的结合。内容涵盖流处理基础、Kafka内核、Flink运行时、状态管理及交付语义,旨在解决实时数据链路中的关键问题,如事件时间、窗口处理、状态管理及故障模式。目标读者为数据平台工程师,帮助他们理解流式计算与批处理的差异,以及如何有效运维Kafka和Flink管道。

流式数据处理 — 系列规划

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-09T15:54:06Z
使用TypeScript提升你的React技能

我们在freeCodeCamp.org的YouTube频道发布了一部新教程,教你如何在React中使用TypeScript。该课程适合希望提高代码安全性和可读性的开发者,涵盖TypeScript基础、状态管理、组件架构和函数属性等内容,帮助有效捕捉错误。

使用TypeScript提升你的React技能

freeCodeCamp.org freeCodeCamp.org · 2026-07-08T14:28:51Z

本文讨论了Flink中EmbeddedRocksDBStateBackend的机制,重点在于KeyGroup前缀、增量checkpoint的实现及其与RocksDB的关系。增量checkpoint依赖于不可变SST文件和MANIFEST,以确保数据一致性。文章还比较了Flink、TiKV和Kafka Streams在状态管理和容错机制上的差异,强调了设计与参数调优的重要性。

【RocksDB 内核机制】生产嵌入对照:Flink · TiKV · Kafka Streams

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-07T00:00:00Z

本文介绍了2026年值得关注的十种代理AI框架,包括LangGraph、CrewAI和OpenAI Agents SDK等。每种框架具有独特优势,如LangGraph适合复杂状态机,CrewAI便于快速构建多代理工作流。选择合适的框架时需考虑控制、状态管理和可观察性等需求。代理AI领域发展迅速,框架也在不断演变。

2026年值得关注的十种代理AI框架

KDnuggets KDnuggets · 2026-07-02T14:00:42Z

本文讨论了Flink DataStream API的工作原理,包括作业结构、数据流转换、shuffle策略及其对性能的影响。重点介绍了keyBy操作、ProcessFunction的使用及定时器注册,强调了状态管理在流处理中的重要性,并通过示例展示了事件时间和窗口聚合的处理,简要说明了Flink 2.x版本。

【流式数据处理】DataStream 与算子语义

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-01T00:00:00Z

本文探讨了Flink中RocksDB的状态管理与优化,分析了状态膨胀的原因及其对磁盘占用的影响,主要涉及窗口状态、TTL和MapState的无限增长等问题。提出通过调整RocksDB参数和设计来优化性能,强调在hot key倾斜情况下,改进状态设计比单纯调参更有效,并提供了调优建议和监控指标。

【流式数据处理】状态放大、Compaction 与调优

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-01T00:00:00Z

本文讨论了Flink中的Keyed State及其管理,介绍了五种状态类型(ValueState、ListState、MapState、ReducingState、AggregatingState)的适用场景和特点。同时分析了HashMapStateBackend与EmbeddedRocksDBStateBackend的优缺点,以及状态的TTL配置和清理策略。最后,提供了状态大小估算的方法,指出滑动窗口和无限MapState可能导致的状态膨胀问题。

【流式数据处理】键控状态与 State TTL

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-01T00:00:00Z
如何构建可扩展且易于维护的大型Flutter应用程序架构

Flutter应用程序在扩展时面临复杂性,建议通过围绕业务能力组织代码,明确责任边界,分离表现层、业务逻辑和数据层,以提高可维护性。有效的状态管理和导航设计也很重要,避免不必要的全局状态和依赖注入。良好的架构应使复杂性可理解,并随着团队和应用的演变而逐步改进。

如何构建可扩展且易于维护的大型Flutter应用程序架构

freeCodeCamp.org freeCodeCamp.org · 2026-06-23T16:39:20Z
AI编排到底是什么:概念、工具与避坑指南

AI编排是管理多个AI模型的层,负责任务路由、状态管理、工具调用和重试机制,确保任务按顺序执行并避免冲突。它协调不同AI的工作,处理复杂的多步骤任务。设计时需考虑模型的不确定性,确保流程稳健,避免因模型错误导致的失败。选择工具时应关注实际需求,保持简单有效。

AI编排到底是什么:概念、工具与避坑指南

极道 极道 · 2026-06-22T07:10:00Z
一分钟读论文:《当工具失败时:LLM智能体的动态重规划与异常恢复基准测试》

腾讯优图实验室与中山大学、清华大学合作的研究评估了大型语言模型(LLM)智能体在工具失败场景下的动态重规划能力。研究表明,隐式语义失败的恢复难度远高于显式故障,复杂的拓扑结构可能导致智能体陷入无效循环。此外,动态重规划能力的提升滞后于基本性能,强调了状态管理与异常检测结合的重要性。

一分钟读论文:《当工具失败时:LLM智能体的动态重规划与异常恢复基准测试》

Micropaper Micropaper · 2026-06-21T00:00:00Z

本文探讨了构建无模型依赖的漏洞检测系统的方法。通过更换和交叉测试不同的AI模型,确保漏洞检测的全面性和准确性。系统分为漏洞发现和验证两个阶段,利用多个代理进行任务分配和状态管理,以提高效率和减少错误。最终目标是实现跨多个代码库的安全性,确保每个发现经过严格验证,并提供可靠的修复建议。

构建自己的漏洞检测系统

The Cloudflare Blog The Cloudflare Blog · 2026-06-18T17:59:40Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码