➡️
继续阅读
-
Kimi K3 模型结构(10):RL 与服务,状态住在哪里
本文介绍Kimi K3模型在1M上下文强化学习与线上服务中的系统设计,核心是状态管理。KV块和KDA状态通过write-back策略在GPU与DRAM池间...
-
StickMe 隐私政策
StickMe是一款本地优先的动作记录应用,无需注册账号,不收集或上传个人数据,无广告及第三方SDK。相机画面仅用于本地识别人体骨骼动作,不分享真人画面。...
-
AI代理评估是产品的一部分
该文讨论AI代理(Agent)的评估问题。文章指出,演示成功不代表系统可靠,需将评估纳入交付流程。建议建立可重复的评估系统,使用固定场景和真实任务,记录完...
-
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
星尘智能发布SmoothRL框架,解决真实机器人异步执行中的在线强化学习问题。该框架仅对实际执行的动作进行学习,并保持训练与部署节奏一致。在投掷、戴笔帽、...
-
CEO的1元年薪起源 - 编程一生
手机更新换代,背后的安迪-比尔定理。还有其他一些大家天天接触但很多人没有深究的一些现象都是怎么产生的呢? 又要换手机了 现象 很多朋友都发现这种事情,刚买...
-
GPT-6 Astra画出初音未来:Midjourney和DALL-E都做不到这一步!
GPT 6 Astra 像真人一样一笔一笔画出初音未来,AI画画的方式被彻底颠覆了! 你以前看到的AI画图,都是敲一行字然后“啪”一下蹦出一张图。但202...