小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Zero-WAM——基于人类视频的上下文世界-动作建模:面对未见任务,给一段人类示范视频作为prompt,不微调直接输出对应的机器人未来视频和可执行动作

蚂蚁灵波与港科大联合提出Zero-WAM,一种因果视频-动作模型,通过上下文学习实现机器人零样本跨任务泛化。它利用人类视频作为任务描述,并构建HumanGen数据集(含8.6K任务、74.2K人机样本),提出上下文未来片段预测目标,避免模型走捷径,从而从视频中提取任务信息执行未见任务。

Zero-WAM——基于人类视频的上下文世界-动作建模:面对未见任务,给一段人类示范视频作为prompt,不微调直接输出对应的机器人未来视频和可执行动作

结构之法 算法之道 结构之法 算法之道 · 2026-09-09T15:44:36Z
机器人运动误差降低90.4%,英伟达/哈佛等提出Hydra-0,用Action Flow统一世界建模与控制

英伟达与哈佛等团队提出Hydra-0,一种以动作流为条件的通用世界模型,将机器人动作表示为像素运动,统一跨本体、任务和环境的预测。该模型降低机器人运动误差90.4%,物体运动误差60.2%,支持零样本组合,并在RoboLab中预测成功率与真实结果高度相关(r=0.96),同时实现高效推理和真实世界验证。

机器人运动误差降低90.4%,英伟达/哈佛等提出Hydra-0,用Action Flow统一世界建模与控制

HyperAI超神经 HyperAI超神经 · 2026-09-08T12:13:51Z
系统设计两种抽象:Java藏细节 TLA+砍细节 根本两码事!

本文区分系统设计中两种抽象:模块化抽象(如Java)通过隐藏内部细节简化使用,建模抽象(如TLA+)通过削减无关信息提炼核心以精确推理。前者隐藏并发,后者暴露并发以验证安全性。工业界如亚马逊已用TLA+发现深层缺陷,但模型回填真实系统仍存挑战。

系统设计两种抽象:Java藏细节 TLA+砍细节 根本两码事!

极道 极道 · 2026-09-05T07:48:00Z
Fable 5.1世界建模案例fable51-worlds:几天生成一个三维城市

fable51-worlds项目利用AI智能体集群,在数天内将旧金山街区数据转化为可交互三维场景,替代了传统数千小时的人工建模。该项目通过Claude Fable 5.1调度研究、建模、质检智能体,成本极低,并成功处理NASA数据生成金星地形图,展示了通用空间智能引擎自动生成可交互世界的能力。

Fable 5.1世界建模案例fable51-worlds:几天生成一个三维城市

极道 极道 · 2026-09-02T22:22:00Z
SwiftData:优化从建模开始

SwiftData 处理大数据集时性能不佳,主要因为缺少惰值机制,查询即加载全部属性,导致内存占用高。建议按使用频率拆分模型,将详情字段放入关联对象,列表仅加载轻量数据。临时方案可用 fetchIdentifiers 配合 HistoryObserver,但非最佳。核心是设计时避免宽模型,以提升列表性能。

SwiftData:优化从建模开始

肘子的Swift记事本 肘子的Swift记事本 · 2026-09-02T14:00:00Z
宇树消防机器人来了!能灭火、会建模,还能跟被困者语音聊天!

宇树科技发布四足机器人消防应急方案,推出智能水炮、侦测、搬运等多款机器狗,具备双向语音对讲、实时三维建模、高速高负载等特性,强调协同作战,实现人机配合的智慧消防闭环,提升救援效率与安全性。

宇树消防机器人来了!能灭火、会建模,还能跟被困者语音聊天!

TechWeb 全站精华 TechWeb 全站精华 · 2026-09-01T08:47:19Z
AIVC只是前菜!复旦提出生命算子,统一生命建模

复旦大学王烁团队提出“生命算子”框架,将生命视为多尺度动力系统,通过感知、演化、生成三类算子及尺度桥,实现从细胞到器官的跨尺度推演。该框架已在消化内镜、肾癌、心脏等领域应用,并孵化Cardio-World项目,旨在构建可验证的虚拟临床系统,推动医疗智能发展。

AIVC只是前菜!复旦提出生命算子,统一生命建模

量子位 量子位 · 2026-09-01T04:12:49Z
一分钟读论文:《贝叶斯伙伴建模与 LLM 协同重规划》

论文提出BayesBeliefAgent,针对多智能体系统中伙伴中途换策略而智能体反应迟缓的问题,结合GPT-4o规划器与贝叶斯追踪,仅在动作与推断技能矛盾时触发重规划。在Overcooked基准上,该法将信念-行动差距从0.41降至0.20,重规划次数减少20-80倍,但Forced Coordination布局收益有限。

一分钟读论文:《贝叶斯伙伴建模与 LLM 协同重规划》

Micropaper Micropaper · 2026-08-20T00:00:00Z
AI论文评述:通过估计数据分布的梯度进行生成建模

本文介绍2019年Song与Ermon提出的基于分数的生成建模框架。该方法不直接学习数据分布,而是学习其分数(对数密度梯度),通过分数匹配训练噪声条件分数网络(NCSN),并用退火朗之万动力学从噪声中采样。多级高斯噪声扰动解决了流形假设和低密度区域问题,在CIFAR-10上取得先进结果,为现代扩散模型奠定基础。

AI论文评述:通过估计数据分布的梯度进行生成建模

freeCodeCamp.org freeCodeCamp.org · 2026-08-12T21:35:20Z
CI/CD中的影子AI:从开发者笔记本到Kubernetes的威胁建模路径

本文探讨云原生交付中的“影子AI”风险,即未经批准的AI工具或代理在软件生命周期中访问代码、密钥和云环境。文章按开发笔记本、源码控制、CI/CD、Kubernetes运行时等阶段进行威胁建模,并提出治理措施:为AI代理分配身份、最小权限、短期凭证,使用Kyverno、Falco、SPIFFE/SPIRE等CNCF工具加强策略、检测和供应链安全,强调人类审批和防御纵深,确保AI可控可审计。

CI/CD中的影子AI:从开发者笔记本到Kubernetes的威胁建模路径

Cloud Native Computing Foundation Cloud Native Computing Foundation · 2026-08-07T11:00:00Z
使用Redex建模Actor:第三部分

本文介绍使用PLT Redex建模Actor系统时,通过减少不可观察的非确定性来提高效率。作者将内部计算与通信效果分离,合并发送和投递规则,并采用贪婪归约,使示例程序的评估时间从1015毫秒降至2毫秒,状态数从74减至13。最终模型更简洁,能更真实地反映Actor的观察能力,但要求Actor不发散。

使用Redex建模Actor:第三部分

eighty-twenty news eighty-twenty news · 2026-08-03T13:10:46Z
使用 Amazon Athena 分析 Kiro 团队用量报表:动态模型列的数据建模实践

本文介绍使用Amazon Athena分析Kiro团队用量报表的实践。针对CSV中动态模型列可能导致数据错位的问题,通过ETL将宽表转为长表,采用Parquet格式和Partition Projection建表,实现稳定查询。方案完全Serverless化,月成本低于1美元,并接入Amazon QuickSight构建看板,便于团队观测用量、治理额度。

使用 Amazon Athena 分析 Kiro 团队用量报表:动态模型列的数据建模实践

亚马逊AWS官方博客 亚马逊AWS官方博客 · 2026-07-29T08:26:45Z
一分钟读论文:《Agentic Real2Sim:用视觉语言代理实现物理世界建模》

UCLA、MIT和UCSD团队提出Agentic Real2Sim框架,利用视觉语言代理自动将真实物体-机器人交互转换为可仿真环境,无需人工干预。该框架通过视觉重建、物理参数推断等步骤,处理刚性、可变形物体及人形运动场景,使用开源VLM后端降低成本,提升机器人策略学习的可扩展性和效率。

一分钟读论文:《Agentic Real2Sim:用视觉语言代理实现物理世界建模》

Micropaper Micropaper · 2026-07-27T00:00:00Z

本文介绍纯代码合成钢琴音色的校准过程。作者通过残差迭代法,而非指标逼近,逐步分离锤击瞬态、音板共鸣和噪声,将残差降至-21.7dB。关键发现包括:高次泛音呈双偏振结构、起音检测需精修、高频段实为随机噪声、需用投影相干度区分真实泛音,并强调同相激发的重要性。最终计划拟合全键规律,生成更纯净的合成钢琴音色。

物理建模钢琴音色校准:40 条血泪经验

茜文的博客 茜文的博客 · 2026-07-26T18:24:13Z
Firestore数据建模指南:嵌入式文档与引用(附博客案例研究)

Firestore作为NoSQL文档数据库,设计时应以读取模式而非写入模式为基准,核心是反规范化,通过嵌入或引用减少读取次数,但需注意1MB文档限制、复合索引和热点问题。关系建模涵盖1-1、1-N和N-N,常用子集合、根集合引用或ID数组实现,避免深层嵌套和自增ID,并同步设计安全规则。

Firestore数据建模指南:嵌入式文档与引用(附博客案例研究)

freeCodeCamp.org freeCodeCamp.org · 2026-07-24T15:19:10Z
AI-DLC 在数据工程中的实践:从分层建模到数据质量的全流程协作

本文介绍亚马逊云科技提出的AI-DLC开发方法论在数据工程中的实践。AI-DLC强调AI执行、人做关键决策,通过Inception、Construction、Operations三阶段及Human Gate审查节点,应用于dbt分层建模和数据质量管理。实战显示,该方法将需求到规格时间从数天缩短至数小时,提升测试覆盖率,实现隐性知识显性化,带来工程纪律的系统性升级。

AI-DLC 在数据工程中的实践:从分层建模到数据质量的全流程协作

亚马逊AWS官方博客 亚马逊AWS官方博客 · 2026-07-21T07:46:31Z

加州大学洛杉矶分校与华盛顿大学合作提出了一种名为MemCon的记忆管理方法,将Agent的记忆操作建模为马尔可夫决策过程。该方法通过在线学习检索策略,自适应决定信息检索的时机和方式,显著提升任务成功率并减少token消耗。实验结果显示,MemCon在六个基准测试中成功率提升最高达15.2分,token使用量减少5%至20%。该方法可无缝集成到现有记忆系统中,具有良好的实用价值。

一分钟读论文:《Memory as a Controlled Process:Agent记忆操作的马尔可夫决策建模》

Micropaper Micropaper · 2026-07-16T00:00:00Z
产品实验与提升建模:将您的LLM功能推出目标定位于真正受益的用户(Python实现)

文章讨论了在产品实验中使用提升建模优化AI功能的推出策略。提升建模通过估计每个用户的条件平均处理效应(CATE),识别最能从新功能中受益的用户,实现分层推出,最大化用户价值并减少干扰。文中还介绍了使用Python和scikit-learn实现提升建模的具体步骤。

产品实验与提升建模:将您的LLM功能推出目标定位于真正受益的用户(Python实现)

freeCodeCamp.org freeCodeCamp.org · 2026-07-09T17:06:32Z
重新构想湖屋上的数据建模:介绍Vibe数据建模

Vibe数据建模是一种多模型LLM代理,能够将企业的简单描述转化为可部署的Silver层数据模型。该模型通过四个阶段的管道构建,确保数据的准确性和一致性,用户可以根据需求进行迭代,快速实现数据产品的交付。

重新构想湖屋上的数据建模:介绍Vibe数据建模

Databricks Databricks · 2026-07-06T20:40:00Z
Arxiv | MagiCodec:高斯噪声注入与多阶段训练实现高保真可建模音频编码

本文介绍了MagiCodec,一种高性能的单层流式音频编解码器。通过高斯噪声注入和三阶段训练,MagiCodec在保持高保真重建的同时,提升了token的语义可建模性。实验结果表明,其在重建质量和下游任务上均超越现有技术,且token分布符合齐普夫定律,适合音频语言模型。

Arxiv | MagiCodec:高斯噪声注入与多阶段训练实现高保真可建模音频编码

实时互动网 实时互动网 · 2026-06-29T08:42:28Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码