小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
Go 1.28 大动作:泛型集合终于要进标准库了,Set、树形Map、堆一次性标准化

Go 官方 Collections 工作组正式提出泛型集合标准化方案,一口气带来 hash.Map、hash.Set、set.Set、tree.Map、heap/v2.Heap 等 7 个提案,并首次给出解决“二元方法问题”的抽象集合接口设计。这是 Go 语言标准库多年来最系统的一次集合类型补课。

Go 1.28 大动作:泛型集合终于要进标准库了,Set、树形Map、堆一次性标准化

Tony Bai
Tony Bai · 2026-07-28T22:00:00Z
Robo-ValueRL——面向离线到在线RL的可靠价值估计:同时捕捉全局任务进度和局部动作偏好,先离线预训练,后在线提升(即在线残差策略自适应)

本文提出Robo-ValueRL框架,旨在通过可靠的价值函数提升离线到在线强化学习在机器人操作任务中的性能。该框架包含三个关键组件:历史条件化价值估计器、质量条件化视觉-语言-动作(VLA)策略预训练和在线残差自适应模块。...

Robo-ValueRL——面向离线到在线RL的可靠价值估计:同时捕捉全局任务进度和局部动作偏好,先离线预训练,后在线提升(即在线残差策略自适应)

结构之法 算法之道
结构之法 算法之道 · 2026-07-28T06:52:35Z
世界模型有触觉了!50万小时视频,训出首个隐式触觉世界动作模型

世界模型有触觉了!50万小时视频,训出首个隐式触觉世界动作模型

量子位
量子位 · 2026-07-28T05:25:31Z
Black Forest Labs发布FLUX 3:用于图像、视频、音频和机器人动作预测的多模态流模型

Black Forest Labs (BFL) 发布了FLUX 3,这是一个多模态基础模型,可在单一架构内学习图像、视频和音频。它也是首个仅使用一组权重即可实现视频、音频和动作预测...

Black Forest Labs发布FLUX 3:用于图像、视频、音频和机器人动作预测的多模态流模型

实时互动网
实时互动网 · 2026-07-27T02:15:48Z
机器人也开始修炼「见闻色」,星尘智能发布具身基座模型 Lumo-2,让动作更快更准了

星尘智能发布了第二代具身基座模型Lumo-2和物理AI智能体Philia。Lumo-2通过预测物理变化提升机器人在家庭任务中的能力,涵盖22项家务。Philia整合多台机器人,关注用户体验,提供长期服务。这两者共同推动具身智能进入系统工程阶段,强调技术与用户体验的结合。

机器人也开始修炼「见闻色」,星尘智能发布具身基座模型 Lumo-2,让动作更快更准了

爱范儿
爱范儿 · 2026-07-15T07:58:21Z
T-WAM——用于富接触操作的视觉-触觉世界动作模型:在统一的流匹配框架下联合学习未来视觉预测、触觉形变预测以及动作预测(且在插入透明导管场景中增大触觉的权重)

VT-WAM是一种视觉-触觉世界动作模型,旨在提升机器人在复杂环境中的操作能力。它结合视觉和触觉信息,通过非对称MoT注意力和接触门控机制优化动作预测,强调触觉动态的重要性,以克服视觉信息的主导偏差。

T-WAM——用于富接触操作的视觉-触觉世界动作模型:在统一的流匹配框架下联合学习未来视觉预测、触觉形变预测以及动作预测(且在插入透明导管场景中增大触觉的权重)

结构之法 算法之道
结构之法 算法之道 · 2026-07-12T07:42:05Z
行业首个具身原生世界动作模型来了!蚂蚁灵波发布LingBot-VA 2.0

蚂蚁灵波于7月10日发布了LingBot-VA 2.0,标志着机器人基础模型从数字世界向物理世界的转变。该模型通过自回归架构和因果预训练,提升了执行速度和泛化能力,解决了具身智能的效率问题。LingBot-VA 2.0设计包括语义视觉-动作分词器和增强的异步推理机制,确保机器人在真实环境中高效执行任务。蚂蚁灵波将继续探索具身智能的潜力,并将在2026世界人工智能大会展示其技术成果。

行业首个具身原生世界动作模型来了!蚂蚁灵波发布LingBot-VA 2.0

量子位
量子位 · 2026-07-10T03:28:59Z
居家办公 5 个减少分心的动作

杜老师分享了五个减少居家办公分心的方法:1. 工作期间手机开启“勿扰”模式;2. 桌面只保留当前任务相关物品;3. 每90分钟起身休息10分钟;4. 浏览器只开1-2个工作相关标签页;5. 与伴侣约定工作时段不打扰。杜老师强调,减少分心的关键在于提前准备,而非强迫自己不分心。

居家办公 5 个减少分心的动作

杜老师说
杜老师说 · 2026-07-06T16:00:00Z
线上健身课的 RTC 技术解码:音乐节拍同步、多机位跟练与 AI 动作校准

线上健身课面临音视频同步的技术挑战,要求延迟低于100ms,以确保教练口令、背景音乐和学员动作的精准对齐。即构科技通过多音频源混合和双视频通道实现实时互动,支持直播、私教和小班教学。关键技术包括音乐节拍同步、镜面模式和AI动作检测,优化音频和视频质量,提升线上健身体验。

线上健身课的 RTC 技术解码:音乐节拍同步、多机位跟练与 AI 动作校准

实时互动网
实时互动网 · 2026-07-01T07:19:48Z
Q-Guided Flow——RL中基于流策略的推理时梯度引导:不直接在噪声动作上求Q的梯度,也不对整条去噪链做BPTT,而是一步Euler积分且把Jacobian直接换成单位矩阵

本文讨论了QGF(Q引导流)方法在强化学习中的应用,解决了扩散和流策略训练不稳定性的问题。通过预训练参考策略和价值函数,QGF利用价值梯度引导生成高价值动作,避免复杂的反向传播,从而提升策略的稳定性和可扩展性。

Q-Guided Flow——RL中基于流策略的推理时梯度引导:不直接在噪声动作上求Q的梯度,也不对整条去噪链做BPTT,而是一步Euler积分且把Jacobian直接换成单位矩阵

结构之法 算法之道
结构之法 算法之道 · 2026-06-24T04:32:42Z

了解CI Games如何使用虚幻引擎5打造备受期待的《堕落之主2》——这是一款黑暗奇幻动作角色扮演游戏,以高能量的魂类战斗为特色,玩家将探索一个地域辽阔、濒临崩解、饱经战火的王国。

<p>《堕落之主2》用UE5将该黑暗奇幻动作RPG续作推向新高度</p>

Unreal Engine
Unreal Engine · 2026-06-23T00:00:00Z
Humanoid-GPT——采用因果注意力机制的类GPT追踪器:通过扩展“数据规模、模型结构、训练多样性”,最终实现零样本动作追踪

Humanoid-GPT是一种新型的GPT风格Transformer模型,专为人形机器人的零样本运动跟踪设计。研究者利用20亿帧的动作数据进行训练,克服了以往模型在灵活性和泛化能力上的不足。该模型采用因果注意力机制,在未见过的动作和控制任务中表现出色,推动了人形智能体的通用AGI发展。

Humanoid-GPT——采用因果注意力机制的类GPT追踪器:通过扩展“数据规模、模型结构、训练多样性”,最终实现零样本动作追踪

结构之法 算法之道
结构之法 算法之道 · 2026-06-21T09:24:38Z
《钻石之手的动作》是一款未完成的、不可抗拒的奇异骰子角色扮演游戏

《Moves of the Diamond Hand》是一款独特的骰子角色扮演游戏,设定在一个充满阴暗企业和人兽混合体的世界中。玩家通过掷骰子进行各种挑战,游戏机制灵活多样,涉及烹饪、音乐等技能。尽管仍在早期测试阶段,但其丰富的剧情和幽默感令人着迷,展现了艺术在反乌托邦世界中的重要性。

《钻石之手的动作》是一款未完成的、不可抗拒的奇异骰子角色扮演游戏

The Verge
The Verge · 2026-06-20T14:00:00Z
全球首个人形机器人通用小脑来了!全球最大规模2万小时人类动作数据,实现零样本泛化

银河通用机器人发布了AstraBrain-WBC 0.5,标志着人形机器人进入“GPT时代”。该模型基于20亿帧人类动作数据,具备全身实时运动控制能力,展现出强大的泛化性和稳定性,推动机器人从单一技能学习向通用运动生成转变。

全球首个人形机器人通用小脑来了!全球最大规模2万小时人类动作数据,实现零样本泛化

量子位
量子位 · 2026-06-19T03:28:37Z
SpaceX上市后首笔大动作:600亿美元收购Cursor母公司

马斯克旗下的SpaceX宣布以600亿美元收购AI编程助手Cursor的开发商Anysphere,交易为全股票方式,预计2026年完成。此次收购将增强xAI在AI编程市场的竞争力。

SpaceX上市后首笔大动作:600亿美元收购Cursor母公司

TechWeb 全站精华
TechWeb 全站精华 · 2026-06-16T13:36:07Z
Galaxea G0.5——升级“VLA自回归建模”范式:摒弃VLM上添加动作专家的模式,而是构建统一模型,用一套权重,在同一个自回归token序列中同时生成推理与动作(含VLA-0的详解)

星海图提出的G0.5模型将视觉语言模型与动作生成统一为单一自回归序列,通过共享权重实现推理与动作的耦合,提升机器人控制效率。该模型采用可学习的动作分词器和视觉记忆模块,优化动作生成过程,减少离散化负担,能够在零样本条件下分解任务,直接生成动作,增强对复杂场景的适应能力。

Galaxea G0.5——升级“VLA自回归建模”范式:摒弃VLM上添加动作专家的模式,而是构建统一模型,用一套权重,在同一个自回归token序列中同时生成推理与动作(含VLA-0的详解)

结构之法 算法之道
结构之法 算法之道 · 2026-06-04T10:18:09Z
从看懂世界到做对动作,卧安机器人OneModel 1.7用一条「隐式通路」打通了具身智能的关键断层

卧安机器人发布了OneModel 1.7 FrontoStria-RL,该模型通过隐式传导机制将世界模型与动作执行连接,提升了家庭机器人在真实环境中的操作能力。其在标准评测中的成功率达到99%,显示出在家庭场景中的应用潜力。OneModel通过真实数据的持续反馈不断进化,推动家庭机器人向可靠工作迈进。

从看懂世界到做对动作,卧安机器人OneModel 1.7用一条「隐式通路」打通了具身智能的关键断层

量子位
量子位 · 2026-06-03T12:28:44Z

TeaQL Robot Task Board 是一个开源项目,包含应用程序、生成库和 teaql-rs 运行时。Docker 镜像仅 2.54MB,运行时内存约 3MiB,支持生成 SQL 和审计日志等功能。项目地址为 https://github.com/teaql/robot-task-board/。

家用路由器也能跑的展示业务动作到 SQL/Audit Trace 的小演示

Rust.cc
Rust.cc · 2026-06-02T15:38:24Z
τ0-WM——智元的视频-动作世界模型:组合“遥操、umi、人类第一人称视角”数据,未来视觉Latent助力动作生成,然后重新加噪去噪,若自洽取表现最好者直接执行,否则模拟推演找出最佳视觉指引重新生成

研究者提出了一种名为τ0-World Model(τ0-WM)的统一视频-动作世界模型,旨在提升机器人操作的预测能力。该模型结合视频预测、动作生成和任务评估,利用27,300小时的多样化数据进行训练。τ0-WM通过共享的预测网络,提供视频动作模型和动作条件视频模拟器两个接口,优化机器人在执行前的决策过程。

τ0-WM——智元的视频-动作世界模型:组合“遥操、umi、人类第一人称视角”数据,未来视觉Latent助力动作生成,然后重新加噪去噪,若自洽取表现最好者直接执行,否则模拟推演找出最佳视觉指引重新生成

结构之法 算法之道
结构之法 算法之道 · 2026-06-01T04:30:18Z
机器人原生世界动作模型问世!首创时空一体架构,复旦系团队出品

眸深智能推出STI-WM时空一体世界动作模型,旨在解决机器人自主感知与决策的难题。该模型通过时空一体化建模和物理一致性约束,提升机器人在真实物理世界中的表现。团队由复旦大学专家组成,已获得多项国际荣誉,并与多家行业领军企业合作,推动AGI技术发展。

机器人原生世界动作模型问世!首创时空一体架构,复旦系团队出品

量子位
量子位 · 2026-05-31T10:13:21Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码