小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
τ0-VLA——具有世界模型“引导测试时计算”的分层机器人模型:首先生成多个子任务候选,然后世界模型预演,最后价值模型评估

本文摘要:τ0-VLA提出了一种分层机器人基础模型,通过世界模型引导的测试时计算来提升长时程任务中的决策质量。该系统采用高层策略生成候选子任务,结合世界模型预测视觉结果和价值模型评估候选方案,形成"提案-预测-评估"的推理循环。低层策略则在统一动作空间上执行生成的子任务,支持多种机器人形态操作。实验表明,这种分层推理机制显著提高了任务成功率和子任务预测准确率。该方法创新性地将语言子任务搜索与...

τ0-VLA——具有世界模型“引导测试时计算”的分层机器人模型:首先生成多个子任务候选,然后世界模型预演,最后价值模型评估

结构之法 算法之道
结构之法 算法之道 · 2026-07-29T12:27:03Z
Robo-ValueRL——面向离线到在线RL的可靠价值估计:同时捕捉全局任务进度和局部动作偏好,先离线预训练,后在线提升(即在线残差策略自适应)

本文提出Robo-ValueRL框架,旨在通过可靠的价值函数提升离线到在线强化学习在机器人操作任务中的性能。该框架包含三个关键组件:历史条件化价值估计器、质量条件化视觉-语言-动作(VLA)策略预训练和在线残差自适应模块。...

Robo-ValueRL——面向离线到在线RL的可靠价值估计:同时捕捉全局任务进度和局部动作偏好,先离线预训练,后在线提升(即在线残差策略自适应)

结构之法 算法之道
结构之法 算法之道 · 2026-07-28T06:52:35Z
LoHoSearch 开源后,搜索智能体评测该往真实任务靠一靠了

美团开源 LoHoSearch,把搜索智能体评测从刷高分拉回到复杂任务和证据链上。对工程团队来说,重点不是模型会不会搜索,而是它在真实查询、外部依赖、成本和故障场景里能不能被接住。

LoHoSearch 开源后,搜索智能体评测该往真实任务靠一靠了

mongona news
mongona news · 2026-07-27T22:38:22Z
不是模型变慢了,是任务变大了 - 肘子的 Swift 周报 #146

最近,即便是一些我认为并不算复杂的工作,AI 交付结果也常常需要几分钟,甚至几十分钟。这让我产生了一种错觉:难道随着模型能力不断增强,速度只能越来越慢?

不是模型变慢了,是任务变大了 - 肘子的 Swift 周报 #146

肘子的Swift记事本
肘子的Swift记事本 · 2026-07-27T14:00:00Z
Open Minis 宣布开源:比 Siri 更像 AI 助手,让手机帮你完成任务。支持 iOS、Android

Open Minis 是一款在手机上的 Agent 应用。昨天,开发者 @Ethan 宣布 Open Minis 开源,支持 iOS 与 Android。@Appinn 经过 3-4 个月的迭代,Open Minis — “可能是你手机上最好的 Agent 应用” — 已稳定为成熟架构,现在为数万用

Open Minis 宣布开源:比 Siri 更像 AI 助手,让手机帮你完成任务。支持 iOS、Android

小众软件
小众软件 · 2026-07-26T09:31:06Z
数字员工的成本账:OpenClaw.NET 如何用工程化实现"成功任务的单位经济学"(下) - 张善友

当"有用智能每人民币"的框架落地到 OpenClaw.NET 的技术栈中,Harness 引擎、MetaSkill DAG、TokenHub 与本体投影形成了一条完整的"成功任务成本优化链"。数字员工不是"会聊天的工具",而是"可算账的生产力系统"。

数字员工的成本账:OpenClaw.NET 如何用工程化实现"成功任务的单位经济学"(下) - 张善友

张善友
张善友 · 2026-07-23T03:56:00Z
百度文心助手任务Agent登顶国际权威榜单,超越Claude、GPT拿下全球智能体冠军

百度文心助手任务Agent登顶国际权威榜单,超越Claude、GPT拿下全球智能体冠军

量子位
量子位 · 2026-07-22T07:31:19Z
从 Token 价格战到成功任务单位经济学:AI 成本战的真正主线(上) - 张善友

AI 行业过去最喜欢讲的是"能力",今天越来越必须讲的是"结果"。"有用智能每人民币"(Useful Intelligence per RMB)正在重新定义企业采购、产品设计与工程优化的底层逻辑。成本战的真正主线,不是 token 价格战,而是成功任务的单位经济学

从 Token 价格战到成功任务单位经济学:AI 成本战的真正主线(上) - 张善友

张善友
张善友 · 2026-07-21T23:19:00Z
魔法原子Magic-VLA K02攻克叠盒封胶长程任务,成功率超90%

WAIC现场叠箱封胶,解锁物理AI新技能

魔法原子Magic-VLA K02攻克叠盒封胶长程任务,成功率超90%

量子位
量子位 · 2026-07-19T02:36:39Z
17美元月费养出24小时Hermes管家:28个定时任务+30技能全拆解

一个人每月花17美元雇了一个24小时不休息的AI管家,帮他管钱、管饭、管健康、管学习,结果两个月增肌4公斤。这听起来像科幻片开头,还是像某个硅谷极客在Reddit上吹牛? 2026年7月,Reddit用户HolmeBengt在r/hermesagent社区发布了一篇更新帖,详细披露了他用Hermes Agent搭建的完整个人AI管家系统。这套系统包含28个定时任务(cron...

17美元月费养出24小时Hermes管家:28个定时任务+30技能全拆解

极道
极道 · 2026-07-18T22:48:00Z
一分钟读论文:《E3:AI Agent 何时知道任务很简单?》

佐治亚理工学院和麻省理工学院合作的一篇论文《Do AI Agents Know When a Task Is Simple? Toward Complexity-Aware Reasoning and Execution》(arXiv:2607.13034)提出 E3 框架,让编码 Agent 在执行前先评估任务复杂度,以最小可行路径执行,仅在验证失败时扩展范围。在 MSE-Bench...

一分钟读论文:《E3:AI Agent 何时知道任务很简单?》

Micropaper
Micropaper · 2026-07-15T00:00:00Z
《无尽的任务》最大的粉丝正在引领其复兴

《EverQuest Legends》将于7月28日发布,旨在重现1999年经典MMORPG的体验。开发团队由热爱该游戏的粉丝组成,致力于保留原作的怀旧元素,并进行质量改进,简化旅行和复活机制,降低玩家的时间成本。

《无尽的任务》最大的粉丝正在引领其复兴

The Verge
The Verge · 2026-07-14T13:00:00Z
如何构建和调度本地AI助手以执行每日任务

本文介绍了如何构建本地AI助手,自动执行重复任务并生成每日摘要。使用Python创建调度程序,调用GOOGL股票检查、AI新闻摘要和天气简报三个代理,确保所有操作在本地进行以保护隐私。用户可通过设置cron或Windows任务调度器,定时运行这些代理,简化工作流程。

如何构建和调度本地AI助手以执行每日任务

freeCodeCamp.org
freeCodeCamp.org · 2026-07-13T21:36:24Z
FurnitureVLA——利用VLA学习长时域双臂家具装配:将装配长时任务拆分为多个子步骤,且提出进度VLA,以预测每个子任务的进度信号,最终实现子任务之间的切换

本文研究了利用视觉-语言-动作模型(VLA)进行真实尺度双臂家具装配。作者开发了双臂仿真流水线和VR远程操控系统,以生成高质量示教数据。通过将装配过程分解为语义子任务,优化了装配的精度和效率,解决了误差累积问题。研究还强调了设计因素对装配成功率的影响,并提出了一种进度增强型VLA模型以实现自动化子任务切换。

FurnitureVLA——利用VLA学习长时域双臂家具装配:将装配长时任务拆分为多个子步骤,且提出进度VLA,以预测每个子任务的进度信号,最终实现子任务之间的切换

结构之法 算法之道
结构之法 算法之道 · 2026-07-13T13:12:45Z
机器狗指挥人类用天平称重!清华现场演示:无脚本,任务随机,观众即兴出题

清华大学展示了搭载一念Unisonmind大脑的机器狗“哮天”,在无预设环境中完成走迷宫、称重和估水量等复杂任务。这次演示验证了物理通用人工智能的核心特征,即同一认知系统在不同实体上持续运行,形成实时的“感知—行动—反馈”闭环。

机器狗指挥人类用天平称重!清华现场演示:无脚本,任务随机,观众即兴出题

量子位
量子位 · 2026-07-13T04:14:27Z
T-Rex——给VLA带上触觉的灵巧操作框架:先通过人类视频做预训练,再通过富含触觉的中期训练对齐交互,最后利用极少量目标域演示以快速适配下游任务

T-Rex是一个多模态框架,旨在提升机器人对触觉信号的反应能力。它通过构建一个包含触觉和视觉信息的统一模型,利用100小时的触觉同步遥操作数据集,支持灵巧操作。该模型分为低频动作专家和高频触觉专家,能够快速适应复杂的操作任务。

T-Rex——给VLA带上触觉的灵巧操作框架:先通过人类视频做预训练,再通过富含触觉的中期训练对齐交互,最后利用极少量目标域演示以快速适配下游任务

结构之法 算法之道
结构之法 算法之道 · 2026-07-12T16:21:19Z
使用esbuild缩减Azure Pipeline任务扩展的体积

本文讨论了如何通过使用esbuild将Azure Pipelines任务扩展打包成单个JavaScript文件,从而显著减少任务包的大小和下载时间,提升构建基础设施的效率。建议Node基础的Azure DevOps任务开发者采用类似的打包方法。

使用esbuild缩减Azure Pipeline任务扩展的体积

Azure DevOps Blog
Azure DevOps Blog · 2026-07-10T14:45:56Z
chat.nvim v1.8.0:自动重试、用户画像与定时任务重写

chat.nvim v1.8.0 版本发布,重点提升稳定性和个性化。新增自动重试机制以应对网络波动,用户画像功能记录用户偏好,重写定时任务架构以提高管理效率,增强Markdown渲染以改善阅读体验。同时修复多个稳定性问题,优化工具系统以确保用户数据安全。

chat.nvim v1.8.0:自动重试、用户画像与定时任务重写

Eric's Blog
Eric's Blog · 2026-07-10T00:00:00Z

文章讨论了通过错误恢复和任务系统增强大型语言模型(LLM)的能力。针对常见故障(如输出截断、输入过长等),提出了自我恢复的方法。任务系统将大目标拆分为小任务,支持持久化和依赖管理,提升规划能力。后台任务功能允许LLM在执行耗时操作时继续处理其他任务,保持高效性。

AI in Harness(二)——错误恢复、任务规划与后台执行:Error Recovery、Task System 与 Background Task

犀利豆的博客
犀利豆的博客 · 2026-07-08T21:12:17Z
Maestro 任务查询 API

本文介绍了Maestro任务查询API的使用方法,包括如何通过POST请求查询视频任务的状态与结果。支持轮询查询,建议每5-10秒进行一次,以获取实时进度。返回的数据包含任务状态、请求参数和响应结果。

Maestro 任务查询 API

静觅
静觅 · 2026-07-08T20:59:55Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码