小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
从海量互联网视频中检索人类操作示范,英伟达联合莱斯大学发布RoboTok,提升下游机器人任务成功率

莱斯大学与英伟达提出RoboTok,一个面向互联网规模人类视频的示范检索数据引擎。它从网络视频中筛选片段、重建三维手部轨迹,学习运动嵌入空间,实现高效相似行为检索,无需任务标签。实验显示其检索质量远超基线,并能提升灵巧操作策略成功率,为机器人学习提供可持续扩展的数据来源。

从海量互联网视频中检索人类操作示范,英伟达联合莱斯大学发布RoboTok,提升下游机器人任务成功率

HyperAI超神经 HyperAI超神经 · 2026-09-10T15:06:52Z
自进化WAM来了!清华AIR联手域变换提出具身In-Context Causal Learning

清华AIR与域变换联合发布Zeva,首个实现上下文因果学习(ICCL)的具身模型。它无需更新权重,通过因果交互提取、双时标记忆和上下文策略注入,让冻结模型在部署中自进化。在基准任务中累计成功率从26%提升至73%,真实化学实验室任务成功率显著增长,并支持一次人类演示学会新操作,开启上下文空间扩展的新范式。

自进化WAM来了!清华AIR联手域变换提出具身In-Context Causal Learning

量子位 量子位 · 2026-09-01T05:12:30Z
“后人会觉得这很荒谬”:Sai代理在OSWorld 2.0上以73%的成功率完成日常(但必要)工作

Simular公司的电脑代理Sai在OSWorld 2.0基准测试中取得73%成功率,超越GPT-5.6 Sol和Opus 5,成本仅为它们的三分之二。Sai采用神经符号方法,结合神经网络与符号代码,高效处理真实工作场景任务,如发票验证和疫苗预约。公司强调其设计注重经济实用性,而非追求行业荣誉,旨在为个人和企业提供可负担的自动化解决方案。

“后人会觉得这很荒谬”:Sai代理在OSWorld 2.0上以73%的成功率完成日常(但必要)工作

The New Stack The New Stack · 2026-08-27T15:34:11Z
一分钟读论文:《同一个模型换个外壳,攻击成功率差出四倍多》

论文《HarnessRisk》提出面向Agent外壳安全的全生命周期基准,用128个沙箱案例测试6个阶段。结果显示同一模型在不同外壳下攻击成功率差4.3倍,配置阶段最脆弱,且检测风险不等于安全行动,任务效用不能作为安全证据。

一分钟读论文:《同一个模型换个外壳,攻击成功率差出四倍多》

Micropaper Micropaper · 2026-08-24T00:00:00Z
我们阻止了AI代理安装到错误的Python环境:任务成功率跃升至95%以上

PyCharm推出Agent Environment Coordinator技能,使AI代理能查询项目正确的Python解释器并自动配置环境,避免安装到错误版本或污染系统。测试显示,6个AI模型在28个任务中平均成功率从68%提升至98%,且不修改系统Python,显著提升任务完成率和环境清洁度。

我们阻止了AI代理安装到错误的Python环境:任务成功率跃升至95%以上

The JetBrains Blog The JetBrains Blog · 2026-08-12T12:01:07Z
AI 成本战的隐性成本与降本五层:从"成功率悖论"到"系统复杂度"(中) - 张善友

AI降本的核心并非更换更便宜的模型,而是降低系统复杂度。高成功率系统往往更复杂、成本更高,企业常只关注模型账单,忽略组织成本。真正降本需重构工作流,通过缓存、模型分层、上下文压缩、工具筛选和任务边界重定义,从减少token消耗转向降低系统复杂度。

AI 成本战的隐性成本与降本五层:从"成功率悖论"到"系统复杂度"(中) - 张善友

张善友 张善友 · 2026-07-22T12:38:00Z
「仿真派」落地真产线!苏度WAIC首秀,CEO韩铮:99%+成功率

苏度科技在WAIC展示仿真训练机器人,实现99%+抓取成功率,涵盖精密装配、柔性打包及宁德时代电池产线多机协作。公司坚持仿真为主、虚实融合数据路线,自研本体,构建高精度世界模型,目标打造具身智能iOS平台,强调高可靠性与泛化能力,估值达200亿元。

「仿真派」落地真产线!苏度WAIC首秀,CEO韩铮:99%+成功率

量子位 量子位 · 2026-07-20T05:35:02Z
魔法原子Magic-VLA K02攻克叠盒封胶长程任务,成功率超90%

魔法原子在WAIC展示其通用具身大模型Magic-VLA K02,成功完成叠盒封胶、衣物整理等复杂长程任务。该模型采用分层双系统架构,实现任务规划与动作执行协同,具备动态纠错和受扰恢复能力,叠盒封胶成功率超90%,并提升跨机器人适配与部署稳定性。

魔法原子Magic-VLA K02攻克叠盒封胶长程任务,成功率超90%

量子位 量子位 · 2026-07-19T02:36:39Z
开源AI价格崩了50倍但部署成功率低12%,闭源正在焊死护城河

开源AI正成为生产主力,推理成本三年降50倍,中国模型流量超美国三倍。但部署成功率低,闭源在集成、长上下文、合规上领先。开源生态经济规模达千亿美元,中国是最大权重来源。未来机会在开源harness、记忆层、权限标准等领域,窗口期有限。

开源AI价格崩了50倍但部署成功率低12%,闭源正在焊死护城河

极道 极道 · 2026-07-17T21:40:00Z
自主谈判中的行为隐私泄露:通过随机策略形式化和缓解推断攻击

本文探讨了自主谈判代理中的行为隐私泄露问题,提出了一种自适应随机谈判策略,确保差分隐私和高谈判效用。通过对3000次双边谈判的评估,该机制将对手推断准确率降低了43-50%,同时保持90%以上的成功率,证明了在不显著损失性能的情况下可以实现强隐私保障。

自主谈判中的行为隐私泄露:通过随机策略形式化和缓解推断攻击

Apple Machine Learning Research Apple Machine Learning Research · 2026-07-10T00:00:00Z
1小时真机RL微调成功率破95%!HIL-ResRL:即插即用的VLA“外挂”神器

HIL-ResRL是一种即插即用的VLA工具,经过1小时微调后成功率超过95%。该技术在提升机器学习模型应用效率方面具有重要意义。

1小时真机RL微调成功率破95%!HIL-ResRL:即插即用的VLA“外挂”神器

mongona news mongona news · 2026-06-24T10:38:38Z
1小时真机RL微调成功率破95%!HIL-ResRL:即插即用的VLA“外挂”神器

在具身智能领域,视觉-语言-动作(VLA)模型面临模仿学习导致的误差累积问题。华为云的HIL-ResRL方法通过人机协同和残差策略,提高了机器人在真实环境中的任务成功率,实验成功率超过95%。该方法无需重训练,适用于多种工业任务,并通过触觉反馈显著提高精度,展示了快速部署的潜力。

1小时真机RL微调成功率破95%!HIL-ResRL:即插即用的VLA“外挂”神器

量子位 量子位 · 2026-06-24T10:38:38Z
把面试变成一场「开卷推理」:我的全流程备战与复盘 SOP

文章探讨了将面试视为推理游戏的方法,通过积累样本来提高成功率。作者分享了备战和复盘的流程,以帮助读者更有效地准备面试。

把面试变成一场「开卷推理」:我的全流程备战与复盘 SOP

mongona news mongona news · 2026-06-23T03:00:18Z
英伟达开始搞机器人自己研究机器人那套了…

英伟达与卡内基梅隆大学、伯克利大学联合推出ENPIRE框架,旨在让AI自主进行机器人研究。该框架通过自动化实验流程,提高机器人在复杂任务中的成功率,研究表明AI代理能够独立提出研究思路并优化实验,最终在多个任务中实现99%的成功率。ENPIRE的核心是构建一个可迭代的物理实验环境,以提升机器人研究的效率。

英伟达开始搞机器人自己研究机器人那套了…

量子位 量子位 · 2026-06-20T12:06:20Z
AI 范式雷达:《从端到端成功率到细粒度规划诊断》

一项研究评估了12个多模态大语言模型(MLLM)的规划能力,发现它们在不可解任务识别中的正确拒绝率仅为34.7%。研究提出了智能体规划基准(APB),通过五大评估设置揭示了模型在长程规划、工具鲁棒性和校准拒绝等方面的系统性弱点,强调规划能力的重要性。结果显示,模型在面对不可解任务时往往盲目尝试,可能导致资源浪费和有害输出。

AI 范式雷达:《从端到端成功率到细粒度规划诊断》

Micropaper Micropaper · 2026-06-11T00:00:00Z
HumanEgo——从半小时人类第一视角视频中进行零样本学习的4大关键点:对人类手臂进行图像修补、将每只手和每个物体编码为一个交互中心Token、流匹配策略、稠密辅助目标

HumanEgo框架通过人类第一视角视频学习机器人策略,成功解决了人类与机器人之间的具身鸿沟。研究者利用佩戴的Aria眼镜采集示范数据,实现了零样本迁移,平均成功率达到92.5%。该方法无需机器人数据,数据高效,支持在新环境中稳健迁移,显著提升了机器人操作效率。

HumanEgo——从半小时人类第一视角视频中进行零样本学习的4大关键点:对人类手臂进行图像修补、将每只手和每个物体编码为一个交互中心Token、流匹配策略、稠密辅助目标

结构之法 算法之道 结构之法 算法之道 · 2026-06-08T15:46:32Z
将您的架构待办事项与技术路线图优先级(TRP)对齐

成功的数字化转型需要业务和技术利益相关者在编写代码前达成共识。70%的转型失败源于利益相关者不一致。使用技术路线图优先级(TRP)框架,组织可以快速确定优先事项,创建可执行的架构待办事项。TRP通过成本和影响的矩阵帮助团队明确优先级,确保资源集中于高价值项目,从而提高转型成功率。

将您的架构待办事项与技术路线图优先级(TRP)对齐

AWS Architecture Blog AWS Architecture Blog · 2026-06-03T18:08:51Z
The Harness Architecture That Every AI Company is Playing With: An In-Depth Analysis of the Harness Architecture

Harness是一种新型AI智能体架构,由五大子系统构成,专注于工程实现而非设计抽象。它通过固定结构和上下文管理提升智能体的稳定性和成功率,标志着AI进入工程学科时代。

The Harness Architecture That Every AI Company is Playing With: An In-Depth Analysis of the Harness Architecture

dotNET跨平台 dotNET跨平台 · 2026-05-24T00:11:00Z
六步用GPT-Image-2做网站界面:从设计图到真实前端的完整教程

本文介绍了使用GPT-Image-2模型将设计图转化为网站前端界面的六步流程,包括撰写提示词、生成设计方案、分析设计图、搭建界面、修改细节和加入个人风格。通过这一流程,成功率可提高至80%以上,适合希望创建专业网站的用户。

六步用GPT-Image-2做网站界面:从设计图到真实前端的完整教程

极道 极道 · 2026-05-01T11:42:00Z
跨维智能DexWorldModel斩获榜首,世界模型真正的考场在机器人执行里

具身智能领域最近发布了GEN-1,成功率超过99%,速度提升2-3倍,微调成本降低至1/10。CEO Pete Florence强调,未来的世界模型应关注机器人任务的成功率,而非仅追求视觉质量。研究表明,高视觉质量与具身任务能力相关性较低,DexWorldModel通过改进表示、记忆、推理和数据引擎,提升了机器人在真实环境中的表现,展示了具身世界模型的潜力。

跨维智能DexWorldModel斩获榜首,世界模型真正的考场在机器人执行里

量子位 量子位 · 2026-04-21T00:06:39Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码