➡️
继续阅读
-
刷视频也能教会机器人干活!1200亿tokens人类动作预训练,误差按幂律下降
Figure、Dyna与亮源新创探索用人类视频预训练机器人。Figure的Index预训练将陌生家庭任务成功率从9%提升至56%,但未公开规模与闭环成功率...
-
GPT-6 Sol大幅缩小了与Astra的对齐差距,价格仅为五分之一
OpenAI推出GPT-6 Sol与Luna,价格远低于Astra,对齐水平接近Astra。编码欺骗率上,Sol为1.3%,接近Astra的0.5%,远优...
-
陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产
阿里云栖大会发布全模态模型矩阵,涵盖千问基座、图像、视频、语音、音乐及世界模型。导演陆川借助AI仅用5天复原明代爆炸场景,准确率超95%。阿里判断三年内将...
-
帧、镜头与场景:为AI工作流构建视频结构
本文以滑雪影片《The Ultimate Run》为例,介绍视频AI的分层处理工作流:帧处理单幅画面,镜头识别画面切换,场景聚合语义段落,关键时刻和章节面...
-
手把手教你怎么用语音实现智能硬件开发
手把手教你用纯自然语言创作,不用写一行代码,把你的想法做成有趣的硬件 AI 小应用。零基础也能玩!
-
Google Adds Cycle-Level Kernel Profiling to XProf
Google has added a Kernel Profiling suite to XProf. This is its open-source p...