➡️
继续阅读
-
TimesFM 3.0 零样本预测时间序列,覆盖多场景分析需求;VLX-Seek 融合目标定位与细粒度理解,拓展具身视觉感知能力
VLX-Seek是OmAI Lab推出的细粒度视觉语言模型,面向机器人、无人机等边缘具身视觉场景,结合语言理解与区域级视觉感知,支持目标定位、指代理解、区...
-
用Chrome升级学习习惯的5种方法
Chrome推出五项学习功能:Gemini可解析播客、视频等媒体并生成互动测验;标签组与分屏视图帮助整理资料、减少干扰;跨设备发送标签可保留滚动位置和表单...
-
Pensieve: 2609
所读所观所玩
-
真的给 AI 一部手机,它会自己用吗?
有人做了个 XPhoneUse,专门给 Codex、Claude 这些 Agent 提供操作手机的“眼睛和手”。 给 AI 一部真实手机去操作,已经这么简...
-
Video-to-BT——让VLM照着人类示范视频自动构建行为树:必要时人工干预,以解决动态环境下的长时程装配任务
本文提出Video-to-BT框架,融合视觉-语言模型(VLM)与行为树(BT),实现从人类示范视频自动生成可反应、可解释的装配任务规划。该框架将高层认知...
-
过去12个月我坚守的投资策略
作者分享过去12个月的投资策略:将闲钱集中投入一类估值处于底部、风险较低且长期回报有望高于市场平均的中国资产,收益远超沪深300。文章原计划讲述如何制定并...