小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源

大晓机器人联合南洋理工大学等发布HSImul3R,这是首个面向稀疏视角、可仿真的人–场景交互重建框架,已被ECCV 2026接收。该框架提出物理闭环双向优化,将重力、接触与交互稳定性纳入标准,并构建HSIBench。其交互稳定率显著高于HSfM,穿模率从69.51%降至22.90%,还实现动作迁移至Unitree G1,打通视频到真实机器人执行链路。

全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源

量子位 量子位 · 2026-09-10T07:57:55Z
不,那些不是游戏

语言模型生成的三维场景并非真正的游戏,仅含少量交互元素。目前它们无法创作出具备完整玩法、机制与挑战性的优质游戏,仅能构建基础环境。

不,那些不是游戏

Josherich的博客 Josherich的博客 · 2026-09-09T00:00:01Z

本文介绍段落评论功能,旨在解决底部评论区与内容分离的问题。实现上,文字流型块(段落、列表项)用行尾小气泡,整块型(引用、图片、代码、表格)用右上角胶囊加高亮框。入口默认隐藏,有评论时常驻显示数量。文章还讨论了嵌套块渲染、悬停死区等边界问题及修复方法。

别让评论憋在文末了:让想法跟着文字串门

九仞之行 九仞之行 · 2026-09-07T12:41:32Z
WRC 2026|原生全模态世界模型:从模拟世界到交互世界

智象未来CEO梅涛在世界机器人大会论坛上演讲,提出高IQ不等于全能,强调世界模型对具身智能的重要性。公司发布原生全模态交互式世界模型HiDream-O1-World,支持多模态输入和长时程时空一致性,应用于AI影游、仿真和3D生成,并构建“数据—认知—行动—反馈”闭环飞轮,推动Physical AI商业化。

WRC 2026|原生全模态世界模型:从模拟世界到交互世界

量子位 量子位 · 2026-08-24T05:04:52Z
Stingr 将为 IBC2026 带来流畅的第二屏幕交互体验

Stingr公司推出第二屏幕交互平台,观众用手机对准电视即可识别内容,推送购物、赞助等信息,无需二维码或中断播放。广播公司可集成至自有应用,掌控数据与商业机会,并支持手语翻译,扩大无障碍访问。该技术旨在解决行业互动痛点,将于IBC2026展出。

Stingr 将为 IBC2026 带来流畅的第二屏幕交互体验

实时互动网 实时互动网 · 2026-08-19T02:01:51Z
IDC首发AI视频云报告:市场规模近10亿,行业迈入“AI重塑多媒体创作与交互”新纪元

IDC报告显示,2025年中国AI视频云市场近10亿元,智能媒体生产与处理赛道增速达427%,音视频AI实时互动增长223%。AI正重构内容供给体系,多模态模型成核心引擎,竞争转向工业化能力比拼,未来将进入Agent-Native时代。

IDC首发AI视频云报告:市场规模近10亿,行业迈入“AI重塑多媒体创作与交互”新纪元

实时互动网 实时互动网 · 2026-08-17T03:53:51Z
在线教程丨狂揽35k Stars,港大团队开源DeepTutor,一套Agent打通知识问答/交互学习/练习生成/深度研究等

DeepTutor是香港大学数据智能实验室开源的个人学习助手,整合问答、测验、研究、可视化、解题和掌握路径等多种模式于一个Agent工作空间,支持文档问答、个性化练习生成和深度研究。它集成多引擎RAG、网络搜索和代码执行,共享学习上下文,形成完整学习闭环。近期版本增强Agent工具、GraphRAG和模型支持,并已在HyperAI平台提供在线教程供开发者体验。

在线教程丨狂揽35k Stars,港大团队开源DeepTutor,一套Agent打通知识问答/交互学习/练习生成/深度研究等

HyperAI超神经 HyperAI超神经 · 2026-08-13T07:23:50Z
引领智能手机迈入具身交互时代 全球首款机器人手机荣耀Robot Phone发布

荣耀发布全球首款机器人手机Robot Phone,首创四自由度钛合金云台,搭载Agentic OS与YOYO Pro,实现具身智能交互。与ARRI合作引入电影级影像,支持4K拍摄与专业运镜。配置骁龙8至尊版、7060mAh电池,售价9999元起,8月18日开售。

引领智能手机迈入具身交互时代 全球首款机器人手机荣耀Robot Phone发布

量子位 量子位 · 2026-08-13T03:00:41Z
蚂蚁首次投向机器人“指尖”!数亿元押注,全球首个物理交互脑发布

蚂蚁集团领投戴盟机器人数亿元融资,资本从机器人本体转向触觉感知层。戴盟推出全球首个“物理交互脑”Daimon-TWM,以触觉为核心,结合数据、评测和部署,提升灵巧操作能力,在碎玻璃等任务中成功率大幅领先,并建成全球最大触觉数据集,推动具身智能从“看见”迈向“理解”世界。

蚂蚁首次投向机器人“指尖”!数亿元押注,全球首个物理交互脑发布

量子位 量子位 · 2026-08-11T13:57:46Z
Hexo主题功能测试-交互视觉篇

本文介绍Hexo主题功能测试,涵盖交互视觉篇与内容标签篇。交互篇包括代码块增强、图片灯箱、打字机及页面特效配置;内容篇涉及note、timeline、tabs、label、button等插件用法。每项均提供配置说明与效果展示,供自动化测试断言使用。

Hexo主题功能测试-交互视觉篇

夜法之书 夜法之书 · 2026-08-07T02:00:00Z
早报|OpenAI首款音箱细节曝光:主打「有生命感」的交互/DeepSeek预告将大幅涨价/Switch 2累计销量达2368万台

OpenAI首款AI音箱“Doughnut”曝光,采用圆环设计,主打“有生命感”交互,预计明年发布,售价300-400美元。任天堂Switch 2销量达2368万台,同比下降34.4%;DeepSeek预告上调API价格;Meta模型在评测中黑入第三方系统。

早报|OpenAI首款音箱细节曝光:主打「有生命感」的交互/DeepSeek预告将大幅涨价/Switch 2累计销量达2368万台

爱范儿 爱范儿 · 2026-08-07T00:15:50Z
Krafton开源语音AI基础模型“A.X K2 Raon-Speech”,发力游戏角色语音交互

Krafton开源语音AI模型A.X K2 Raon-Speech,采用端到端语音直接转换,保留情感语调,21B参数,韩语综合第一、英语第三,覆盖语音识别、合成等6领域,未来将用于游戏CPC角色实时互动。

Krafton开源语音AI基础模型“A.X K2 Raon-Speech”,发力游戏角色语音交互

实时互动网 实时互动网 · 2026-07-29T02:40:38Z
Claude Code Tools 研究系列(一)—— AskUserQuestion:把「AI 提问」变成结构化交互原语

AskUserQuestion是Claude Code的结构化提问工具,通过预设选项卡片降低用户认知负担,提升决策效率。它严格限定触发条件,仅在无法从请求或代码推断且无合理默认值时使用。技术实现支持1-4个问题、每问2-4选项,自动附加“其它”选项,推荐值置首。与计划模式工具分工明确,形成“澄清-展开-批准”流水线,将AI提问收敛为可预测的交互原语。

Claude Code Tools 研究系列(一)—— AskUserQuestion:把「AI 提问」变成结构化交互原语

犀利豆的博客 犀利豆的博客 · 2026-07-28T22:22:00Z
文本/LaTeX/HTML表格一步搞定!OvisOCR2实现端到端文档智能解析;1.4 万+ 元素标注、万条语言指令!Voxel51 发布 SceneFun3D 室内场景微观交互数据集

OvisOCR2是2026年7月推出的0.8B参数端到端文档解析模型,基于Qwen3.5-0.8B构建,能将文档图像转为结构化Markdown,精准解析文本、公式、表格等。在OmniDocBench v1.6评测中获96.58分,超越传统流水线方法,实现低部署成本与高性能统一。HyperAI官网已上线该模型,并提供在线使用。

文本/LaTeX/HTML表格一步搞定!OvisOCR2实现端到端文档智能解析;1.4 万+ 元素标注、万条语言指令!Voxel51 发布 SceneFun3D 室内场景微观交互数据集

HyperAI超神经 HyperAI超神经 · 2026-07-27T06:58:36Z
早报|曝苹果智能眼镜明年亮相/OpenAI签署支持AI开源模型发展公开信/罗永浩再批智能电视交互

苹果计划在明年WWDC上推出首款智能眼镜,主打本地处理与隐私保护,可能弃用人脸识别;携程因滥用市场支配地位被罚51.79亿元并承诺整改;罗永浩批评电视交互复杂;极氪推出跨境解锁功能;Hugging Face向OpenAI索要1亿美元算力;三星与博通扩大合作;英伟达与SK集团公布AI数据中心计划;网信办称6G完成首阶段试验。

早报|曝苹果智能眼镜明年亮相/OpenAI签署支持AI开源模型发展公开信/罗永浩再批智能电视交互

爱范儿 爱范儿 · 2026-07-27T00:10:33Z
教会LLMs更新信念以实现高效的长时程交互

ABBEL框架通过将交互历史压缩为自然语言信念状态,并采用重建评分监督信念内容,提升长任务中LLM的摘要学习效率。相比传统递归摘要,ABBEL在CollabBench等场景中减少约50%性能差距,训练步骤减半,同时降低内存使用。信念评分作为辅助RL任务,平衡摘要简洁性与信息保留,支持更高效的长期交互。

教会LLMs更新信念以实现高效的长时程交互

The Berkeley Artificial Intelligence Research Blog The Berkeley Artificial Intelligence Research Blog · 2026-07-26T09:00:00Z
Zendesk 研究发现:更出色的联络中心 AI 能推动交互量增长,而非减少

联络中心引入AI后,咨询量不降反升,因服务效率提升促使客户更多求助。Zendesk数据显示,自动化率41%时,总联系量近翻倍,人工工作量增87%,但人员仅增3.5%。企业若急于裁员,可能需重新招聘,应避免重蹈成本导向覆辙,将AI影响与业务指标挂钩。

Zendesk 研究发现:更出色的联络中心 AI 能推动交互量增长,而非减少

实时互动网 实时互动网 · 2026-07-20T03:46:22Z

Tokio团队开源Topcoat,一个Rust全栈Web框架,结合SSR和响应式交互,无需Wasm客户端。它通过服务端渲染和前端表达式执行实现交互,支持#[shard]组件和自动路由。项目早期但值得关注,可能定义新Rust Web开发体验。

【Rust日报】2026-07-19 Tokio 团队开源 Topcoat:Rust 全栈 Web 框架把 SSR、响应式交互和无 Wasm 客户端一起打包

Rust.cc Rust.cc · 2026-07-19T01:06:33Z
双次亚线性交互证明的接近性

本文研究了双次亚线性交互证明的接近性(dsIPPs),这种证明生成速度极快,仅需读取输入的一小部分,适用于证明关于大输入的近似断言,且验证过程更快。我们构建了适用于常数宽度一次性无记忆分支程序(ROOBP)的证明系统,以及用于近似验证输入汉明重量和有界度图模型中二分性的放宽的证明系统。

双次亚线性交互证明的接近性

Apple Machine Learning Research Apple Machine Learning Research · 2026-07-16T00:00:00Z
我和「二次元老公」约上会了!全球首个可以玩的实时交互模型,Xmax X2.0发布

Xmax AI发布了实时交互视频模型X2.0,具备实时换装和角色变换功能,用户可与虚拟角色深度互动。该模型通过毫秒级响应和多种交互方式提升用户体验,适用于电商和直播等领域。X2.0的API将推动视频行业变革,降低创作门槛,重塑人机交互方式。

我和「二次元老公」约上会了!全球首个可以玩的实时交互模型,Xmax X2.0发布

量子位 量子位 · 2026-07-15T08:09:57Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码