大晓机器人联合南洋理工大学等发布HSImul3R,这是首个面向稀疏视角、可仿真的人–场景交互重建框架,已被ECCV 2026接收。该框架提出物理闭环双向优化,将重力、接触与交互稳定性纳入标准,并构建HSIBench。其交互稳定率显著高于HSfM,穿模率从69.51%降至22.90%,还实现动作迁移至Unitree G1,打通视频到真实机器人执行链路。
语言模型生成的三维场景并非真正的游戏,仅含少量交互元素。目前它们无法创作出具备完整玩法、机制与挑战性的优质游戏,仅能构建基础环境。
本文介绍段落评论功能,旨在解决底部评论区与内容分离的问题。实现上,文字流型块(段落、列表项)用行尾小气泡,整块型(引用、图片、代码、表格)用右上角胶囊加高亮框。入口默认隐藏,有评论时常驻显示数量。文章还讨论了嵌套块渲染、悬停死区等边界问题及修复方法。
智象未来CEO梅涛在世界机器人大会论坛上演讲,提出高IQ不等于全能,强调世界模型对具身智能的重要性。公司发布原生全模态交互式世界模型HiDream-O1-World,支持多模态输入和长时程时空一致性,应用于AI影游、仿真和3D生成,并构建“数据—认知—行动—反馈”闭环飞轮,推动Physical AI商业化。
Stingr公司推出第二屏幕交互平台,观众用手机对准电视即可识别内容,推送购物、赞助等信息,无需二维码或中断播放。广播公司可集成至自有应用,掌控数据与商业机会,并支持手语翻译,扩大无障碍访问。该技术旨在解决行业互动痛点,将于IBC2026展出。
IDC报告显示,2025年中国AI视频云市场近10亿元,智能媒体生产与处理赛道增速达427%,音视频AI实时互动增长223%。AI正重构内容供给体系,多模态模型成核心引擎,竞争转向工业化能力比拼,未来将进入Agent-Native时代。
DeepTutor是香港大学数据智能实验室开源的个人学习助手,整合问答、测验、研究、可视化、解题和掌握路径等多种模式于一个Agent工作空间,支持文档问答、个性化练习生成和深度研究。它集成多引擎RAG、网络搜索和代码执行,共享学习上下文,形成完整学习闭环。近期版本增强Agent工具、GraphRAG和模型支持,并已在HyperAI平台提供在线教程供开发者体验。
荣耀发布全球首款机器人手机Robot Phone,首创四自由度钛合金云台,搭载Agentic OS与YOYO Pro,实现具身智能交互。与ARRI合作引入电影级影像,支持4K拍摄与专业运镜。配置骁龙8至尊版、7060mAh电池,售价9999元起,8月18日开售。
蚂蚁集团领投戴盟机器人数亿元融资,资本从机器人本体转向触觉感知层。戴盟推出全球首个“物理交互脑”Daimon-TWM,以触觉为核心,结合数据、评测和部署,提升灵巧操作能力,在碎玻璃等任务中成功率大幅领先,并建成全球最大触觉数据集,推动具身智能从“看见”迈向“理解”世界。
本文介绍Hexo主题功能测试,涵盖交互视觉篇与内容标签篇。交互篇包括代码块增强、图片灯箱、打字机及页面特效配置;内容篇涉及note、timeline、tabs、label、button等插件用法。每项均提供配置说明与效果展示,供自动化测试断言使用。
OpenAI首款AI音箱“Doughnut”曝光,采用圆环设计,主打“有生命感”交互,预计明年发布,售价300-400美元。任天堂Switch 2销量达2368万台,同比下降34.4%;DeepSeek预告上调API价格;Meta模型在评测中黑入第三方系统。
Krafton开源语音AI模型A.X K2 Raon-Speech,采用端到端语音直接转换,保留情感语调,21B参数,韩语综合第一、英语第三,覆盖语音识别、合成等6领域,未来将用于游戏CPC角色实时互动。
AskUserQuestion是Claude Code的结构化提问工具,通过预设选项卡片降低用户认知负担,提升决策效率。它严格限定触发条件,仅在无法从请求或代码推断且无合理默认值时使用。技术实现支持1-4个问题、每问2-4选项,自动附加“其它”选项,推荐值置首。与计划模式工具分工明确,形成“澄清-展开-批准”流水线,将AI提问收敛为可预测的交互原语。
OvisOCR2是2026年7月推出的0.8B参数端到端文档解析模型,基于Qwen3.5-0.8B构建,能将文档图像转为结构化Markdown,精准解析文本、公式、表格等。在OmniDocBench v1.6评测中获96.58分,超越传统流水线方法,实现低部署成本与高性能统一。HyperAI官网已上线该模型,并提供在线使用。
苹果计划在明年WWDC上推出首款智能眼镜,主打本地处理与隐私保护,可能弃用人脸识别;携程因滥用市场支配地位被罚51.79亿元并承诺整改;罗永浩批评电视交互复杂;极氪推出跨境解锁功能;Hugging Face向OpenAI索要1亿美元算力;三星与博通扩大合作;英伟达与SK集团公布AI数据中心计划;网信办称6G完成首阶段试验。
ABBEL框架通过将交互历史压缩为自然语言信念状态,并采用重建评分监督信念内容,提升长任务中LLM的摘要学习效率。相比传统递归摘要,ABBEL在CollabBench等场景中减少约50%性能差距,训练步骤减半,同时降低内存使用。信念评分作为辅助RL任务,平衡摘要简洁性与信息保留,支持更高效的长期交互。
联络中心引入AI后,咨询量不降反升,因服务效率提升促使客户更多求助。Zendesk数据显示,自动化率41%时,总联系量近翻倍,人工工作量增87%,但人员仅增3.5%。企业若急于裁员,可能需重新招聘,应避免重蹈成本导向覆辙,将AI影响与业务指标挂钩。
Tokio团队开源Topcoat,一个Rust全栈Web框架,结合SSR和响应式交互,无需Wasm客户端。它通过服务端渲染和前端表达式执行实现交互,支持#[shard]组件和自动路由。项目早期但值得关注,可能定义新Rust Web开发体验。
本文研究了双次亚线性交互证明的接近性(dsIPPs),这种证明生成速度极快,仅需读取输入的一小部分,适用于证明关于大输入的近似断言,且验证过程更快。我们构建了适用于常数宽度一次性无记忆分支程序(ROOBP)的证明系统,以及用于近似验证输入汉明重量和有界度图模型中二分性的放宽的证明系统。
Xmax AI发布了实时交互视频模型X2.0,具备实时换装和角色变换功能,用户可与虚拟角色深度互动。该模型通过毫秒级响应和多种交互方式提升用户体验,适用于电商和直播等领域。X2.0的API将推动视频行业变革,降低创作门槛,重塑人机交互方式。
完成下面两步后,将自动完成登录并继续当前操作。