阿里通义实验室发布的Wan-Streamer v0.2实现了低延迟、全双工的AI视频通话,响应时间约550毫秒。该模型整合音视频输入,实时理解并生成自然对话,画质提升至640×368,适用于AI助手、教育和游戏NPC等多种场景。通过流式架构,AI与用户的互动更加自然,逐步接近真实交流。
通义万相是阿里推出的视频生成模型,支持文生视频、图生视频和参考视频转生视频,最高可输出1080P并生成音频。用户可通过Claude Desktop连接该模型,首次注册可获得免费额度,计费按调用次数计算。
Claude.ai 现已支持通义万相 Wan MCP,用户可以生成1080P视频,支持文本、图片和参考视频输入。配置简单,首次连接需完成OAuth授权,并提供多种生成视频的工具,方便用户在对话中直接调用。
戴盟机器人完成亿元A轮融资,专注于具身智能中的触觉技术。新任首席AI科学家原玮浩表示,触觉是理解物理世界的关键,团队将重点发展物理世界模型。戴盟通过外发数据采集网络,解决触觉数据采集和多模态对齐问题,推动行业标准化。
复旦大学与通义实验室联合提出ToolCUA,旨在优化计算机使用代理(CUA)在GUI与工具调用之间的选择。研究表明,直接连接工具未能提升模型性能,反而导致准确率下降。ToolCUA通过生成混合轨迹数据,帮助模型学习何时使用GUI或工具,从而提高任务执行效率。在OSWorld-MCP上的评测结果显示,ToolCUA取得46.85%的准确率,显著优于其他模型,展示了其在复杂任务中的有效性和灵活性。
阿里通义实验室推出开源项目MAI-UI,旨在实现AI对手机的直接操控。该项目在GUI定位和任务执行方面表现出色,能够识别屏幕内容并完成复杂操作。MAI-UI支持多种参数变体,具备主动询问用户信息和与外部应用集成的能力,适应动态环境。目前已开源2B和8B版本,用户可通过GitHub获取体验。
斑马智行与通义、高通合作推出全模态端侧大模型Auto Omni,提升智能座舱体验,支持主动服务。该方案具备全模态感知和全时空记忆能力,预计2026年量产。斑马智行还与多品牌合作,推动AI技术发展,建立互利生态系统。
阿里通义DeepResearch模型在多个评测中超越OpenAI,成为开源Agent模型的领军者。该模型通过增量预训练和后训练,利用合成数据生成高质量训练集,提升推理和决策能力,已广泛应用于阿里内部项目。
机器之心数据服务现已上线,提供高效稳定的数据获取,简化数据爬取流程。
高德地图通过AI重构底层架构,推出主-从Agent系统,简化用户获取出行建议和旅行计划的流程,提升用户体验。新架构使高德从工具转变为智能体,主动满足用户需求,为行业转型提供借鉴。
机器之心数据服务现已上线,提供高效稳定的数据获取服务,简化数据爬取流程。
斑马智行与通义、高通在2025世界人工智能大会发布了基于高通8397平台的多模态大模型解决方案,推动汽车智能座舱进入主动智能时代。该方案实现了智能座舱90%的服务闭环,用户可通过自然对话完成多项任务,提升人机交互体验。斑马智行的元神AI在多个场景中展现出强大的智能化能力,成为汽车智能化服务的新标杆。
阿里云通义灵码推出的Qwen3-Coder编程模型免费使用,提升代码生成速度和准确率,超越GPT4.1,成为全球最受欢迎的开源模型,下载量超过2000万,服务超过1万家企业。
阿里巴巴通义实验室推出的WebSailor开源网络智能体,通过后训练方法显著提升复杂网页推理能力,成为首个挑战BrowseComp基准的开源模型,缩小了开源与闭源模型的能力差距。
机器之心数据服务现已上线,提供高效稳定的数据获取,简化爬取流程。
完成下面两步后,将自动完成登录并继续当前操作。