2026年7月2日,科大讯飞在深圳发布了智能交互生态,AIUI平台升级为多模态交互,支持40余种语言,助力智能硬件出海。同时,机器人超脑平台也完成升级,增强了多模态感知和复杂任务执行能力,推动机器人产业发展。
新一代SU7汽车采用目标说话人识别(TS-ASR)和动态追踪(TS-Tracking)技术,有效解决车外语音识别中的干扰问题。该系统能够在嘈杂环境中精准识别用户指令,提升交互体验。通过声纹注册,用户可在移动中下达指令,系统能有效过滤其他声音,实现更智能的语音交互。
MyClaw.NET 是一个基于 C# 的个人 AI 助手,具备多渠道通信和长期记忆功能。其模块化架构包括 Agent、Gateway、Channels、Memory 和 Skills,能够执行复杂任务并适应用户偏好,支持动态技能加载和定时自动化,提供智能的上下文感知交互体验。
LG电子将在2026年CES上首次展示家用机器人LG CLOiD,旨在提高家务管理效率和生活质量。该机器人配备灵活的双机械臂和智能交互能力,能够执行多种家庭任务。LG将机器人技术视为未来增长的关键,积极推动创新与合作。
荣威M7 DMH搭载豆包大模型,具备情绪理解、上下文记忆和复杂车控联动能力,提升智能交互体验。语音功能使用率从60%提升至90%。该车注重舒适性与低能耗,售价9.78万元,预计2025年新增238家服务网点。
11月18日,ITMA SUMMIT 2025在深圳召开。华大电子副总经理陈波涛介绍了NFC技术的演进及“iTAP-Ready”产品,该技术支持智能门禁和无感支付等应用。华大电子还展示了NFC和eSIM产品,并已通过多项认证。
Agent 的长期记忆功能是智能交互的关键,能够持久存储重要信息,实现跨会话的知识积累。NebulaAI 作为企业级 AI 开发平台,具备独特的长期记忆技术,确保 AI 准确记住用户学习内容,从而提供更自然的智能服务。
Robrain AI机器人解决方案V2.0正式推出,融合多模态AI大模型,提升机器人场景理解与动作控制能力。新方案引入声纹识别,支持个性化智能交互,有效过滤环境噪音,区分注册用户与陌生人,已成功应用于人形机器人领域。
科大讯飞发布会展示了智能交互的新模式,强调人机交互从命令式转向深度智能协作。AI技术的进步使设备更自然地理解和响应用户情感,提升交互体验。讯飞的AIUI平台和机器人超脑平台实现多模态交互,推动智能硬件在儿童教育等领域的应用,展现未来人机协作的潜力。
孚知流团队在微软开发者挑战赛中获“最佳智能交互奖”,其“小红书运营专家 Agent”项目专注于人机交互设计,旨在提升用户的思考与决策能力。该系统基于Azure与OpenAI技术,模拟专家思维,提供高效的任务处理与反馈。团队计划深入微软生态,推动AI与人类专家的结合,展现智能交互的深层意义。
百度文小言APP升级,新增多模型融合调度,增强语音和图片问答功能。新模型支持多方言理解,快速响应用户需求,提升AI体验。用户可生成吉卜力风格的图片和视频,并解答数学题,展现更智能的交互能力。
三星 Galaxy S25 的 AI 功能引发了用户与手机交互方式的思考。目前 AI 功能缺乏统一入口,用户难以发现和使用。建议设立专门的 AI 按钮以提升用户体验,但真正的智能交互应在用户需要时自动提供帮助,未来 AI 按钮可能会逐渐消失,因 AI 将更深入系统底层。
广和通于3月22日参加AI工坊,展示MagiCore系列AI轻算力大模型解决方案,支持多种智能交互需求,开发者可在10分钟内快速搭建智能体原型,且该系列兼容全球法规,集成eSIM卡。
小智 AI 开源硬件为.NET 开发者提供了免费的 C# 客户端,便于智能交互体验、快速开发智能体及深入调试小智服务端,界面简洁,适合各级开发者,欢迎加入社区。
本文介绍了如何在应用中实现函数调用功能,使聊天机器人能够根据用户上下文动态响应。通过集成此功能,应用可以执行数据库查询等操作,提升用户体验。实现步骤包括定义函数及其参数类型、将函数集成到助手API中并进行测试,从而使应用交互更智能,用户可用自然语言进行查询。
智能交互创新赛在杭州举行,哈尔滨工业大学的《雅韵智诵——AI智能背诵助手》获得特等奖。赛事聚焦人机交互技术,OPPO提供技术支持,推动AI应用发展。四川大学的《走心》项目创新心理测评系统,提高心理健康筛查的普及性和准确度。
RAG(检索增强生成)结合大型语言模型与外部知识库,提高回答的准确性和可解释性。随着技术进步,RAG需要演变为具备感知、决策和行动能力的Agent,以满足复杂应用需求,实现更高级的智能交互和服务。
云知声推出山海多模态大模型,具备智能交互能力,能接收多种形式输入并生成任意组合输出,实现多模态交互体验。山海语音交互具有实时秒回和灵活插话的特点,能感知和表达情绪。山海还能自由切换音色,根据用户需求生成个性化声音。通过摄像头,山海能识别场景和物体信息,并生成符合个性化需求的图像。山海多模态大模型能模拟不同人物性格和对话风格,提供个性化和富有情感的交互体验。云知声将继续发展山海的多模态交互能力,使其成为能够深入理解世界和与人类进行自然交流的智能伙伴。
完成下面两步后,将自动完成登录并继续当前操作。