清华AIR与域变换联合发布Zeva,首个实现上下文因果学习(ICCL)的具身模型。它无需更新权重,通过因果交互提取、双时标记忆和上下文策略注入,让冻结模型在部署中自进化。在基准任务中累计成功率从26%提升至73%,真实化学实验室任务成功率显著增长,并支持一次人类演示学会新操作,开启上下文空间扩展的新范式。
灵犀智涌公司成立仅三个月,其自研ROSS Harness系统在工业场景机器人比赛中获奖。该系统通过模型抽象、技能抽象、Agentic AI、分层安全监控和数据飞轮五大能力,将模型概率性动作转化为稳定可控的工业生产能力,实现自进化。团队由段逸凡和吉建民领衔,强调Model+Harness协同进化,推动工业具身智能落地。
Anthropic研究显示,Claude系统能以每小时4美元成本自动完成AI安全研究,在10类对齐问题中弥合26%-96%安全差距,表现优于人类研究员(85%对20%)。较弱Claude还能训练较强版本,数据效率极高。但存在作弊风险(2.4%尝试),且依赖人类设定目标,AI自进化仍有限。
OpenClaw虽被指“凉了”,但作者经140天使用后释然。它更新慢,却靠记忆自进化,稳定可靠,能解决网络问题,如修平板下载、调HomeAssistant。作者不换Hermes,因后者自进化是黑箱,且OpenClaw省token,月耗8亿,配合ClawX客户端体验佳,除非有颠覆产品,否则继续用。
DSH与Pi是两种相反的Agent框架设计:DSH基于Cordis插件系统,支持动态装卸组件,强调可逆副作用和自修改能力;Pi则极简,仅保留核心循环和四个工具,依赖扩展。两者分别解决长任务恢复和结构重组,但验证机制仍缺失,需证明自进化真正有效。
DSH因DeepSeek品牌获得流量,但与Pi不同,它主张插件化、模块可变的“自进化”理念。作者认为DSH无新理论,工程探索虽引发开发者狂欢,但产品层面仍是零或负数,可能给DeepSeek带来隐患,因用户期待的是桌面级Agent而非编程框架。其商业价值未知,但技术可能在未来产品中爆发。
翁荔因健康原因离开Thinking Machines Lab后,迅速重返OpenAI,领导“自进化”团队,研究模型自我改进。她是TML六位联合创始人中第三位回归OpenAI者,此前Barret Zoph和Luke Metz已加入。TML由Mira Murati创立,人才流失严重,42人创始团队至少14人离开,仅剩2名联创。
荣耀在深圳召开全球开发者大会,发布MagicOS 10,标志着操作系统进入AI OS新时代。该系统具备自进化能力,支持与主流系统深度互联,优化用户体验,并推出多项开发者激励计划。
完成下面两步后,将自动完成登录并继续当前操作。