智谱GLM-5.3-Flash在超10万颗国产AI加速器上两周完成部署,吞吐提升3.2倍。GLM-5.3驱动的Infra Agent参与优化,定位精度与调度问题,将KV传输开销从30%降至1%以下。团队提出dense feedback机制,让AI理解性能变化原因。唐杰称递归自我改进的早期形态已现:模型优化系统,系统服务模型。
智谱创始人唐杰分享了RSI早期案例:GLM-5.3驱动的Infra Agent在超10万张国产芯片集群上从零搭建并优化生产级推理系统,不到两周将端到端吞吐提升至基线的3.2倍。该Agent能自主读取反馈、提出假设、修改代码并迭代,定位并修复了KV Transfer中Python GIL并发阻塞等问题。唐杰强调尚未实现RSI,目标设定与风险判断仍由人负责。
完成下面两步后,将自动完成登录并继续当前操作。