➡️
继续阅读
-
至知研究院提出大模型可解释性新路线:拆权重,数据成本不到1%
该文介绍了一种新方法“稀疏权重分解”(SWD),用于直接分解预训练大模型的权重矩阵,无需训练替代网络。SWD将稠密权重分解为两个稀疏矩阵,形成可独立干预的...
-
52岁大叔靠人工智能减重18斤,秘诀全在一条死规矩
52岁男子通过AI和固定规则,一个夏天减重18斤。他设定热量、蛋白质和进食时间等硬性参数,避免自我谈判,用体积控制饱腹感,蛋白质优先保住代谢,并保留放纵餐...
-
根治AI音乐通病!这家国产音乐模型正面挑战SUNO
音潮发布AI音乐大模型V4.0,突破行业瓶颈,能精准理解用户情绪和碎片化灵感,提升曲风、乐器及人声还原度。新增多语种和纯音乐功能,并开放API平台限时免费...
-
智谱GLM 5.3挖出2436漏洞:安全实测反超Mythos
智谱GLM 5.3在269个项目中挖出2436个漏洞,其中1097个高危,平均潜伏26.6年,最老可追溯至1981年。在CyberGym评测中以84.5%...
-
Claude Code实盘炒股165美元亏光,AI交易真能赚钱吗
实验显示,让Claude Code用真实资金进行期权交易,最终亏损165美元,暴露了AI交易的多重问题:模型复制散户失败模式、API和算力成本被忽视、复杂...
-
27B的Qwen3.8与3.6架构相同!性能怎么反超50%?
阿里巴巴发布Qwen3.8-27B,与3.6版架构相同,但性能大幅提升,编程测试领先,部分超越闭源旗舰。提升源于训练数据优化和推理深度调节,代价是toke...