➡️
继续阅读
-
SenseNova-U1.5-8B-MoT 统一生成与理解,解锁原生多模态创作;DeepSeek-V4-Flash-Vision-Exp 拓展视觉理解新能力
商汤科技发布SenseNova-U1.5-8B-MoT统一多模态模型,支持图像生成、编辑与理解,提升4K画质和文字渲染。HyperAI官网更新数据集、教程...
-
Kimi K3 模型结构(1):序列维度(上),从线性注意力到 KDA
本文介绍Kimi K3模型中KDA(Kimi Delta Attention)的递推形式,从线性注意力、DeltaNet到Gated DeltaNet演进...
-
Kimi K3 模型结构(4):深度维度,Attention Residuals
本文解析Kimi K3模型中的Attention Residuals(注意力残差)结构。该机制将残差连接视为深度方向上的RNN,通过可学习伪query对e...
-
Kimi K3 模型结构(0):一张图看懂 Kimi K3
Kimi K3是2.78T参数、104.2B激活的93层MoE模型,支持1M上下文及图像视频输入。其结构创新分三方面:序列用KDA与Gated MLA混合...
-
入蜀记 day467 小小的真理
文章记录了作者在成都的日常生活与思考,包括买菜、阅读、观看农业节目等。作者反思实践的重要性,感叹农业的脆弱与科技应对天灾的局限,并讨论文化个体化趋势、地震...
-
入蜀记 day466 近谿
作者在2026年9月的日记中记录了梦境中与老同学重逢的喜悦,反思了苏轼等古人思想被忽视的现象,分享了使用AI工具优化工作流程的体验,并强调了真实生活不可被...