➡️
继续阅读
-
Witbe 推出用于视频测试自动化的 AI 模型
Witbe推出自研视觉语言模型Witbe VLMs,用于视频测试自动化,与通用模型协同工作。该模型针对机顶盒等特定场景训练,性能不逊于前沿模型,且延迟更低...
-
Qwen Audio:复杂人声干扰下,如何让 ASR “听对人”
本文探讨语音识别在多人环境中“听对人”的挑战,即区分用户与背景人声。对比两种技术路线:基于身份注册的Target-Speaker ASR和基于场景线索的前...
-
Kimi K3 模型结构(4):深度维度,Attention Residuals
本文解析Kimi K3模型中的Attention Residuals(注意力残差)结构。该机制将残差连接视为深度方向上的RNN,通过可学习伪query对e...
-
Kimi K3 模型结构(0):一张图看懂 Kimi K3
Kimi K3是2.78T参数、104.2B激活的93层MoE模型,支持1M上下文及图像视频输入。其结构创新分三方面:序列用KDA与Gated MLA混合...
-
入蜀记 day467 小小的真理
文章记录了作者在成都的日常生活与思考,包括买菜、阅读、观看农业节目等。作者反思实践的重要性,感叹农业的脆弱与科技应对天灾的局限,并讨论文化个体化趋势、地震...
-
入蜀记 day466 近谿
作者在2026年9月的日记中记录了梦境中与老同学重逢的喜悦,反思了苏轼等古人思想被忽视的现象,分享了使用AI工具优化工作流程的体验,并强调了真实生活不可被...