➡️
继续阅读
-
将GPU推理冷启动从8分钟缩短至不到1分钟
本文分析了GPU节点上大语言模型冷启动的瓶颈,发现从Pod创建到首次推理响应需8分钟,涉及六个阶段。主要问题包括CUDA内核重复编译(小模型占65%时间)...
-
Allora Labs证明变异AI模型群体性能超单个优化模型
Allora Labs研究表明,在AI模型群体中引入随机变异可提升整体性能,超越单个优化模型。变异群体在环境变化时表现更优,最佳情况下约80%优于优化群体...
-
蚂蚁 inclusionAI 开源 6B 统一图像生成与编辑模型 LLaDA-Image
蚂蚁集团开源统一图像生成与编辑模型LLaDA-Image,含6B参数,提供Base和Turbo两版本,支持文生图、编辑及中英文渲染。Turbo采用蒸馏技术...
-
迅策科技发布TokenCloud一站式AI模型训推算力平台
迅策科技发布TokenCloud一站式AI模型训推算力平台,以异构算力为基础,构建四层协同生态,打通数据到Token全链路。平台支持GPU、NPU等统一调...
-
Witbe 推出用于视频测试自动化的 AI 模型
Witbe推出自研视觉语言模型Witbe VLMs,用于视频测试自动化,与通用模型协同工作。该模型针对机顶盒等特定场景训练,性能不逊于前沿模型,且延迟更低...
-
英伟达将正式为旧款GPU带来DLSS 5——但不会给玩家完全控制权
英伟达确认DLSS 5将扩展支持RTX 40系列显卡,但暂不支持更旧的RTX 30/20系列。玩家只能使用简单的开关切换,无法像模组那样精细控制画质滑块。...