小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
DeepSeek-V4.1 模型结构(8):KV cache 的管理与 SWA Bounded Replay

DeepSeek-V4.1为降低长上下文agent负载成本,将滑窗KV从SSD移至主机内存池,仅保留几分钟;全局KV仍存SSD至少72小时。滑窗KV丢失后用SWA Bounded Replay只回放128个token近似重建,代价是结果不精确。CSA2跨层共享在流水线并行下通过shadow indexer等三项支持训练。多模态训练有三处系统改动。

DeepSeek-V4.1 模型结构(8):KV cache 的管理与 SWA Bounded Replay

Java不加糖's Blog Java不加糖's Blog · 2026-10-02T13:20:00Z
B站多模态精细画质分析模型在 ICCV2025 大赛获得佳绩

B站多媒体实验室在ICCV MIPI Workshop的细粒度图像质量定位国际挑战赛中,提出多模态训练策略,提升综合指标13.5%,获得第二名。实验室专注于视频质量评价与图像处理的协同,应用GRPO算法优化模型,验证了SFT+GRPO的有效性,推动智能视频处理系统的发展。

B站多模态精细画质分析模型在 ICCV2025 大赛获得佳绩

实时互动网 实时互动网 · 2025-10-17T06:17:02Z

本研究提出了Mol-LLM,通过多模态训练和分子结构优化,克服了大型语言模型在分子任务中的局限性,表现优于大多数现有模型。

Mol-LLM: A General Molecular Large Language Model with Improved Graph Utilization

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-02-05T00:00:00Z

本研究探讨了多语言模型(LLMs)和自动化机器学习(AutoML)的进展,提出了新方法如Auto-Instruct和MAV,显著提升了模型性能和指令质量,推动了LLMs的透明训练和应用。

AutoTrain:无代码的先进模型训练

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-10-21T00:00:00Z

研究提出了一种课程学习方法,优化视觉-语言任务,提高小规模多模态训练效果。结合文本预训练,课程学习在文本任务中表现出显著优势,特别是对小参数模型有明显帮助。这为在数据有限的环境中有效利用机器学习提供了新见解。

探索课程学习在视觉-语言任务中的应用:关于小规模多模态训练的研究

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-10-20T00:00:00Z

本文研究了图像生成模型的现状与进展,提出了一种统一语言界面,将计算机视觉任务转化为文本到图像生成问题。通过使用大规模语言模型和InstructPix2Pix架构,创建了多模态训练数据集,提升了模型在视觉任务中的表现和泛化能力。同时,探讨了基于Transformer的扩散模型在图像和视频生成中的应用,推动了计算机视觉领域的创新。

OmniGen:统一图像生成

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-09-17T00:00:00Z

本研究探讨了深度学习模型在老年痴呆症MRI数据集中的泛化能力,发现更广泛的训练图像能提升模型性能。提出了BraVL和FINE等新方法,以改善神经网络的泛化能力和自我监督表示。研究表明,模态不可知解码器在解码脑信号方面优于传统方法,强调了多模态训练的重要性。

神经OOD:利用脑机融合学习框架提升分布外泛化性能

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-27T00:00:00Z

本文探讨了利用音频数据进行意图分类的多模态训练方法,通过生成音频嵌入和余弦相似度实现零样本分类。实验结果表明,该方法在SLURP和目标导向对话数据集上显著提高了分类准确率,并研究了无监督方法、聚类技术和元学习在意图识别中的应用,以解决低资源环境下的分类性能问题。

探索基于描述增强的无数据意图分类

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-07-25T00:00:00Z

本文介绍了一种名为4M的多模态训练方案,结合文本、图像、几何和语义模态,展示了其在训练视觉基础模型中的潜力。同时,提出了Unified-IO 2模型,能够理解和生成多种模态,表现出强大的性能。通过多任务训练,模型在多个任务上取得了显著提升,推动了全模态智能的发展。

4M-21:面向数十项任务和模态的任意到任意视觉模型

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-06-13T00:00:00Z

多模态训练显著提升了语言模型在情感识别方面的质量与效率。研究提出了一种结合LSTM、音频与文本信息的神经架构,优于单模态基线,并在IEMOCAP数据集上取得高准确率。通过注意力机制和多模态融合,模型在情感分类和标点预测任务中表现出色,展示了多模态方法的优势。

多模态信念预测

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-06-11T00:00:00Z

本文介绍了多种视觉转换器和预训练策略在三维检测和医学图像分析中的应用,包括GeoMIM、M$^{3}$3D和MIM。研究表明,遮蔽图像建模技术能提高学习效率和精度,MIM方法在不同任务中表现优异。此外,提出的多模态训练方案4M和Mask3D方法也展示了在视觉基础模型和场景理解任务中的潜力。

MIM4D:多视角视频遮蔽建模的自动驾驶表示学习

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-03-13T00:00:00Z
向量搜索的复杂性:来自图像搜索和RAG项目的见解 - Noé Achache | 向量空间讲座

本文讨论了向量搜索在图像搜索和文档检索中的应用,重点介绍了Dino V2模型在图像表示中的有效性。Noé Achache分享了在房地产广告去重和医疗文档检索中的经验,强调了数据安全和模型调优的重要性,并指出未来需要新型模型以满足行业需求,提出了多模态训练的潜力。

向量搜索的复杂性:来自图像搜索和RAG项目的见解 - Noé Achache | 向量空间讲座

Qdrant - Vector Database Qdrant - Vector Database · 2024-01-09T13:51:26Z

本文研究了文本预训练的局限性,重点讨论了报告偏差对单一模态训练的负面影响,并通过比较颜色分布的实验结果发现,多模态模型可以减轻此影响。

矢量图文档中的多模态色彩推荐

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-08-08T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码