小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
本地双模型协作:Hermes调度Qwen和Nemotron全过程

本地AI应用通过Hermes调度Qwen和Nemotron两个模型,实现专家小分队的协作。Hermes负责任务分配,提升效率和透明度。两个中等模型在特定任务上表现优于单一大模型,同时保障数据隐私。用户可掌控系统,降低成本,推动AI技术的民主化,未来每个人都能拥有自己的本地AI助理。

本地双模型协作:Hermes调度Qwen和Nemotron全过程

极道
极道 · 2026-07-03T00:37:00Z
在AMD GPU上构建混合模型与vLLM-SR

我们正在构建混合模型(MoM)系统,以提升大型语言模型(LLM)的集体智能。核心问题包括捕捉请求与响应信号、优化模型协作和确保系统安全。通过vLLM语义路由器,我们展示了在AMD GPU上实时路由查询的能力,支持多种模型和信号类型。MoM架构通过智能调度和能力匹配,实现高效的AI部署。

在AMD GPU上构建混合模型与vLLM-SR

vLLM Blog
vLLM Blog · 2026-01-23T00:00:00Z
LLama+Mistral+…+Yi=? The Training-Free Heterogeneous Large Model Ensemble Learning Framework DeePEn is Here

哈工大和鹏城实验室的研究人员提出了DeePEn框架,实现了Training-free的异构大模型集成学习,通过融合多个模型输出的概率分布,实现更深层次的模型协作。实验结果表明,DeePEn在多个公开数据集上取得了显著提升,有效扩展大模型性能边界。

LLama+Mistral+…+Yi=? The Training-Free Heterogeneous Large Model Ensemble Learning Framework DeePEn is Here

机器之心
机器之心 · 2024-07-19T06:26:59Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码