小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
NVIDIA Nemotron 3.5 Lightning与NeMo Switchyard:提供更快、更智能、更高效的智能体AI

NVIDIA发布Nemotron 3.5 Lightning开源模型和NeMo Switchyard路由库,提升智能体AI效率。前者为300亿参数专家混合模型,速度快4倍,任务完成快30%,支持本地部署;后者智能路由请求至最适模型,降低成本。多家企业已采用,实现高精度与成本节约。

NVIDIA Nemotron 3.5 Lightning与NeMo Switchyard:提供更快、更智能、更高效的智能体AI

NVIDIA Blog NVIDIA Blog · 2026-08-11T13:00:05Z
英伟达推出更小更快的Nemotron模型及配套路由器,助力实际应用

英伟达发布Nemotron 3.5 Lightning开源模型及NeMo Switchyard路由库,主打速度与定制化。该模型经微调后可在专业任务上媲美大型专有模型,并降低成本。Switchyard通过路由优化,在保持精度的同时大幅削减任务成本,合作伙伴已见成效。

英伟达推出更小更快的Nemotron模型及配套路由器,助力实际应用

The New Stack The New Stack · 2026-08-11T13:00:00Z
LWiAI播客第252期 - GPT 5.6、Grok 4.5、Nemotron-Labs-Diffusion、AI 2040

本期播客回顾上周AI要闻:OpenAI发布GPT-5.6并更名ChatGPT Work;SpaceX AI推出低价Grok 4.5;Meta发布Muse Spark 1.1及图像视频工具,因隐私争议撤回;中国开源模型份额增长;Meta计划云业务,美国能源监管施压数据中心;Anthropic发布可解释性研究,AI 2040提议中美协调AI发展。

LWiAI播客第252期 - GPT 5.6、Grok 4.5、Nemotron-Labs-Diffusion、AI 2040

Last Week in AI Last Week in AI · 2026-07-21T12:03:29Z
数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

训练数据在大模型竞争中至关重要,NVIDIA推出的Nemotron系列数据集强调数据质量和任务适配性,涵盖通用文本预训练、监督微调和代码生成等核心能力,推动模型训练从数量向精准转变。这些数据集为大模型研究提供系统性支持,提升模型能力。

数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

HyperAI超神经 HyperAI超神经 · 2026-07-17T08:06:36Z
Nemotron Labs:开放模型如何为企业和国家提供可控、可信和可定制的人工智能

Nemotron Labs探讨了开放模型如何帮助企业和国家构建可控、可信和定制的人工智能。通过定制开放模型,开发者可以根据专业知识创建专属AI,提升工作流程和准确性,尤其在医疗和法律等高要求行业中。许多公司已在各自领域中应用Nemotron,取得显著成效。

Nemotron Labs:开放模型如何为企业和国家提供可控、可信和可定制的人工智能

NVIDIA Blog NVIDIA Blog · 2026-07-14T16:45:13Z
NVIDIA Nemotron通过LangChain深度代理实现领先基准性能

NVIDIA Nemotron 3 Ultra通过优化LangChain深度代理,实现领先性能和更低成本,帮助企业完成更多任务。该系统无需重新训练模型,企业可定制和控制AI代理,从而提升工作效率。NemoClaw为企业提供开放的AI构建蓝图,支持在多种平台上运行,助力构建专属代理。

NVIDIA Nemotron通过LangChain深度代理实现领先基准性能

NVIDIA Blog NVIDIA Blog · 2026-07-08T15:00:27Z
NVIDIA 发布 Audex (Nemotron-Labs-Audex-30B-A3B):一种统一的音频-文本大语言模型

NVIDIA 发布了 Audex,这是一个统一的音频-文本大型语言模型,具备理解和生成音频及语音的能力,同时保持文本智能。Audex 采用 30 亿参数的 MoE 结构,设计简洁,避免了多模态模型的性能退化,在文本和音频任务中表现优异,尤其在语音识别领域领先。尽管存在商业许可限制和音频理解能力不足等缺点,Audex 仍在多项任务中表现出色。

NVIDIA 发布 Audex (Nemotron-Labs-Audex-30B-A3B):一种统一的音频-文本大语言模型

实时互动网 实时互动网 · 2026-07-08T02:20:40Z
本地双模型协作:Hermes调度Qwen和Nemotron全过程

本地AI应用通过Hermes调度Qwen和Nemotron两个模型,实现专家小分队的协作。Hermes负责任务分配,提升效率和透明度。两个中等模型在特定任务上表现优于单一大模型,同时保障数据隐私。用户可掌控系统,降低成本,推动AI技术的民主化,未来每个人都能拥有自己的本地AI助理。

本地双模型协作:Hermes调度Qwen和Nemotron全过程

极道 极道 · 2026-07-03T00:37:00Z
开放模型,封闭环境:Palantir与NVIDIA Nemotron为美国机构提供安全的AI

Palantir与NVIDIA合作推出基于开放模型的智能引擎,为美国政府机构提供安全的AI解决方案。这些模型增强了透明度和可定制性,帮助政府在敏感环境中高效运作。通过Palantir的主权AI操作系统,机构可以在自己的基础设施上训练和部署模型,确保数据安全和控制,推动美国技术领导力的发展。

开放模型,封闭环境:Palantir与NVIDIA Nemotron为美国机构提供安全的AI

NVIDIA Blog NVIDIA Blog · 2026-06-29T10:59:38Z
NVIDIA 发布 Nemotron 3.5 ASR:一个拥有 6 亿参数、支持缓存的流式转录模型,可实时转录 40 种语言区域设置

NVIDIA发布了Nemotron 3.5 ASR,这是一个支持40种语言的流式自动语音识别模型,拥有6亿参数。该模型采用FastConformer-RNNT架构,实时转录时无需单独处理标点和大小写,推理延迟可调,适合多种应用场景。经过微调,希腊语和保加利亚语的识别准确率显著提高。

NVIDIA 发布 Nemotron 3.5 ASR:一个拥有 6 亿参数、支持缓存的流式转录模型,可实时转录 40 种语言区域设置

实时互动网 实时互动网 · 2026-06-08T02:31:38Z
Nemotron 3 Ultra现已在AI Gateway上可用

Nvidia推出的Nemotron 3 Ultra现已在Vercel AI Gateway上可用。这是一种开放的混合专家推理模型,专为长时间运行的代理工作流设计,具有1M的上下文窗口,支持多轮代理工作流,吞吐量可达每秒350个标记,成本降低30%。使用时需在AI SDK中设置模型为nvidia/nemotron-3-ultra-550b-a55b。

Nemotron 3 Ultra现已在AI Gateway上可用

Vercel News Vercel News · 2026-06-04T07:00:00Z
Nemotron实验室:OpenClaw代理对每个组织的意义

OpenClaw是一个自托管的AI助手,允许用户在本地运行,避免依赖云服务。NVIDIA与OpenClaw社区合作,提升安全性,并推出NemoClaw以便于企业安全部署长效AI代理。长效代理在金融、药物发现和IT运维等领域展现出显著效率,能够自动处理复杂任务,减少人工干预。

Nemotron实验室:OpenClaw代理对每个组织的意义

NVIDIA Blog NVIDIA Blog · 2026-04-30T20:00:39Z
NVIDIA推出Nemotron 3 Nano Omni模型,整合视觉、音频和语言,实现高达9倍的AI代理效率

NVIDIA推出Nemotron 3 Nano Omni模型,将视觉、音频和语言整合为一个系统,显著提升AI代理的效率和准确性。该模型具备高达9倍的处理能力,适用于客户支持、文档智能和音视频理解等领域,并支持开放定制,适合多种部署环境。

NVIDIA推出Nemotron 3 Nano Omni模型,整合视觉、音频和语言,实现高达9倍的AI代理效率

NVIDIA Blog NVIDIA Blog · 2026-04-28T16:00:28Z
LWiAI 播客第237期 - Nemotron 3 Super,xAI重生,Anthropic诉讼,研究!

在第237期节目中,讨论了上周的AI新闻,包括Perplexity推出的本地AI代理、Anthropic的代码审查工具、ChatGPT的互动视觉功能,以及Nvidia暂停H200生产、Anthropic起诉五角大楼和Yann LeCun的AMI Labs筹集13亿美元。

LWiAI 播客第237期 - Nemotron 3 Super,xAI重生,Anthropic诉讼,研究!

Last Week in AI Last Week in AI · 2026-03-16T06:06:58Z
英伟达推出Nemotron 3 Super,一款用于大规模人工智能系统的1200亿参数开放模型

英伟达推出了Nemotron 3 Super模型,具备1200亿参数和100万令牌的上下文窗口,专注于速度和效率优化。该模型可在多个云平台上使用,推理时可调用更多专家。尽管智能评分略低于领先模型,但速度表现优异,每秒可输出478个令牌。

英伟达推出Nemotron 3 Super,一款用于大规模人工智能系统的1200亿参数开放模型

The New Stack The New Stack · 2026-03-11T18:30:23Z
新款NVIDIA Nemotron 3 Super为智能代理AI提供5倍更高的吞吐量

NVIDIA推出的Nemotron 3 Super模型拥有1200亿参数,支持复杂多智能体系统,具备高效推理能力和1百万token的上下文窗口,避免目标漂移,广泛应用于多个行业,提升工作效率,支持开发者自定义和部署。

新款NVIDIA Nemotron 3 Super为智能代理AI提供5倍更高的吞吐量

NVIDIA Blog NVIDIA Blog · 2026-03-11T16:00:21Z
连芯片制造商也在开发大型语言模型

NVIDIA与Open Robotics合作推出Nemotron开源模型,专注于AI代理构建,讨论了硬件与软件协同设计、模型训练精度和内存管理,强调开源对研发加速的重要性。

连芯片制造商也在开发大型语言模型

Stack Overflow Blog Stack Overflow Blog · 2026-03-10T07:40:00Z
Nemotron实验室:AI代理如何将文档转化为实时商业智能

智能文档处理利用AI自动提取文档信息,帮助企业从复杂文件中获取洞察。NVIDIA的Nemotron模型高效处理,适用于金融和法律领域,提升业务智能与决策效率。

Nemotron实验室:AI代理如何将文档转化为实时商业智能

NVIDIA Blog NVIDIA Blog · 2026-02-04T16:00:36Z
NVIDIA AI 发布 Nemotron Speech ASR:全新的开源实时转录模型

NVIDIA发布了Nemotron语音识别模型,专为低延迟语音助手和实时字幕设计。该模型采用缓存感知的FastConformer编码器和RNNT解码器,支持16 kHz音频,提供多种输入块配置,词错误率在7.2%至7.8%之间,显著提升了并发性和稳定性,适用于实时语音应用。

NVIDIA AI 发布 Nemotron Speech ASR:全新的开源实时转录模型

实时互动网 实时互动网 · 2026-01-08T02:51:11Z
LWiAI播客第229期 - Gemini 3 Flash、ChatGPT应用、Nemotron 3

在第229期播客中,讨论了谷歌的Gemini 3 Flash和OpenAI的GPT-5.2 Codex等重要AI新闻。中国在半导体技术方面取得进展,华为和中芯国际推动EUV光刻机的发展。OpenAI关注生物安全和网络安全风险,并与美国军方合作开发新AI平台。

LWiAI播客第229期 - Gemini 3 Flash、ChatGPT应用、Nemotron 3

Last Week in AI Last Week in AI · 2025-12-25T21:29:26Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码