NVIDIA发布Nemotron 3.5 Lightning开源模型和NeMo Switchyard路由库,提升智能体AI效率。前者为300亿参数专家混合模型,速度快4倍,任务完成快30%,支持本地部署;后者智能路由请求至最适模型,降低成本。多家企业已采用,实现高精度与成本节约。
英伟达发布Nemotron 3.5 Lightning开源模型及NeMo Switchyard路由库,主打速度与定制化。该模型经微调后可在专业任务上媲美大型专有模型,并降低成本。Switchyard通过路由优化,在保持精度的同时大幅削减任务成本,合作伙伴已见成效。
本期播客回顾上周AI要闻:OpenAI发布GPT-5.6并更名ChatGPT Work;SpaceX AI推出低价Grok 4.5;Meta发布Muse Spark 1.1及图像视频工具,因隐私争议撤回;中国开源模型份额增长;Meta计划云业务,美国能源监管施压数据中心;Anthropic发布可解释性研究,AI 2040提议中美协调AI发展。
训练数据在大模型竞争中至关重要,NVIDIA推出的Nemotron系列数据集强调数据质量和任务适配性,涵盖通用文本预训练、监督微调和代码生成等核心能力,推动模型训练从数量向精准转变。这些数据集为大模型研究提供系统性支持,提升模型能力。
Nemotron Labs探讨了开放模型如何帮助企业和国家构建可控、可信和定制的人工智能。通过定制开放模型,开发者可以根据专业知识创建专属AI,提升工作流程和准确性,尤其在医疗和法律等高要求行业中。许多公司已在各自领域中应用Nemotron,取得显著成效。
NVIDIA Nemotron 3 Ultra通过优化LangChain深度代理,实现领先性能和更低成本,帮助企业完成更多任务。该系统无需重新训练模型,企业可定制和控制AI代理,从而提升工作效率。NemoClaw为企业提供开放的AI构建蓝图,支持在多种平台上运行,助力构建专属代理。
NVIDIA 发布了 Audex,这是一个统一的音频-文本大型语言模型,具备理解和生成音频及语音的能力,同时保持文本智能。Audex 采用 30 亿参数的 MoE 结构,设计简洁,避免了多模态模型的性能退化,在文本和音频任务中表现优异,尤其在语音识别领域领先。尽管存在商业许可限制和音频理解能力不足等缺点,Audex 仍在多项任务中表现出色。
本地AI应用通过Hermes调度Qwen和Nemotron两个模型,实现专家小分队的协作。Hermes负责任务分配,提升效率和透明度。两个中等模型在特定任务上表现优于单一大模型,同时保障数据隐私。用户可掌控系统,降低成本,推动AI技术的民主化,未来每个人都能拥有自己的本地AI助理。
Palantir与NVIDIA合作推出基于开放模型的智能引擎,为美国政府机构提供安全的AI解决方案。这些模型增强了透明度和可定制性,帮助政府在敏感环境中高效运作。通过Palantir的主权AI操作系统,机构可以在自己的基础设施上训练和部署模型,确保数据安全和控制,推动美国技术领导力的发展。
NVIDIA发布了Nemotron 3.5 ASR,这是一个支持40种语言的流式自动语音识别模型,拥有6亿参数。该模型采用FastConformer-RNNT架构,实时转录时无需单独处理标点和大小写,推理延迟可调,适合多种应用场景。经过微调,希腊语和保加利亚语的识别准确率显著提高。
Nvidia推出的Nemotron 3 Ultra现已在Vercel AI Gateway上可用。这是一种开放的混合专家推理模型,专为长时间运行的代理工作流设计,具有1M的上下文窗口,支持多轮代理工作流,吞吐量可达每秒350个标记,成本降低30%。使用时需在AI SDK中设置模型为nvidia/nemotron-3-ultra-550b-a55b。
OpenClaw是一个自托管的AI助手,允许用户在本地运行,避免依赖云服务。NVIDIA与OpenClaw社区合作,提升安全性,并推出NemoClaw以便于企业安全部署长效AI代理。长效代理在金融、药物发现和IT运维等领域展现出显著效率,能够自动处理复杂任务,减少人工干预。
NVIDIA推出Nemotron 3 Nano Omni模型,将视觉、音频和语言整合为一个系统,显著提升AI代理的效率和准确性。该模型具备高达9倍的处理能力,适用于客户支持、文档智能和音视频理解等领域,并支持开放定制,适合多种部署环境。
在第237期节目中,讨论了上周的AI新闻,包括Perplexity推出的本地AI代理、Anthropic的代码审查工具、ChatGPT的互动视觉功能,以及Nvidia暂停H200生产、Anthropic起诉五角大楼和Yann LeCun的AMI Labs筹集13亿美元。
英伟达推出了Nemotron 3 Super模型,具备1200亿参数和100万令牌的上下文窗口,专注于速度和效率优化。该模型可在多个云平台上使用,推理时可调用更多专家。尽管智能评分略低于领先模型,但速度表现优异,每秒可输出478个令牌。
NVIDIA推出的Nemotron 3 Super模型拥有1200亿参数,支持复杂多智能体系统,具备高效推理能力和1百万token的上下文窗口,避免目标漂移,广泛应用于多个行业,提升工作效率,支持开发者自定义和部署。
NVIDIA与Open Robotics合作推出Nemotron开源模型,专注于AI代理构建,讨论了硬件与软件协同设计、模型训练精度和内存管理,强调开源对研发加速的重要性。
智能文档处理利用AI自动提取文档信息,帮助企业从复杂文件中获取洞察。NVIDIA的Nemotron模型高效处理,适用于金融和法律领域,提升业务智能与决策效率。
NVIDIA发布了Nemotron语音识别模型,专为低延迟语音助手和实时字幕设计。该模型采用缓存感知的FastConformer编码器和RNNT解码器,支持16 kHz音频,提供多种输入块配置,词错误率在7.2%至7.8%之间,显著提升了并发性和稳定性,适用于实时语音应用。
在第229期播客中,讨论了谷歌的Gemini 3 Flash和OpenAI的GPT-5.2 Codex等重要AI新闻。中国在半导体技术方面取得进展,华为和中芯国际推动EUV光刻机的发展。OpenAI关注生物安全和网络安全风险,并与美国军方合作开发新AI平台。
完成下面两步后,将自动完成登录并继续当前操作。