NVIDIA与Palantir合作,将供应链规划师的决策依据、理由与结果写入Ontology,并微调约300亿参数的Nemotron小模型辅助GPU分配。微调后准确率达86.7%,但Macro-F1仅57.5%,表明少数场景仍难处理。文章指出企业AI的关键在于高质量决策日志而非模型本身,并提醒注意数据偏见与反馈审核。
PROOF-Gen是一种通过逐场景提示优化从失败轨迹中恢复黄金数据的方法。在τ²-bench上,57%的教师尝试失败,其中三分之二是近失。该方法利用反射器分析执行轨迹和评估反馈,生成纠正指导,使教师产生通过轨迹,恢复93%的失败场景。微调后,Qwen3-4B和Gemma模型性能显著提升,部署中目标完成率提高6.3个百分点,并正向迁移至设备端模型。
本文提出DLR-Lock方法,通过将预训练MLP替换为深度低秩残差网络,利用自动微分的推理-训练不对称性,增加微调时的激活内存和计算开销,并造成架构不匹配,从而有效防御自适应攻击者修改权重,同时保持模型原有性能。实验验证了该方法的有效性。
本文探讨了AI语音聊天机器人的人设与声线设计,强调了三种主要方法:prompt工程、模型微调和声音克隆。prompt工程适合探索阶段,成本低、迭代快;模型微调提高人设辨识度和一致性;声音克隆确保声线独特性。最佳实践是结合三者,根据项目阶段逐步引入,以提升用户体验和产品差异化。
本文介绍音视频AI模型的进阶与实践,适合初级开发者。推荐使用YAMNet进行音频分类和Silero VAD进行语音活动检测,视频领域则推荐YOLO模型用于目标检测。强调迁移学习和模型微调的重要性,并提供智能录音、视频剪辑工具和AR滤镜检测等实战项目建议。初学者应关注性能优化,确保流畅体验,扎实音视频基础与AI结合。
随着大语言模型(LLM)的普及,相关技术和应用生态迅速发展。为帮助人们掌握LLM,开源项目LLM Course应运而生,提供系统化的学习路径,涵盖模型微调、量化和高级应用,适合初学者和开发者。HyperAI也推出了相关教程,方便用户实践。
生成式AI(如OpenClaw)引入了新的个人代理计算机类别。NVIDIA GTC展示了支持本地代理开发与定制的新模型和优化,提升了AI助手的隐私和性能。Unsloth Studio简化了模型微调过程,适合开发者和爱好者使用。
随着大语言模型在自然语言处理中的应用增加,企业面临知识更新滞后和专业数据不足的问题。为此,业界提出了模型微调、检索增强生成(RAG)、工具调用和Agent架构等技术方案。微软的Agent Framework支持智能代理的构建,通过整合外部知识和工具,提升AI应用的实用性和可靠性。
本文介绍了十个有助于构建和部署大型语言模型(LLM)应用的Python库和框架,如Hugging Face Transformers、LangChain和Pydantic AI。这些工具简化了模型访问、应用构建、检索增强生成(RAG)和模型微调的过程,提高了开发效率和生产环境性能。
DeepSeek-V3.2通过自动合成高质量旅行规划数据,提升行程规划能力。该流程包括数据集准备和模型微调,采用无人工干预生成任务,确保数据质量和数量,最终生成的任务可验证,适用于强化学习训练。
本文介绍了大模型文本审核系统的优化项目,重点在第三阶段的模型微调方案。通过训练XLM-RoBERTa Base模型,误判率降低至近5%,准确率达到95%。相较于大型模型,小型模型在特定场景下表现更佳,提供高效的长期解决方案。建议在生产环境中使用该模型,并保持人工审核和定期评估,以持续优化系统性能。
本研究提出了一种思维链跃迁桥接任务,以解决大型语言模型在数学任务中因缺失中间步骤而导致的思维跃迁问题。实验结果显示,经过微调的模型在数学推理基准上的表现提升最高可达5.87%。
Video-LLM 处理离线视频,但在流媒体场景中存在局限。StreamBridge 框架通过结合内存缓冲区和轻量级激活模型,解决了多轮实时理解和主动响应生成的挑战,提升了流媒体视频的理解能力。同时,引入的新数据集 Stream-IT 支持更好的模型微调,展现了在机器人和自动驾驶等领域的应用潜力。
本研究探讨了人工智能在地球观测中的可靠性,提出基准数据集以评估AI能力。通过微调合成数据,提升了开放模型的表现,使小模型在准确性上与大模型相当。研究强调在实现AI自动化地球观测前需解决的关键挑战,并指明未来研究方向。
本研究提出了一种新方法,通过自适应问题难度生成高质量链式思维(CoT)数据,以解决大型语言模型在复杂任务中的推理能力不均衡问题。该方法显著降低了数据生成成本,提高了模型微调效率,并在数学竞赛和代码生成领域验证了其有效性。
本文介绍了如何使用Hugging Face的预训练模型构建自动语音识别(ASR)系统,包括加载语音数据集、微调Wav2Vec2模型、评估模型性能(字错误率)以及实时语音转文本推断。通过安装必要库、预处理音频数据、定义训练参数和训练模型,实现了高效的ASR系统。
本文介绍了如何利用Cohere的分类API快速构建情感分析系统。通过简单的数据准备和API调用,用户无需具备机器学习专业知识即可实现高效的情感分类。教程涵盖数据准备、模型微调和性能评估等步骤,最终模型在测试集上达到了93.20%的准确率,展示了其在情感检测中的强大能力。
GRPO算法通过组内样本比较计算策略梯度,降低训练不稳定性并提高效率。Andriy Burkov发布了基于Qwen2.5-1.5B-Instruct模型的GRPO实现教程,涵盖数据准备、评估和奖励函数,最终实现模型微调,显著提升准确率。
本研究提出了一种新策略,通过集成方法量化大型语言模型(LLM)分类结果的不确定性。模型微调降低了输出对输入词汇变动的敏感性,从而提高了分类的可靠性,增强了LLM在实际应用中的可信度和可解释性。
企业在AI应用中需在快速提示工程与深入模型微调之间做出选择。提示工程适合一般任务,快速且成本低,但定制性不足;而微调通过特定数据集提升模型性能,适合专业需求。选择合适的基础设施和工具至关重要。
完成下面两步后,将自动完成登录并继续当前操作。