小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

本文介绍如何构建一个始终在线的流式AI代理,用于监控维基百科实时编辑流并检测恶意编辑。系统采用两阶段漏斗设计:第一阶段用廉价Python逻辑过滤大多数无关编辑,第二阶段仅对可疑事件调用本地LLM(通过Ollama)进行深度分析。代理支持实时流式输出推理过程,并通过SSE广播给客户端。文章强调效率、自动重连和优雅降级对始终在线系统的重要性。

构建流式本地AI代理

KDnuggets KDnuggets · 2026-08-13T14:00:15Z
Ollama 安装及使用

本文介绍Ollama的安装与使用,涵盖常用命令及systemd服务模式。通过systemctl可管理服务,如重启、启动、停止,并可禁用或启用开机自启。若需手动运行,可先停止服务并禁用,再自行启动。

Ollama 安装及使用

文艺数学君 文艺数学君 · 2026-07-30T23:50:51Z
Ollama vs. LM Studio vs. llama.cpp:2026年你应该使用哪个本地AI运行时?

本文比较了Ollama、LM Studio和llama.cpp三种本地AI运行时。LM Studio适合初学者,提供图形界面和可视化量化控制;Ollama适合开发者,提供简洁CLI和API集成;llama.cpp适合追求极致控制的生产工程师,支持手动量化。三者共享同一推理引擎,用户可按需从LM Studio迁移至Ollama再至llama.cpp。

Ollama vs. LM Studio vs. llama.cpp:2026年你应该使用哪个本地AI运行时?

MachineLearningMastery.com MachineLearningMastery.com · 2026-07-29T12:00:13Z
在 JetBrains IDE 中接入 OpenCode 并配置自定义模型 - SharpCJ

OpenCode 是一款开源 AI 编程代理,支持多模型提供商和隐私保护,可接入 Android Studio 等 IDE。文章介绍通过 JetBrains AI Assistant 插件启用 OpenCode Agent,配置 Zen 免费模型或自定义 OpenAI 兼容 API,并设置中文回复规则。还涵盖 Token 优化、本地 Ollama 方案及项目级规则建议,帮助开发者高效使用。

在 JetBrains IDE 中接入 OpenCode 并配置自定义模型 - SharpCJ

SharpCJ SharpCJ · 2026-07-25T06:29:00Z
如何为AI代理应用提示工程与上下文工程

本教程演示如何通过提示工程和上下文工程提升AI代理性能,使用LangChain v1、Ollama、Qwen和Python构建本地代理,对比基线、优化提示和增强上下文三种模式。结果显示,清晰指令和丰富上下文能显著改善输出质量,无需更换模型。同时提醒注意提示注入风险,并建议通过系统提示设置防护。

如何为AI代理应用提示工程与上下文工程

freeCodeCamp.org freeCodeCamp.org · 2026-07-24T20:43:29Z
如何使用LangSmith追踪和监控AI代理

本教程介绍如何使用LangSmith监控本地AI代理。通过LangChain v1、Ollama和Qwen构建代理,并启用LangSmith追踪,可在Web界面查看模型调用、工具使用和延迟。步骤包括安装Ollama、配置环境变量、构建带工具调用的代理,并展示追踪结果。LangSmith支持调试和监控,但为专有服务,开源替代方案为Langfuse。

如何使用LangSmith追踪和监控AI代理

freeCodeCamp.org freeCodeCamp.org · 2026-07-22T19:49:02Z
如何在Python中使用LLM评判器评估AI代理

本教程介绍如何用LangChain v1、Ollama、Qwen和Python构建本地AI代理评估工具。通过测试用例、规则检查和LLM评判,生成通过/失败摘要,无需API费用。示例代理含时间和字数工具,评估发现代理遵循用户指令避免工具调用导致失败,通过修改系统提示词修复,最终全部通过。建议结合规则检查与LLM评判,并手动抽查结果。

如何在Python中使用LLM评判器评估AI代理

freeCodeCamp.org freeCodeCamp.org · 2026-07-17T21:03:56Z
在15分钟内使用Ollama运行本地AI模型

本文介绍了如何在15分钟内使用Ollama在本地运行小型语言模型。用户只需安装Ollama、下载模型(如Llama 3.2 3B)并开始聊天。Ollama通过量化技术减少内存占用,确保模型高效运行,保障数据安全和隐私。

在15分钟内使用Ollama运行本地AI模型

MachineLearningMastery.com MachineLearningMastery.com · 2026-07-16T12:25:41Z

本文介绍了七种2026年工程师在本地基础设施上构建和运行智能代理的Python工具,包括Ollama(轻量级开源大语言模型运行时)、smolagents(简洁代码逻辑)、PydanticAI(数据格式安全)、CrewAI(多代理协作)、AgentScope(生产环境专注)、LangGraph(状态管理支持)和Microsoft Agent Framework(企业功能与本地支持结合)。这些工具各具特色,满足不同需求。

七种用于协调本地AI代理的Python框架

KDnuggets KDnuggets · 2026-07-15T12:00:56Z
Scikit-Ollama用于Scikit-LLM/Ollama集成

本文介绍了scikit-ollama如何将scikit-learn接口与本地Ollama模型结合,实现零-shot文本分类,无需云API。用户可以使用本地Llama 3模型加载电影评论情感数据集,并创建情感预测分类器,从而简化传统机器学习流程,避免数据隐私问题和订阅费用。

Scikit-Ollama用于Scikit-LLM/Ollama集成

MachineLearningMastery.com MachineLearningMastery.com · 2026-07-15T12:00:34Z
如何在Python和LangGraph中构建您的第一个多智能体AI系统

本文教程介绍了如何在Python中构建多智能体AI系统,展示了使用和不使用框架的区别。通过将任务分解为更小的步骤,多智能体系统提高了效率。实现了一个学习指南生成器,使用Ollama和Qwen模型,分为规划、教学和测验三个角色。提供了简单的Python版本和LangGraph版本,展示了不同的工作流协调方式。

如何在Python和LangGraph中构建您的第一个多智能体AI系统

freeCodeCamp.org freeCodeCamp.org · 2026-07-14T21:32:24Z

OpenClaw 是一个个人 AI 助手,能够在本地硬件上运行,并与 WhatsApp、Telegram 等消息应用连接。它通过后台守护进程 Gateway 处理消息,支持多步骤任务和网络搜索,用户只需一条命令即可安装和配置,适合注重隐私的用户。OpenClaw 能够在后台完成复杂的研究任务,并快速返回结果。

使用 Ollama 运行 OpenClaw

KDnuggets KDnuggets · 2026-07-09T14:00:15Z
使用MedGemma、Ollama和Open WebUI构建自己的医疗AI助手

本文介绍了如何在本地构建医疗AI助手,使用开源工具MedGemma、Ollama和Open WebUI。该助手能够分析医学文本和图像,确保数据隐私。教程包括安装步骤、模型测试和图像上传,强调本地运行的隐私和成本优势。MedGemma专为医疗应用设计,支持医学术语和影像理解,适合学习和研究。

使用MedGemma、Ollama和Open WebUI构建自己的医疗AI助手

freeCodeCamp.org freeCodeCamp.org · 2026-07-08T23:21:21Z
如何构建具有工具调用和记忆功能的本地AI代理

本文介绍了如何使用LangChain v1、Ollama和Python构建一个具有工具调用和短期记忆的本地AI代理。该代理能够自主决定何时调用工具,并记住对话内容,以便进行自然的后续提问。教程包括Ollama和Python依赖项的安装、代理代码的编写及运行步骤,强调了本地模型的隐私保护和无API费用的优势。

如何构建具有工具调用和记忆功能的本地AI代理

freeCodeCamp.org freeCodeCamp.org · 2026-07-07T20:08:59Z
如何使用LangChain v1构建RAG驱动的文档问答AI代理

本文介绍了如何使用LangChain、Ollama和Python构建本地RAG驱动的问答AI代理。该代理可以读取个人文档并回答相关问题,确保隐私安全。教程包括Ollama的安装、文档准备、Python代码编写及代理运行步骤。用户可离线使用,无需支付API费用,并可根据需求调整模型和参数以提高回答质量。

如何使用LangChain v1构建RAG驱动的文档问答AI代理

freeCodeCamp.org freeCodeCamp.org · 2026-07-02T23:21:11Z
如何使用Ollama和Qwen构建个人AI网络研究代理

本文介绍了如何使用Ollama、Qwen和Python构建一个AI网络研究代理。该代理能够搜索网络主题、提取相关页面,并利用本地LLM生成简明摘要。用户只需在本地安装Ollama并获取API密钥,通过Python代码实现网页搜索和内容摘要,确保隐私且无API费用。最终,摘要以Markdown格式保存,用户可根据需要调整提示和模型。

如何使用Ollama和Qwen构建个人AI网络研究代理

freeCodeCamp.org freeCodeCamp.org · 2026-06-26T18:07:10Z

本文讨论了如何在本地使用Claude Code进行编程,强调了本地推理模型的优势,如成本低和无速率限制。介绍了三种推理后端(Ollama、LM Studio和llama.cpp),并提供了详细的配置和使用步骤。通过设置环境变量,用户可以将Claude Code连接到本地模型,以提升编程效率。建议使用Ollama和glm-4.7-flash模型作为起点,以实现最佳性能。

将Claude Code与本地模型配对

KDnuggets KDnuggets · 2026-06-12T14:00:59Z

Gemma 4是谷歌DeepMind最新的开源模型,性能更高且计算成本更低,支持多种设备,适用于内部工具和生产环境。文章介绍了如何安装Ollama和Gemma 4,以及配置Claude Code以实现高效的代码生成和调试。Gemma 4能够处理复杂的编程任务,如代码分析和测试生成,适合日常工程使用。

低成本的本地自主编程:Claude Code + Ollama + Gemma 4

KDnuggets KDnuggets · 2026-06-10T14:00:17Z
使用Scikit-LLM与开源语言模型

本文介绍如何使用Ollama本地托管的开源语言模型(如Llama 3、Mistral和Gemma)进行文本分类,避免支付API费用。内容包括Ollama的安装、Scikit-LLM库的配置,以及构建零样本文本分类器的步骤。通过简单的Python代码,用户可以实现模型的训练和预测,展示如何高效使用大型语言模型。

使用Scikit-LLM与开源语言模型

MachineLearningMastery.com MachineLearningMastery.com · 2026-06-04T12:55:34Z

本文记录了在Mac Mini上安装和配置本地大模型工具的过程,重点介绍了如何通过Ollama运行LLM模型,并结合Dify搭建私有知识库,支持网页抓取和文件上传,实现个性化的知识检索和生成。

笔记:在 Mac Mini 本地跑 LLM 大模型

四火的唠叨 四火的唠叨 · 2026-06-01T04:03:31Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码