小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
BaseRT:专为 Apple Silicon 优化,让 Mac 本地大模型快 6.4 倍

Apple Silicon 跑本地大模型,速度还能再提升多少?BaseRT 给出了一个答案:在 M5 Pro 上,它的提示词处理速度最高达到 llama.cpp 的 6.4 倍,MLX 的 3.9 倍 BaseRT 是一款专为 Apple Silicon 优化的本地 AI 推理引擎,可以运行 Qwe

BaseRT:专为 Apple Silicon 优化,让 Mac 本地大模型快 6.4 倍

小众软件
小众软件 · 2026-07-21T07:13:10Z
在15分钟内使用Ollama运行本地AI模型

本文介绍了如何在15分钟内使用Ollama在本地运行小型语言模型。用户只需安装Ollama、下载模型(如Llama 3.2 3B)并开始聊天。Ollama通过量化技术减少内存占用,确保模型高效运行,保障数据安全和隐私。

在15分钟内使用Ollama运行本地AI模型

MachineLearningMastery.com
MachineLearningMastery.com · 2026-07-16T12:25:41Z
Deja Vu本地记忆系统:项目经验跟随代码仓库同步迁移

Deja Vu是一个开源的本地记忆系统,旨在提升AI编程代理的项目记忆能力。它通过在代码仓库中保存项目经验,帮助AI快速获取重要信息,减少重复解释的时间。系统使用Markdown和JSONL文件结构,支持分层加载,确保AI在需要时获取相关信息,同时避免隐私风险。开发者可以控制记忆内容,使其更像代码资产。

Deja Vu本地记忆系统:项目经验跟随代码仓库同步迁移

极道
极道 · 2026-07-16T02:41:00Z
screenpipe:开源本地的 AI 记忆引擎,让电脑更懂你

screenpipe 是一个开源的本地隐私优先工具,能够自动记录用户的屏幕和音频,生成可搜索的“数字记忆”。它采用事件驱动的捕获策略,仅在有意义的操作时进行记录,数据存储在本地,支持自然语言搜索和视觉时间线回放。用户可以创建自定义的 AI Agent 管道,自动总结工作内容,确保数据隐私和安全。对于关注隐私的用户,screenpipe 是一个值得考虑的替代方案。

screenpipe:开源本地的 AI 记忆引擎,让电脑更懂你

张洪Heo
张洪Heo · 2026-07-15T16:00:00Z

本文介绍了七种2026年工程师在本地基础设施上构建和运行智能代理的Python工具,包括Ollama(轻量级开源大语言模型运行时)、smolagents(简洁代码逻辑)、PydanticAI(数据格式安全)、CrewAI(多代理协作)、AgentScope(生产环境专注)、LangGraph(状态管理支持)和Microsoft Agent Framework(企业功能与本地支持结合)。这些工具各具特色,满足不同需求。

七种用于协调本地AI代理的Python框架

KDnuggets
KDnuggets · 2026-07-15T12:00:56Z
2026年本地数据库即服务(DBaaS):平台、标准与差距

到2026年,尽管平台工程和Kubernetes的采用有所进展,但数据库供应仍然分散。开发团队在自主管理与依赖平台之间面临权衡。目前的解决方案缺乏标准化,导致重复构建相似的数据库即服务(DBaaS)能力。因此,需要一个统一的标准,以简化跨环境的数据库管理和自助服务体验。

2026年本地数据库即服务(DBaaS):平台、标准与差距

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-07-15T11:00:00Z
微软爆改Windows 11搜索框(搜索功能) 删除广告和必应搜索推荐 侧重本地优先

微软对Windows 11搜索框进行了重大改进,去除了广告和推广内容,提升了本地文件和设置的搜索体验。预览版用户可以手动启用新搜索框,界面更简洁,搜索结果更清晰,优先显示相关答案,并减少干扰。用户还可以控制联网搜索的使用,以提高搜索准确性和容错率。

微软爆改Windows 11搜索框(搜索功能) 删除广告和必应搜索推荐 侧重本地优先

蓝点网
蓝点网 · 2026-07-14T04:00:26Z
如何构建和调度本地AI助手以执行每日任务

本文介绍了如何构建本地AI助手,自动执行重复任务并生成每日摘要。使用Python创建调度程序,调用GOOGL股票检查、AI新闻摘要和天气简报三个代理,确保所有操作在本地进行以保护隐私。用户可通过设置cron或Windows任务调度器,定时运行这些代理,简化工作流程。

如何构建和调度本地AI助手以执行每日任务

freeCodeCamp.org
freeCodeCamp.org · 2026-07-13T21:36:24Z

SmolVLM2-2.2B是一个高效的视频理解模型,能够在普通GPU上运行,适合处理会议记录、讲座和监控视频。它提取视频帧并生成结构化的JSON摘要,提供每帧的场景描述、关键时刻和行动项,表现优异,适合开发者在本地环境中使用。

本地视频摘要管道:使用SmolVLM2-2.2B处理帧

KDnuggets
KDnuggets · 2026-07-10T12:00:51Z
像部署一样开发:缩小Kubernetes本地与集群之间的差距

Krumware的Epinio是一个开源应用开发引擎,旨在简化Kubernetes的使用,帮助开发者高效部署应用而无需深入了解Kubernetes。Epinio支持快速原型开发,提升开发速度,并确保安全合规。Krumware还计划通过Epinio MCP服务器增强与AI的集成,进一步优化开发流程。

像部署一样开发:缩小Kubernetes本地与集群之间的差距

The New Stack
The New Stack · 2026-07-09T15:00:00Z
如何使用FastMCP为本地AI代理构建MCP服务器

本文介绍了如何使用FastMCP构建MCP服务器,并将本地AI代理连接到该服务器以使用工具。MCP(模型上下文协议)为AI代理和工具提供标准接口,简化了工具的共享与重用。用户可以通过安装Ollama和Python依赖,创建本地MCP服务器,连接远程MCP服务器,并使用LangChain构建AI代理。教程涵盖了安装、构建服务器、编写代理代码及运行代理的步骤,旨在帮助用户高效整合与使用AI工具。

如何使用FastMCP为本地AI代理构建MCP服务器

freeCodeCamp.org
freeCodeCamp.org · 2026-07-08T18:56:26Z
本地模型编码经验

本文讨论了在开发者机器上本地运行小型模型进行自主编码的经验。作者分享了使用Qwen和Gemma等模型进行手动和自动评估的过程,强调任务选择对模型表现的重要性。尽管小模型在某些任务中表现不佳,但在日常使用中提供了更多反馈,促进了更深入的理解和代码审查。总体而言,小模型的自主编码能力仍不及大型模型。

本地模型编码经验

Martin Fowler
Martin Fowler · 2026-07-08T11:57:00Z
如何构建具有工具调用和记忆功能的本地AI代理

本文介绍了如何使用LangChain v1、Ollama和Python构建一个具有工具调用和短期记忆的本地AI代理。该代理能够自主决定何时调用工具,并记住对话内容,以便进行自然的后续提问。教程包括Ollama和Python依赖项的安装、代理代码的编写及运行步骤,强调了本地模型的隐私保护和无API费用的优势。

如何构建具有工具调用和记忆功能的本地AI代理

freeCodeCamp.org
freeCodeCamp.org · 2026-07-07T20:08:59Z

Gemma 4是谷歌DeepMind推出的文档解析工具,能够处理扫描和数字PDF,提取发票信息。它通过将PDF页面渲染为高分辨率图像,利用视觉语言模型读取内容,克服传统文本提取工具的局限性。该工具支持灵活的视觉令牌预算,以适应不同文档的复杂性,确保高效准确的提取。

使用Gemma 4进行零样本本地文档解析:将PDF视为图像

KDnuggets
KDnuggets · 2026-07-07T14:00:04Z
本地模型在编码中的可行性

本文探讨了在本地运行生成模型进行编码的可行性,分析了影响模型性能的因素,如内存、处理器核心、模型参数和推理能力。尽管小型模型在工具调用上存在困难,但Qwen3.6 35B MoE模型在能力、速度和内存占用方面表现最佳。总体而言,当前模型仍需改进,尚未实现简单的“即插即用”体验。

本地模型在编码中的可行性

Martin Fowler
Martin Fowler · 2026-07-07T12:34:00Z
LakeNetworks意大利VPS年付特价:€13.5/年起,1Gbps不限流量+金牌CPU,米兰机房解锁本地业务

LakeNetworks推出特价意大利VPS年付套餐,最低仅需13.5欧元,配置金牌CPU和SSD硬盘,支持1Gbps不限流量,适合高性价比用户。

LakeNetworks意大利VPS年付特价:€13.5/年起,1Gbps不限流量+金牌CPU,米兰机房解锁本地业务

老董日志
老董日志 · 2026-07-05T23:23:05Z
本地双模型协作:Hermes调度Qwen和Nemotron全过程

本地AI应用通过Hermes调度Qwen和Nemotron两个模型,实现专家小分队的协作。Hermes负责任务分配,提升效率和透明度。两个中等模型在特定任务上表现优于单一大模型,同时保障数据隐私。用户可掌控系统,降低成本,推动AI技术的民主化,未来每个人都能拥有自己的本地AI助理。

本地双模型协作:Hermes调度Qwen和Nemotron全过程

极道
极道 · 2026-07-03T00:37:00Z
OpenClaw折腾到Hermes:24GB内存带不动本地模型

文章讨论了本地AI模型与云端服务的对比,指出24GB内存的局限性,难以支持复杂任务。作者经历了从OpenClaw到Hermes框架的转变,发现本地模型在处理长上下文时常出现错误,且量化版本的质量差异显著。尽管本地模型有优势,但最终仍需依赖云端服务以提高效率,反映出效率与数据控制之间的矛盾。

OpenClaw折腾到Hermes:24GB内存带不动本地模型

极道
极道 · 2026-07-02T22:07:00Z
Hermes本地云端双模型配置教程与自动化简报实战

Hermes 是一款 AI 代理工具,支持本地和云端模型的配置。用户可以通过简单的安装和配置创建多个代理,以满足不同需求,如保护隐私或处理复杂任务。Hermes 的反馈循环机制使其能够根据用户反馈进行学习和优化。对于硬件不足的用户,可以选择云服务器或聚合平台来运行模型。

Hermes本地云端双模型配置教程与自动化简报实战

极道
极道 · 2026-07-02T02:25:00Z

Godcoder 是一个本地优先的 Rust 编码助手,强调自我迭代和优化,支持代码修改和 GUI 自动化。franken_ocr 是一个纯 Rust 的 OCR 引擎,专注于无依赖的文档解析。QCue 是一个知识管理工具,将碎片化信息转化为可检索的 Markdown Wiki。ipatool-rs 重写了 IPA 下载工具,适应 Apple 新认证流,提供完整的下载链路。

【Rust日报】2026-07-01 Godcoder:本地优先 Rust 编码助手,连自己的 Harness 都能边跑边自我迭代

Rust.cc
Rust.cc · 2026-07-01T01:10:31Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码