小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
你的Mac现在已成为Perplexity AI基础设施的一部分

Perplexity推出Hybrid Compute功能,使AI代理任务能在云端与Mac本地模型间灵活切换,以保护敏感信息并降低成本。该功能支持本地模型选择、隐私过滤和任务无缝衔接,但需32GB内存的Mac。此举正值John Ternus接任苹果CEO,或预示更多AI工作将转向本地设备。

你的Mac现在已成为Perplexity AI基础设施的一部分

The New Stack The New Stack · 2026-09-01T19:21:51Z
Ollama首次尝试受阻后,Claude Desktop现可轻松运行Qwen、DeepSeek和Kimi模型

Ollama重新推出与Claude Desktop的集成,允许用户通过Ollama连接本地或云端模型(如Qwen、DeepSeek等),在Claude界面内使用。此功能支持Mac应用,用户可切换模型,强调成本、速度和灵活性。Ollama旨在让开源模型更易用,未来或支持Windows。

Ollama首次尝试受阻后,Claude Desktop现可轻松运行Qwen、DeepSeek和Kimi模型

The New Stack The New Stack · 2026-08-26T16:59:39Z
Junie现在完全离线运行。你有一台64GB内存的M5 Mac吗?

JetBrains推出Junie Local,一款完全在开发者本机运行的免费AI编程代理,采用Qwen3.6-27B模型,针对Apple Silicon优化。它简化了本地模型设置,适合长时重复任务,并保障代码隐私。但需macOS 26、64GB内存及M5芯片,门槛较高,公司正努力降低硬件要求。

Junie现在完全离线运行。你有一台64GB内存的M5 Mac吗?

The New Stack The New Stack · 2026-08-24T20:56:41Z
Scikit-Ollama用于Scikit-LLM/Ollama集成

本文介绍了scikit-ollama如何将scikit-learn接口与本地Ollama模型结合,实现零-shot文本分类,无需云API。用户可以使用本地Llama 3模型加载电影评论情感数据集,并创建情感预测分类器,从而简化传统机器学习流程,避免数据隐私问题和订阅费用。

Scikit-Ollama用于Scikit-LLM/Ollama集成

MachineLearningMastery.com MachineLearningMastery.com · 2026-07-15T12:00:34Z
Hermes本地云端双模型配置教程与自动化简报实战

Hermes 是一款 AI 代理工具,支持本地和云端模型的配置。用户可以通过简单的安装和配置创建多个代理,以满足不同需求,如保护隐私或处理复杂任务。Hermes 的反馈循环机制使其能够根据用户反馈进行学习和优化。对于硬件不足的用户,可以选择云服务器或聚合平台来运行模型。

Hermes本地云端双模型配置教程与自动化简报实战

极道 极道 · 2026-07-02T02:25:00Z
本地开发新宠:阿里Qwen 3.6 27B本地部署性能实测与体验

阿里Qwen 3.6 27B本地模型在笔记本上运行表现出色,生成代码和创意写作效果接近顶级API。尽管运行时电脑发热严重,但其性能和数据安全性使得本地部署成为理想选择。用户认为该模型适合简单开发任务,但在复杂项目中表现有限。整体来看,Qwen 3.6 27B是本地开发的强大工具。

本地开发新宠:阿里Qwen 3.6 27B本地部署性能实测与体验

极道 极道 · 2026-06-29T22:48:00Z
在VS Code中使用自带语言模型密钥

在2026年微软Build大会上,VS Code展示了使用本地模型进行日志分析的功能,提升了工作灵活性。用户可以通过“自带语言模型”(BYOK)功能添加不同提供商的模型,支持多种工作流程。语言模型编辑器允许用户管理和选择模型,从而增强聊天和代理工作流的选择,提升开发效率。

在VS Code中使用自带语言模型密钥

Visual Studio Code - Code Editing. Redefined. Visual Studio Code - Code Editing. Redefined. · 2026-06-18T00:00:00Z
谷歌浏览器v149正式版向所有用户提供设备端AI管理 可以禁用功能删除4GB本地模型

谷歌浏览器v149正式版推出了设备端AI管理功能,用户可以禁用4GB的本地模型,以避免重复下载。更新后,用户可在设置中禁用此功能,并自动删除已下载的模型。这一功能对于安装多个版本的用户尤为重要,可以节省存储空间。禁用后,用户可以检查模型文件夹确认模型已被删除。

谷歌浏览器v149正式版向所有用户提供设备端AI管理 可以禁用功能删除4GB本地模型

蓝点网 蓝点网 · 2026-06-07T07:07:25Z

本文介绍了2026年免费LLM API的指南,涵盖13家提供商,如Google Gemini和OpenAI,提供AI网关高级玩法和本地模型方案,帮助用户以零成本实现生产工作流。

2026 年免费 LLM API 完全指南:13 家提供商 + AI 网关高级玩法 + 本地模型

夜法之书 夜法之书 · 2026-05-19T02:00:00Z
告别云端大模型:本地模型才是应用软件的靠谱未来 |

文章批判开发者过度依赖云端AI,强调本地模型在应用中的重要性。通过新闻应用示例,展示如何利用苹果设备的内置模型实现快速、安全的文本摘要,避免隐私泄露和网络依赖。强调本地处理高效且减少复杂性,建议开发者在适当情况下使用云端模型,以保护用户数据安全。

告别云端大模型:本地模型才是应用软件的靠谱未来 |

极道 极道 · 2026-05-11T00:53:00Z
聚焦与打磨本地模型

文章讨论了本地模型开发中的挑战,强调用户体验的重要性。尽管本地推理取得了进展,但配置复杂性影响了用户体验。作者希望通过优化特定模型,提高本地模型的易用性和性能,特别是在工具调用和缓存管理方面,最终目标是让更多开发者能够轻松使用本地模型,而非依赖远程API。

聚焦与打磨本地模型

Armin Ronacher's Thoughts and Writings Armin Ronacher's Thoughts and Writings · 2026-05-08T00:00:00Z
片段:5月5日

Rahul Garg开发的开源框架Lattice旨在减少AI编程中的摩擦,通过三层可组合技能和嵌入工程标准提升AI助手的代码质量。文章还提到音乐家Ashley MacIsaac因Google AI错误信息提起诉讼,强调科技公司需对发布内容负责,并探讨了本地模型的潜力及其对未来AI发展的影响。

片段:5月5日

Martin Fowler Martin Fowler · 2026-05-05T16:23:00Z
Ollama launch用法详解:Claude Code、Codex、Hermes Agent、OpenClaw、VS Code等主流工具集成一步到位,本地AI大模型多场景复用

本文介绍了Ollama的命令及其与Codex、Claude Code、Hermes Agent、OpenClaw和VS Code等工具的集成。Ollama v0.15+引入的“ollama launch”命令简化了本地模型的配置与启动,用户可通过一条命令实现多种工具的无缝衔接,提升编码效率。

Ollama launch用法详解:Claude Code、Codex、Hermes Agent、OpenClaw、VS Code等主流工具集成一步到位,本地AI大模型多场景复用

人言兑 人言兑 · 2026-04-26T09:42:31Z

OpenClaw是一个开源个人AI助手,能够处理邮件和日程安排等任务。文章介绍了五个项目,帮助用户学习如何连接聊天应用、运行本地模型、自动化邮件和日历、执行网页任务,以及在虚拟私人服务器上安全部署OpenClaw。每个项目专注于实用技能,最终使用户能够构建一个真正有用的AI助手。

使用OpenClaw的五个有趣项目

KDnuggets KDnuggets · 2026-04-06T12:00:33Z
OpenClaw+本地Gemma4+谷歌Turbo Quant架构全解析

OpenClaw与Gemma 4架构旨在提升本地模型的执行能力。Gemma 4作为高性能模型,能够独立完成复杂任务。系统优化聚焦于模型利用、量化压缩、接口稳定性和上下文扩展,以确保高效运行。通过Turbo Quant技术,模型可在普通设备上流畅运行,简化部署并降低技术门槛。

OpenClaw+本地Gemma4+谷歌Turbo Quant架构全解析

极道 极道 · 2026-04-06T02:21:00Z
Claude Code 也能跑本地模型?CCR 多模型 智能路由,成本直降 90%

本文介绍了通过Claude Code Router(CCR)实现本地模型部署和多模型智能路由的方法,降低AI编程助手的使用成本。用户可通过CCR对接开源模型GLM5,实现零成本使用,并根据任务类型自动选择合适模型,优化资源利用和成本。合理配置后,月成本可降低90%以上,适合开发者寻找高性价比的AI解决方案。

Claude Code 也能跑本地模型?CCR 多模型 智能路由,成本直降 90%

探索云原生 探索云原生 · 2026-03-18T20:00:00Z
tiny corp的产品 - 训练盒

新香港办公室的产品愿景更加明确,当前的LLM缺乏学习能力,导致多样性下降。未来市场可能被少数模型主导,云计算将占主导地位。为避免同质化,需要开发能够根据用户互动学习的本地模型,而非依赖现有API服务。

tiny corp的产品 - 训练盒

the singularity is nearer the singularity is nearer · 2026-02-14T16:00:00Z
技术速递|Windows ML 正式发布:助力开发者在 Windows 设备上大规模扩展本地 AI

微软正式推出Windows ML,旨在将AI计算能力引入Windows设备。该平台支持本地模型推理,简化跨硬件部署,提升AI应用的响应速度和隐私保护,助力开发者构建高效、安全的AI体验。

技术速递|Windows ML 正式发布:助力开发者在 Windows 设备上大规模扩展本地 AI

dotNET跨平台 dotNET跨平台 · 2025-11-20T00:02:07Z
10个Python一行代码示例,用于调用大型语言模型(LLM)

本文介绍了10个Python一行代码示例,用于调用大型语言模型(LLM),包括云端API(如OpenAI、Anthropic、Google Gemini等)和本地模型(如Ollama、LM Studio、vLLM)。每个示例附有简要说明和官方文档链接,帮助用户快速实现LLM调用,提升开发效率。

10个Python一行代码示例,用于调用大型语言模型(LLM)

MachineLearningMastery.com MachineLearningMastery.com · 2025-10-14T11:00:54Z
几分钟内构建MCP客户端:本地AI代理真正实现

本文介绍了如何在本地构建MCP客户端,以确保数据隐私和控制。用户可以通过简单步骤和少量代码连接MCP服务器并进行交互,支持本地模型,避免云服务的费用和数据泄露风险。

几分钟内构建MCP客户端:本地AI代理真正实现

DEV Community DEV Community · 2025-05-09T14:48:19Z
  • <<
  • <
  • 1 (current)
  • 2
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码