小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
把 Fable 5 装进 MacBook,还要多久

Fable 5 的下线时间延长至12号,用户对端侧 AI 的期待不断增加。高通和苹果等芯片厂商正在重构硬件以支持本地 AI,推出更强大的处理器和架构。新模型如 Google 的 Gemma 4 和阿里的 Qwen3.6 降低了本地部署的门槛。尽管本地 AI 前景光明,但硬件成本、功耗和权限管理等问题仍需解决。

把 Fable 5 装进 MacBook,还要多久

爱范儿
爱范儿 · 2026-07-08T09:31:36Z
本地开发新宠:阿里Qwen 3.6 27B本地部署性能实测与体验

阿里Qwen 3.6 27B本地模型在笔记本上运行表现出色,生成代码和创意写作效果接近顶级API。尽管运行时电脑发热严重,但其性能和数据安全性使得本地部署成为理想选择。用户认为该模型适合简单开发任务,但在复杂项目中表现有限。整体来看,Qwen 3.6 27B是本地开发的强大工具。

本地开发新宠:阿里Qwen 3.6 27B本地部署性能实测与体验

极道
极道 · 2026-06-29T22:48:00Z
本地部署Gemma4-26B-A4B模型

本文介绍了在RTX4060上本地部署Gemma4-26B-A4B模型的过程与效果。通过Q8缓存量化和MTP加速,模型输出速度可达40 tokens/s。尽管在翻译和数学问题上表现一般,但在SQL测试中与其他模型相当。文章还讨论了模型的参数设置及其对性能的影响。

本地部署Gemma4-26B-A4B模型

如鱼饮水
如鱼饮水 · 2026-06-29T00:21:06Z
公共云与本地部署:关于各类工作负载归属的峰会

随着云计算的发展,许多公司开始质疑“云优先”策略。云服务费用上升,企业考虑将部分工作负载迁回本地以降低成本和简化管理。专家建议合理分配工作负载,避免高额账单。

公共云与本地部署:关于各类工作负载归属的峰会

The New Stack
The New Stack · 2026-06-26T00:09:24Z
一千台599美元Mac mini替代H100跑大模型:便宜十倍

一千台599美元的Mac mini可以替代昂贵的H100服务器,具有低成本和低功耗的优势。Mac mini的统一内存架构提升了AI模型的运行效率,适合本地部署。相比之下,云服务费用高昂,使用Mac mini搭建AI服务器简单易行,能有效节省成本。

一千台599美元Mac mini替代H100跑大模型:便宜十倍

极道
极道 · 2026-06-03T22:26:00Z
本地部署 Hy-MT2 翻译模型

腾讯于2026年开源了Hy-MT2翻译模型,支持本地部署,分为1.8B和7B两种尺寸,适合网页和PDF翻译。测试显示,7B模型在翻译质量上优于1.8B模型,尤其在使用Q4缓存量化时表现更佳。用户可通过调整参数和使用不同翻译插件来优化翻译效果。

本地部署 Hy-MT2 翻译模型

如鱼饮水
如鱼饮水 · 2026-06-02T00:40:39Z
6.8万星免费视频神器MoneyPrinterTurbo本地部署教程

MoneyPrinterTurbo是一款流行的本地视频制作工具,用户只需输入关键词即可自动生成包含脚本、配音、字幕和音乐的高清短视频,避免了高额订阅费和平台限制。该工具支持批量生成视频,操作简单,适合各种用户,真正实现了视频制作的自由。

6.8万星免费视频神器MoneyPrinterTurbo本地部署教程

极道
极道 · 2026-05-30T05:47:00Z
KV缓存命中率模拟器

该文章介绍了KV缓存命中率模拟器的使用,包括选择和自定义追踪文件、设置块大小以及缓存块的驱逐策略(FIFO、LRU或最佳)。还提到该工具可以本地部署,并提供相关计算器和反馈渠道。

KV缓存命中率模拟器

Home | KVCache.ai
Home | KVCache.ai · 2026-05-28T00:00:00Z
码道助阵:Hermes本地部署轻松搞定

本案例介绍如何在Windows环境中快速部署Hermes开源AI智能体,利用华为云码道和WSL技术,解决AI Agent本地部署的挑战。开发者可通过简单步骤实现AI助手的功能,包括跨会话记忆和Skill生成,提升自动化任务执行能力。适合个人开发者和企业,预计耗时90分钟,费用低廉。

码道助阵:Hermes本地部署轻松搞定

华为云官方博客
华为云官方博客 · 2026-05-23T04:00:00Z
C# 结合 llama.cpp 实现 QianfanOCR本地部署,搞定所有卡证识别与结构化输出

Qianfan-OCR是一个本地OCR解决方案,旨在提高文档处理效率并保护数据隐私。该模型集成了文档解析、文字识别和语义理解,支持复杂结构的识别,适合企业使用。用户可通过C# WinForm和llama.cpp在本地完成OCR任务,确保敏感数据安全。

C# 结合 llama.cpp 实现 QianfanOCR本地部署,搞定所有卡证识别与结构化输出

dotNET跨平台
dotNET跨平台 · 2026-05-12T23:58:54Z

本文介绍了如何在Windows上本地部署大模型Ollama和OpenWebUI,用户可以在本地运行Llama 3等模型,确保数据隐私、零成本推理和离线使用。文章详细说明了安装步骤、硬件要求和模型推荐,以实现一个私密的AI对话环境。

Windows本地部署大模型 Ollama + OpenWebUI 最佳实践指南

孙威的阳光海
孙威的阳光海 · 2026-05-12T03:40:36Z
开源版的 GPT Image 2,信息图、连续图文、本地部署全拿下|商汤SenseNova U1实测

SenseNova U1 是商汤发布的开源多模态模型,具备连续图文生成能力,能够同时生成文字和图片。该模型在信息图生成方面表现出色,采用 NEO-unify 架构,提升了生成效率和理解能力,适合创作者和开发者使用。SenseNova U1 的开源版本已在 GitHub 和 Hugging Face 上发布。

开源版的 GPT Image 2,信息图、连续图文、本地部署全拿下|商汤SenseNova U1实测

爱范儿
爱范儿 · 2026-04-29T11:01:42Z
本地部署AI大模型完全指南(最新):最低配置+工具+知识库+实战教程

随着AI技术的发展,越来越多的人希望在本地部署大模型,以保护数据隐私并实现零成本调用。本文介绍了本地部署大模型的意义、配置要求及推荐工具,适合开发者和普通用户。通过合理配置显卡和内存,用户可以在不同设备上流畅运行大模型,进行代码编写、文档翻译等多种应用。

本地部署AI大模型完全指南(最新):最低配置+工具+知识库+实战教程

人言兑
人言兑 · 2026-04-25T12:10:12Z

阿里通义发布的新模型Qwen3.6-27B拥有27亿参数,在代码修复测试中得分77.2,超越前代397亿参数模型的76.2分。该模型采用全参数激活的稠密架构,显存需求低至18GB,适合本地运行,降低了开发门槛。其原生多模态能力可处理文本、图像和视频,提升编程助手效率。开源协议为Apache 2.0,便于商业应用,可能改变开发者的使用方式。

27B参数跑赢397B,这个开源模型让本地部署有了新选择

dotNET跨平台
dotNET跨平台 · 2026-04-25T00:09:04Z
一文吃透Ollama Embeddings:概念、实操、避坑,助力RAG落地|本地部署AI大模型必备

本文介绍了Ollama中的嵌入向量及其在检索增强生成中的应用。嵌入向量将文本转换为数值数组,以便计算语义相似度。文章探讨了嵌入向量的生成方法、应用场景(如搜索引擎、去重、推荐系统)以及常见问题和解决方案,帮助新手理解和应用该技术。

一文吃透Ollama Embeddings:概念、实操、避坑,助力RAG落地|本地部署AI大模型必备

人言兑
人言兑 · 2026-04-24T10:40:15Z
Ollama 使用教程:本地 AI 大模型部署工具完全指南

Ollama是一个开源的跨平台大模型工具,旨在简化大型语言模型的本地部署。用户只需一个命令即可运行模型,支持macOS、Windows和Linux等多种操作系统,并提供丰富的模型库。其优势在于数据安全和低成本,适合开发者使用,支持量化和自定义功能。

Ollama 使用教程:本地 AI 大模型部署工具完全指南

人言兑
人言兑 · 2026-04-23T15:09:06Z
Talkdesk 利用 AI 驱动的客户体验自动化技术,瞄准本地部署的联络中心

Talkdesk 推出客户体验自动化 (CXA) 产品,旨在将 AI 功能整合到现有联络中心,支持多语言和全渠道客服。CXA 增强人工客服能力,降低运营成本,提高客户满意度,符合行业数字化趋势,增强市场竞争力。

Talkdesk 利用 AI 驱动的客户体验自动化技术,瞄准本地部署的联络中心

实时互动网
实时互动网 · 2026-04-21T09:49:59Z

本文介绍了在macOS环境下部署OpenClaw、QwenPaw和Hermes Agent的步骤,包括安装Podman、克隆OpenClaw源代码、配置OpenClaw与Discord消息频道,以及QwenPaw和Hermes Agent的安装与配置。强调管理页面的安全性,避免暴露在公网。

本地部署 OpenClaw,QwenPaw 和 Hermes Agent

范叶亮的博客
范叶亮的博客 · 2026-04-18T00:00:00Z

本文介绍了在macOS环境下部署OpenClaw、QwenPaw和Hermes Agent的步骤,使用Podman进行环境隔离。内容包括克隆源代码、构建容器和配置消息频道等。用户可通过浏览器访问管理页面进行后续配置和管理。

本地部署智能体

范叶亮的博客
范叶亮的博客 · 2026-04-18T00:00:00Z

本文介绍了在macOS和Windows环境下部署本地大模型服务的步骤,包括安装ollama和LM Studio、配置环境变量、下载模型以及启动服务。用户可以通过API接口进行测试,确保上下文长度设置合适以优化效果。

本地部署大模型服务

范叶亮的博客
范叶亮的博客 · 2026-04-05T00:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码