小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
英伟达推出免费工具,将闲置电脑连接成个人AI数据中心

英伟达发布免费开源工具PAIR,可将家中闲置电脑(如RTX显卡PC、MacBook)联网组成个人AI数据中心,用于本地AI推理任务。PAIR非硬件路由器,支持Windows、Linux和macOS,通过六位码和mTLS加密保障安全,能动态适应设备加入或离开,避免干扰用户正常使用。

英伟达推出免费工具,将闲置电脑连接成个人AI数据中心

The Verge The Verge · 2026-09-03T16:00:00Z
纯 C# 追平 llama.cpp?.NET 本地推理三国杀 - 张善友

2026年,.NET生态出现三个本地大模型推理引擎:LLamaSharp借力llama.cpp,性能稳定但依赖原生库;dotLLM纯C#实现,CPU解码追平C++,但预填充慢,零原生依赖;TensorSharp融合GGML内核,GPU吞吐领先,支持多模态和集群。三者各具优势,求稳选LLamaSharp,求纯选dotLLM,求全选TensorSharp,C#本地推理已成熟。

纯 C# 追平 llama.cpp?.NET 本地推理三国杀 - 张善友

张善友 张善友 · 2026-08-02T23:08:00Z

Gemma 4 12B是谷歌DeepMind推出的新型多模态智能模型,旨在直接在笔记本电脑上运行。它采用无编码架构,集成视觉和音频输入,性能接近更大模型,但内存占用更低,适合日常硬件使用。

介绍Gemma 4 12B:一种统一的无编码多模态模型

Google DeepMind Blog Google DeepMind Blog · 2026-06-09T14:10:19Z
如何在手机上使用QVAC和Expo本地运行大型语言模型

现代智能手机具备强大的计算能力,可以离线运行人工智能模型。QVAC平台允许用户在本地设备上处理数据,增强隐私和控制。本文介绍了如何使用React Native构建与QVAC交互的应用程序,实现本地AI推理,避免依赖云服务,从而提高响应速度和安全性。

如何在手机上使用QVAC和Expo本地运行大型语言模型

freeCodeCamp.org freeCodeCamp.org · 2026-06-03T17:17:33Z
Redis之父下场,给DeepSeek V4单独造了一台推理引擎

DeepSeek V4发布后,开发者antirez推出了专属推理引擎ds4.c,旨在提升Mac上的运行效率。该引擎使用C和Metal编写,专注于本地推理,支持高效的量化和KV缓存。测试表明,ds4.c在高端Mac上表现优异,生成速度快。antirez希望通过此项目推动本地推理的发展,并强调AI辅助开发的重要性。

Redis之父下场,给DeepSeek V4单独造了一台推理引擎

量子位 量子位 · 2026-05-08T08:20:40Z
使用n8n、MCP和Ollama实现强大的本地AI自动化

本文介绍了如何通过n8n、MCP和Ollama在本地工作站或小型服务器上实现自动化,替代脆弱的脚本和昂贵的API系统。内容涵盖日志处理、数据质量监控、数据标记、研究更新、事件后期分析、合同审查和代码审查等自动化工作流,强调本地推理的高效性和控制力。

使用n8n、MCP和Ollama实现强大的本地AI自动化

KDnuggets KDnuggets · 2026-01-08T15:00:43Z
在本地运行GPT-OSS的最佳方式

本文介绍了如何在本地高效运行GPT-OSS 20B模型,使用llama.cpp和Open WebUI。通过简单的命令设置Python环境、安装必要的包、下载量化模型并启动服务器,用户可轻松获得现代聊天界面,实现本地推理。

在本地运行GPT-OSS的最佳方式

KDnuggets KDnuggets · 2025-08-25T14:00:04Z
OpenAI 发布开放权重 LLM:gpt-oss-120B(可在电脑上运行)和 gpt-oss-20B(可在手机上运行)

OpenAI 发布了两个开放权重语言模型:GPT-OSS-120b 和 GPT-OSS-20b,允许用户下载和微调。这一举措推动了 AI 领域的透明性和定制化,支持本地推理,确保数据隐私,适用于多种设备,促进本地 AI 创新。

OpenAI 发布开放权重 LLM:gpt-oss-120B(可在电脑上运行)和 gpt-oss-20B(可在手机上运行)

实时互动网 实时互动网 · 2025-08-06T02:44:34Z
使用 Docker Model Runner 本地构建生成式 AI 应用

Docker Model Runner 是 Docker Desktop 的新功能,旨在简化本地运行和测试 AI 模型的过程。它通过将推理引擎嵌入 Docker Desktop,提升性能并优化用户体验,支持从 Docker 和 Hugging Face 拉取模型,特别在 Apple 硅系统上实现 GPU 加速。

使用 Docker Model Runner 本地构建生成式 AI 应用

The New Stack The New Stack · 2025-05-23T13:00:26Z
用M1 Max MacBook Pro私有化部署DeepSeek-R1

DeepSeek-R1是一个开源的本地推理模型,性能与OpenAI相当,适用于多种硬件配置。用户可通过Ollama工具在本地运行该模型,支持多种参数选择,安装后可通过命令行或浏览器插件进行交互,提升使用体验。

用M1 Max MacBook Pro私有化部署DeepSeek-R1

我不是咕咕鸽 我不是咕咕鸽 · 2025-02-11T08:52:06Z

本研究探讨大型语言模型在移动设备上的应用,分析硬件和网络的进步,提出高效的本地推理和低延迟响应方案,以促进移动智能应用的发展,提升用户体验和数据隐私安全。

A Modern Overview of Trends and Applications of Large Language Models on Mobile Devices

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-12-04T00:00:00Z
Mistral AI发布两款小型语言模型Les Ministraux

Mistral AI发布了两款小型语言模型Ministral 3B和8B,称为les Ministraux,专为本地推理应用设计,性能优于同类模型。8B模型采用滑动窗口注意力机制,推理速度更快。与之前的Mistral 7B不同,les Ministraux需商业许可,并可通过API访问,适用于隐私优先的关键应用。

Mistral AI发布两款小型语言模型Les Ministraux

InfoQ InfoQ · 2024-11-28T13:00:00Z
批量生成,本地推理,人工智能声音克隆框架PaddleSpeech本地批量克隆实践(Python3.10)

本文介绍了如何在本地配置PaddleSpeech进行语音合成的本地推理,包括下载音色模型和声码器,编写推理脚本等。同时,提供了两个声码器对象的选择,以及一个音频内容的字典用于生成音频文件。最后,给出了一个基于声学模型FastSpeech2的鬼畜视频一键生成项目的链接。

批量生成,本地推理,人工智能声音克隆框架PaddleSpeech本地批量克隆实践(Python3.10)

刘悦 刘悦 · 2023-06-15T00:00:00Z
声音好听,颜值能打,基于PaddleGAN给人工智能AI语音模型配上动态画面(Python3.10)

本文介绍如何使用PaddlePaddle和PaddleGAN构建“懂王”,实现唇形与语音同步,让人物看起来仿佛在唱歌。需要配置Python3.10和CUDA/cudnn,安装PaddlePaddle和PaddleGAN,并进行本地推理。成品视频可在Youtube/B站搜索:刘悦的技术博客,提取码为oo0d。

声音好听,颜值能打,基于PaddleGAN给人工智能AI语音模型配上动态画面(Python3.10)

刘悦 刘悦 · 2023-05-18T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码