小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

谷歌Gemma 4 Good挑战赛公布获奖项目,旨在用AI解决现实问题。获奖方案包括辅助老人和残障人士的机器人GEM-4、支持残障教师的语音白板Trido、离线野生动物研究工具PenguinAgent、痴呆症护理伴侣DEMENTOR等。这些项目利用Gemma模型在边缘设备上运行,强调隐私保护和离线能力,覆盖教育、医疗、灾害预警等领域。

开发者如何利用Gemma 4构建有益于社会的AI

The Keyword The Keyword · 2026-08-24T16:00:00Z

法国自8月11日起禁止未经同意的电话营销,违规企业最高罚款37.5万欧元,此举引发摩洛哥呼叫中心岗位危机。同时,AI导致互联网集体记忆消失,链接腐烂、信息隔断,文化主权受威胁。英国非政府组织借“儿童安全”推动美国数字身份法案,剥夺网络匿名权。此外,14MB的智能体大语言模型Needle 2发布,可在边缘设备运行。

2026 08 12 HackerNews

介绍 on SuperTechFans 介绍 on SuperTechFans · 2026-08-12T00:41:45Z
AI + C# NativeAOT:破解应用开发的"最后一公里" - 张善友

C# NativeAOT编译模式通过预编译生成原生机器码,实现亚秒级启动、15MB极小镜像和低内存占用,适合Serverless冷启动和边缘设备。虽非万能,存在性能损失限制,但为AI从实验室到生产提供高效部署路径,优于Python生态。

AI + C# NativeAOT:破解应用开发的"最后一公里" - 张善友

张善友 张善友 · 2026-07-27T13:47:00Z

MoteDB是一款专为边缘设备设计的嵌入式数据库,支持多模态数据。最新更新使性能提升2-10倍,内存使用减少30%。该数据库完全由Rust构建,展示了Rust的强大能力,适合机器人和高性能数据库开发者使用。

面向具身智能场景的AI原生多模态数据库 motedb v0.5.1 发布

Rust.cc Rust.cc · 2026-07-13T14:25:30Z
如何构建小型语言模型集群的生产架构

本文讨论了小型语言模型(SLM)架构设计,以避免“模型衰退”。重点包括建立模型注册表以跟踪模型来源和性能,实施版本控制的网关模式,以及开发基于清单的交付系统,以确保模型在边缘设备上的高效部署。这些方法提高了模型的可维护性和可追溯性,确保在生产环境中有效管理多个SLM。

如何构建小型语言模型集群的生产架构

freeCodeCamp.org freeCodeCamp.org · 2026-06-17T19:21:38Z

IREE是一个基于MLIR的开源编译器,旨在高效地将TensorFlow、PyTorch等模型编译到移动端和边缘设备。其编译流程包括前端导入、优化和生成目标代码,支持多种硬件后端。IREE的模块化方言设计便于扩展和优化,通过HAL实现设备抽象和内存管理,提升跨平台兼容性。

【编译器工程与 MLIR】在实际框架中集成 MLIR(以 IREE 为例)

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-06-09T00:00:00Z

Gemma 4最近发布了优化的量化感知训练(QAT)检查点,提升了模型在移动设备上的效率,减少了压缩时的质量损失,显著降低了内存占用,适合在日常边缘设备上运行。新模型支持多种开发工具,用户可轻松下载和部署。

Gemma 4 QAT模型:优化移动设备和笔记本电脑的模型压缩效率

The Keyword The Keyword · 2026-06-05T16:00:00Z

本文介绍了五种小型语言模型:SmolLM3-3B、Qwen3-4B-Instruct-2507、Phi-3-mini-4k-instruct、Gemma-4-E2B-it 和 Mistral-7B-Instruct-v0.3。这些模型支持工具调用,适用于多种应用场景,具有不同的参数、架构和上下文长度,能够在不依赖大型基础设施的情况下提供高效推理和多语言支持,适合边缘设备和低延迟需求。

五种小型语言模型用于自主工具调用

KDnuggets KDnuggets · 2026-05-14T12:00:13Z
Meta AI发布EUPE:一款参数量低于1亿的紧凑型视觉编码器,可同时处理各种视觉任务

Meta公司推出了一种紧凑型视觉编码器EUPE,能够同时处理多种视觉任务。它采用“先扩大规模,再缩小规模”的方法,将多个专家模型的知识整合到一个代理模型中,并提炼出高效的学生模型,从而解决边缘设备计算资源不足的问题。

Meta AI发布EUPE:一款参数量低于1亿的紧凑型视觉编码器,可同时处理各种视觉任务

实时互动网 实时互动网 · 2026-04-08T02:22:37Z
从RTX到Spark:NVIDIA加速Gemma 4以实现本地智能AI

谷歌Gemma 4系列推出小型高效模型,优化NVIDIA GPU性能,支持推理、编码和多模态交互,适用于边缘设备和高性能GPU,推动本地智能助手的发展。

从RTX到Spark:NVIDIA加速Gemma 4以实现本地智能AI

NVIDIA Blog NVIDIA Blog · 2026-04-02T16:15:58Z

MoteDB v0.1.4 发布,全球首款面向具身智能的 AI 嵌入式数据库,支持多模态数据,内存占用仅 35MB,查询延迟≤50ms,适用于家庭机器人和 AR 眼镜等边缘设备。

MoteDB v0.1.4 发布:面向具身智能的 AI 原生嵌入式数据库

Rust.cc Rust.cc · 2026-04-02T15:06:38Z
阿里巴巴通义千问团队继续推出小模型 9B参数能力甚至超过120B的开源同行

阿里巴巴通义千问团队推出适合边缘设备的小型模型,参数范围从0.8B到9B,强调以少量算力实现高智能。新模型在架构和数据质量上进行了优化,未来将推出更小的基础模型。

阿里巴巴通义千问团队继续推出小模型 9B参数能力甚至超过120B的开源同行

蓝点网 蓝点网 · 2026-03-03T00:30:06Z
大模型蒸馏:小型快速AI的实用指南

大模型在基准测试中表现优异,但推理成本高。模型蒸馏通过知识转移压缩模型,既保持准确性又降低成本,适合边缘设备。本文介绍了蒸馏的原理、应用场景及与其他优化技术的结合,以提高LLM应用的效率和性能。

大模型蒸馏:小型快速AI的实用指南

Redis Blog Redis Blog · 2026-02-11T00:00:00Z

MoteDB 是全球首款面向具身智能的 AI 嵌入式数据库,专为家庭机器人和 AR 眼镜等边缘设备设计,支持多模态数据的统一存储与查询,具备低延迟检索和强一致性数据语义。

用rust 写了一个多模态数据库,欢迎大家使用评价

Rust.cc Rust.cc · 2026-01-17T15:47:45Z
WASI 1.0:2026年你将不会察觉WebAssembly无处不在

WebAssembly在Wasm 3.0和组件模型发布后取得显著进展,预计2026年2月发布WASI 0.3.0。这一标准化将使WebAssembly逐步取代不适合某些应用的容器,特别是在边缘设备和无服务器环境中。WebAssembly已在多个环境中稳定运行,未来将支持更高层次的抽象和API,以促进开发者的使用。

WASI 1.0:2026年你将不会察觉WebAssembly无处不在

The New Stack The New Stack · 2026-01-05T19:00:08Z
LiteRT - 一种高性能、可扩展的轻量级深度学习推理运行时用于…

LiteRT是谷歌基于TensorFlow Lite开发的轻量级推理运行时,适用于资源受限的边缘设备。V1兼容经典TFLite API,V2引入异步执行和自动加速器选择,支持多平台。其主要特点包括跨平台支持、硬件加速、异步高效I/O和生态系统兼容性,适合移动实时推理、嵌入式设备和生成模型加速。

LiteRT - 一种高性能、可扩展的轻量级深度学习推理运行时用于…

云原生 云原生 · 2025-11-26T04:02:48Z

Mariner Linux 是微软于2020年推出的开源轻量级Linux发行版,专为云服务和边缘设备设计,具有精简内核、高安全性和低资源占用的特点,支持虚拟机和容器。它使用 tdnf 作为包管理器,适合边缘计算和云原生应用。

Mariner Linux 详解:微软开源的轻量级云边操作系统

极客技术博客’s Blog 极客技术博客’s Blog · 2025-11-16T10:00:12Z
Liquid AI 发布 LFM2-VL-3B,为边缘设备带来 3B 参数的视觉语言模型

Liquid AI 发布了 LFM2-VL-3B,这是一个具有 30 亿参数的视觉语言模型,专用于图像文本到文本任务。该模型提高了准确率并保持了处理速度,支持高达 512×512 的图像输入,适合边缘设备使用,评估得分具有竞争力。

Liquid AI 发布 LFM2-VL-3B,为边缘设备带来 3B 参数的视觉语言模型

实时互动网 实时互动网 · 2025-10-27T02:58:19Z
人工智能的转折点不在云端,而在边缘

AI模型开发已达到转折点,边缘设备能够运行多种语言模型,但大型语言模型面临挑战。Edge Impulse的CEO指出,工业环境需要更高的可靠性和投资回报。小型语言模型和视觉语言模型在边缘应用中逐渐成熟,能够进行复杂的视觉分析。

人工智能的转折点不在云端,而在边缘

The New Stack The New Stack · 2025-10-26T15:00:02Z
高通描绘人工智能从云端到边缘的愿景

高通提出AI工作负载将在云端与边缘设备间混合运行,未来依赖6G技术。CEO Amon强调边缘设备的重要性,认为其能提供个性化和即时体验。骁龙8 Elite Gen 5和Snapdragon X2 Elite系列处理器将增强AI处理能力,目标为高端市场。

高通描绘人工智能从云端到边缘的愿景

实时互动网 实时互动网 · 2025-09-25T03:44:49Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码