小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
在线教程|27B大模型压缩到7.2GB!Ternary-Bonsai用「三进制魔法」让大模型跑进个人电脑

该模型基于 Qwen3.6-27B 架构,通过端到端三进制量化技术,将模型权重压缩为 {-1、0、+1} 三种状态,并结合 FP16 批量缩放机制,在大幅降低模型体积的同时尽可能保留原始模型能力。1、进入 hyper.ai 首页后,选择「教程」页面,或点击「查看更多教程」,选择「Ternary-Bonsai-27B:7.2GB 三值量化推理...

在线教程|27B大模型压缩到7.2GB!Ternary-Bonsai用「三进制魔法」让大模型跑进个人电脑

HyperAI超神经
HyperAI超神经 · 2026-07-24T03:51:02Z
在线教程|一键加载ComfyUI工作流,不写一行代码也能玩转AI绘图

同时,ComfyUI 具备开放的扩展生态,支持社区自定义节点,可接入 LoRA、ControlNet、量化模型等多种能力,满足图像生成、图像编辑、视频生成等不同场景需求。此外,ComfyUI 还提供了丰富的预设模板,并支持自动检测工作流所需模型,降低模型配置门槛,让更多用户能够快速体验生成式 AI 工作流。1、进入 hyper.ai...

在线教程|一键加载ComfyUI工作流,不写一行代码也能玩转AI绘图

HyperAI超神经
HyperAI超神经 · 2026-07-21T10:37:24Z
在线教程|9B 小模型也能复杂推理,基于 Qwen3.5-9B,Qwythos 融合 Claude 推理经验实现能力跃升

Empero 开源了 Qwythos-9B-Claude-Mythos-5-1M,这是一款增强推理能力的小模型,拥有 90 亿参数。该模型通过高质量数据提升复杂推理任务的表现,支持长上下文和工具调用,拓展了多模态应用。HyperAI 提供了快速部署和测试的资源,方便开发者使用。

在线教程|9B 小模型也能复杂推理,基于 Qwen3.5-9B,Qwythos 融合 Claude 推理经验实现能力跃升

HyperAI超神经
HyperAI超神经 · 2026-07-14T05:59:31Z
在线教程|InSpatio 团队开源实时 4D 世界模拟器,传入一段视频即可自由漫游动态世界

InSpatio团队推出了InSpatio-World,这是一个实时4D世界模拟器,用户可以通过普通视频和自定义摄像机轨迹生成新视角视频。该模型采用时空自回归框架,支持复杂拍摄技巧,推理速度可达24 fps,适合实时应用。

在线教程|InSpatio 团队开源实时 4D 世界模拟器,传入一段视频即可自由漫游动态世界

HyperAI超神经
HyperAI超神经 · 2026-07-10T15:19:25Z
在线教程|阿里千问团队开源首个原生语言世界模型,一个模型打通终端、网页与手机智能体交互

阿里巴巴推出的「Qwen-AgentWorld-35B-A3B」模型在AgentWorldBench评测中超越Claude Sonnet 4.6。该模型专注于环境建模,具备跨领域建模能力,支持多种交互方式。其架构结合了Gated DeltaNet和Gated Attention,激活参数仅30亿,提升了效率和效果。该模型已上线HyperAI,用户可体验其智能体交互功能。

在线教程|阿里千问团队开源首个原生语言世界模型,一个模型打通终端、网页与手机智能体交互

HyperAI超神经
HyperAI超神经 · 2026-07-09T06:07:13Z
在线教程丨32K上下文一次解析数十页文档,百度开源Unlimited OCR,重构长文档复杂场景

近年来,OCR 技术已从简单的文字识别发展为完整的文档理解。新一代 DeepSeek OCR 模型通过引入大语言模型,提升了识别准确率和复杂版面解析能力。百度的 Unlimited OCR 解决了传统 OCR 的效率低和上下文割裂问题,采用 R-SWA 机制,降低计算成本,支持长文档的高效处理,并可扩展至其他任务。

在线教程丨32K上下文一次解析数十页文档,百度开源Unlimited OCR,重构长文档复杂场景

HyperAI超神经
HyperAI超神经 · 2026-06-29T12:57:58Z
在线教程丨UC伯克利/英伟达等发布3DGS开源库gsplat,节省4倍显存,训练时间缩短10%

自2023年《3D Gaussian Splatting for Real-Time Rendering of Radiance Fields》发布以来,3DGS技术在三维重建领域迅速崛起。与传统NeRF相比,3DGS在渲染速度和视觉质量上有显著提升,但对显存和计算资源的要求较高。加州大学伯克利分校等机构开发的开源项目gsplat优化了训练框架,显著降低了资源需求,支持多种数据来源,并提供实时Web查看功能,便于快速验证模型。

在线教程丨UC伯克利/英伟达等发布3DGS开源库gsplat,节省4倍显存,训练时间缩短10%

HyperAI超神经
HyperAI超神经 · 2026-06-25T05:47:12Z
在线教程丨香港科技大学团队开源首个确定性视频深度框架DVD,零样本刷新 SOTA

香港科技大学(广州)团队提出的DVD模型通过一次前向传播实现视频深度估计,提升了推理效率,解决了几何幻觉问题。该模型在多个基准测试中表现优异,仅需36.7万帧训练数据,显著降低了成本,为视频三维感知提供了新技术路线。

在线教程丨香港科技大学团队开源首个确定性视频深度框架DVD,零样本刷新 SOTA

HyperAI超神经
HyperAI超神经 · 2026-06-18T06:45:41Z
在线教程丨最高4倍生成速度提升,DiffusionGemma可同时生成整块文本,基于多轮并行去噪持续优化结果

Google于6月11日开源了基于离散扩散技术的文本生成模型DiffusionGemma。该模型具有高效的生成速度,能够以最高1100 Token/s的速度同时生成整个文本块,采用26B参数的混合专家设计,支持256K Token长上下文和多模态输入。尽管标准版Gemma 4在生成质量上更优,DiffusionGemma展示了新的发展方向。

在线教程丨最高4倍生成速度提升,DiffusionGemma可同时生成整块文本,基于多轮并行去噪持续优化结果

HyperAI超神经
HyperAI超神经 · 2026-06-12T10:10:12Z
在线教程丨16GB笔记本跑出接近26B MoE性能,Gemma 4 12B基于创新架构统一处理文本/图像/声音三种模态

Google DeepMind 发布了新款多模态模型 Gemma 4 12B,参数为120亿,但在多项测试中表现接近260亿参数的模型。其无编码器架构显著降低了推理延迟和内存占用,支持音频输入,并可在普通笔记本上运行,降低了部署成本,为开发者提供了接近顶级性能的选择。

在线教程丨16GB笔记本跑出接近26B MoE性能,Gemma 4 12B基于创新架构统一处理文本/图像/声音三种模态

HyperAI超神经
HyperAI超神经 · 2026-06-10T03:09:51Z
在线教程丨英伟达开源LocateAnything,3B模型可实现图像+视频的目标指向/开放词汇目标检测/指代表达定位/OCR文本定位等功能

NVIDIA 最近推出了视觉语言定位模型LocateAnything-3B,拥有30亿参数,支持多种视觉定位任务。其核心创新为并行框解码(PBD),显著提升了定位精度和解码速度,尤其在复杂场景下表现优异,推动了视觉定位技术的发展。

在线教程丨英伟达开源LocateAnything,3B模型可实现图像+视频的目标指向/开放词汇目标检测/指代表达定位/OCR文本定位等功能

HyperAI超神经
HyperAI超神经 · 2026-06-02T09:55:40Z
Free CPU在线教程 | Hermes Agent学会长期记忆?记忆增强插件TencentDB Agent Memory可将事实/偏好/任务状态等分开存储

过去一年,AI Agent 发展迅速,但缺乏持续记忆。为解决这一问题,Nous Research 推出了 Hermes Agent,具备自我演进学习能力。同时,TencentDB Agent Memory 作为记忆增强插件,采用分层式记忆架构,帮助 Agent 长期积累经验。结合这两者,AI Agent 正在向具备学习和记忆能力的数字员工迈进。

Free CPU在线教程 | Hermes Agent学会长期记忆?记忆增强插件TencentDB Agent Memory可将事实/偏好/任务状态等分开存储

HyperAI超神经
HyperAI超神经 · 2026-06-01T12:02:53Z
在线教程丨单卡即可爆改,面壁智能等开源MiniCPM-V-4.6,1.3B端侧模型支持图像理解/视频理解/OCR/多轮多模态对话

近年来,AI行业认识到并非所有场景都需使用大型模型。高昂的推理成本和数据隐私风险使得小型模型在实际应用中更具效率。新开源的MiniCPM-V 4.6模型仅有1.3B参数,支持多种任务,适合在端侧设备上运行,推动AI应用落地。

在线教程丨单卡即可爆改,面壁智能等开源MiniCPM-V-4.6,1.3B端侧模型支持图像理解/视频理解/OCR/多轮多模态对话

HyperAI超神经
HyperAI超神经 · 2026-05-13T10:50:55Z
在线教程丨支持600+语言,小米开源OmniVoice:仅需3-10秒参考音频实现语音克隆

OmniVoice是一款新发布的多语言文本转语音(TTS)模型,支持超过600种语言,包括多种方言和口音。它采用非自回归架构,简化了语音生成流程,提高了自然度和可懂度。该模型具备零样本语音克隆能力,适用于AI配音和跨语言内容生成,展现出广泛的应用潜力。

在线教程丨支持600+语言,小米开源OmniVoice:仅需3-10秒参考音频实现语音克隆

HyperAI超神经
HyperAI超神经 · 2026-05-09T06:34:15Z
在线教程丨指令遵循/推理/编码三合一,Mistral Medium 3.5把Coding Agent搬上云端

Mistral AI 发布的 Mistral Medium 3.5 模型标志着 AI 编程助手向自主智能系统的转变。该模型具备独立运行和处理复杂任务的能力,包括代码生成、调试和测试。通过 Vibe Remote Agents,开发者可以在云端进行异步编码,支持跨工具协作,逐步演化为真正的执行型 AI 助手。这一进展可能改变未来的软件开发流程。

在线教程丨指令遵循/推理/编码三合一,Mistral Medium 3.5把Coding Agent搬上云端

HyperAI超神经
HyperAI超神经 · 2026-05-08T10:28:19Z
在线教程丨指令遵循/推理/编码三合一,Mistral Medium 3.5把Coding Agent搬上云端

Mistral AI 发布了 Mistral Medium 3.5 模型,具备独立运行和复杂任务处理能力,标志着 AI 编程助手向自主智能系统的转变。该模型采用 128B 稠密架构,支持长时间任务执行和工具调用,提升软件开发效率。HyperAI 官网已上线一键部署功能,降低使用门槛。

在线教程丨指令遵循/推理/编码三合一,Mistral Medium 3.5把Coding Agent搬上云端

HyperAI超神经
HyperAI超神经 · 2026-05-07T11:14:44Z
在线教程丨高性能与易部署兼得,DeepSeek-V4-Flash模型参数284B,简单任务可媲美1.6T Pro版模型

DeepSeek V4 最近发布,分为 DeepSeek-V4-Pro 和 DeepSeek-V4-Flash 两个版本。Pro 版本参数达到 1.6T,性能优异,超越其他开源模型;Flash 版本在性能和资源消耗上进行了优化,适合更广泛的硬件。HyperAI 提供一键部署教程,降低使用门槛。

在线教程丨高性能与易部署兼得,DeepSeek-V4-Flash模型参数284B,简单任务可媲美1.6T Pro版模型

HyperAI超神经
HyperAI超神经 · 2026-04-29T12:12:18Z
在线教程丨狂揽41k stars,港大团队开源超轻量AI助手nanobot,4000行代码实现OpenClaw核心功能

香港大学数据智能实验室开源了轻量级个人AI助手nanobot,代码量不足4000行,功能强大且易于开发。nanobot支持多种模型接口和工具调用,具备多会话和跨会话记忆能力,已在GitHub获得41.1k stars,降低了开发门槛,提供详细教程,适合开发者快速上手。

在线教程丨狂揽41k stars,港大团队开源超轻量AI助手nanobot,4000行代码实现OpenClaw核心功能

HyperAI超神经
HyperAI超神经 · 2026-04-28T06:56:50Z
在线教程丨小身材大「码」力,Qwen3.6-27B编程能力达旗舰级

Qwen团队推出了新版本Qwen3.6-27B,这是一个拥有270亿参数的多模态模型,支持视觉和文本理解。该模型在多个编程基准测试中表现优异,超越了前代版本,并在推理任务上取得了高分。HyperAI官网提供了快速部署该模型的教程。

在线教程丨小身材大「码」力,Qwen3.6-27B编程能力达旗舰级

HyperAI超神经
HyperAI超神经 · 2026-04-24T07:17:55Z
在线教程丨Qwen3.6系列首个开源模型Agent编程能力大涨,激活参数仅3B超越Gemma4-31B

Qwen3.6-35B-A3B 模型近日开源,性能优于 Qwen3.5 和 Gemma4 系列,编程基准测试显著提升,新增“思考过程留存”功能,简化开发流程。HyperAI 提供在线部署和教程,支持全球开发者快速体验。

在线教程丨Qwen3.6系列首个开源模型Agent编程能力大涨,激活参数仅3B超越Gemma4-31B

HyperAI超神经
HyperAI超神经 · 2026-04-21T06:00:04Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码