小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
Kimi K3缓存为何比DeepSeek V4大,2.78万亿参数与24层无压缩层的真相

金句:两万亿参数模型打架,偷看小抄那个真能赢吗? Moonshot的K3缓存比DeepSeek V4大,这件事本身就像学霸考试带了两本笔记本。一本记重点,一本记全部。但重点来了,两本笔记本的重量差距,直接决定了谁跑得快、谁记得牢。这篇文章不聊代码,只聊缓存大小背后那点人性。缓存就是模型的小抄本,越大能记的东西越多,但翻书速度也越慢。...

Kimi K3缓存为何比DeepSeek V4大,2.78万亿参数与24层无压缩层的真相

极道
极道 · 2026-07-28T10:26:00Z
一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

AI模型价格从70万打到1.5万,开源社区是把大厂当韭菜割了吗? 80%的模型体积被削掉,智商居然还保留82%。一群民间高手在Discord里把7530亿参数的顶级大模型塞进了不到2万块的显卡里,他们到底对模型干了什么? 模型体积与内存带宽构成第一道成本高墙...

一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

极道
极道 · 2026-07-22T22:13:00Z
ResULIC:语义残差编码与压缩感知扩散的超低码率图像压缩 | ICML 2025

图像压缩的核心目标是在尽可能低的码率下保留尽可能高的视觉质量。近年来,学习式图像压缩方法在客观指标和主观感知质量上取得了显著进展,但在极低码率场景下仍面临明显挑战:传统率失真优化方...

ResULIC:语义残差编码与压缩感知扩散的超低码率图像压缩 | ICML 2025

实时互动网
实时互动网 · 2026-07-22T06:15:05Z

拆解 WiredTiger Block Manager:块与 address cookie、无覆盖写入、checkpoint 的 alloc/avail/discard extent list,以及 allocation_size 与 checksum;压缩只作入口,不写各 codec 手册。

【WiredTiger 内核】Block manager、页格式与压缩

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-22T00:00:00Z
克里斯托弗·温斯莱特:Postgres 19 压缩:从 pglz 到 LZ4

Postgres 19计划将默认的TOAST压缩算法从pglz更改为LZ4,LZ4在压缩速度和压缩比上优于pglz,更适应现代硬件。Postgres使用统一的压缩框架,自动对可变长度类型进行压缩,TOAST的实现将继续优化压缩算法以解决数据存储问题。

克里斯托弗·温斯莱特:Postgres 19 压缩:从 pglz 到 LZ4

Planet PostgreSQL
Planet PostgreSQL · 2026-07-16T12:00:00Z
群晖 DSM 7.4:原生数据去重/压缩功能,可节省硬盘空间。是 DS216+、DS918+ 的最后一个版本

群晖DSM 7.4正式发布,新增数据缩减功能,自动删除重复数据并压缩文件,节省存储空间。引入AI助手、私有知识库和GPU信息显示等功能。部分早期设备将不再支持此版本,数据缩减功能适用于2022年及以后推出的型号,提升存储效率。

群晖 DSM 7.4:原生数据去重/压缩功能,可节省硬盘空间。是 DS216+、DS918+ 的最后一个版本

小众软件
小众软件 · 2026-07-16T06:12:35Z

本文探讨了Apache Lucene中有限状态转换器(FST)在段文件中的作用,如何通过词典快速定位倒排索引的postings。FST通过共享前缀压缩词典,减少内存占用,并支持高效查找与遍历。文章比较了Lucene的词典结构与PostgreSQL的GIN Entry Tree,强调两者在存储引擎假设上的不同,并讨论了FST的实现细节及其在查询中的应用。

【全文检索引擎】词项词典 FST:前缀压缩与 TermsEnum

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-15T00:00:00Z

本文讨论了LevelDB 1.23的架构及其与RocksDB的差异,重点介绍了DBImpl的核心成员、读写路径、后台任务处理以及SST文件与MANIFEST的语义。LevelDB设计简洁,但存在单线程压缩和无列族等限制,这促使了RocksDB的开发,以满足更高的并发和多租户需求。

【RocksDB 内核机制】LevelDB 基线:单线程 Leveled 与 DBImpl 骨架

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-07T00:00:00Z
LensVLM:用于文本压缩视觉表示的选择性上下文扩展

LensVLM是一种推理框架,旨在提升视觉语言模型(VLM)在压缩图像上的表现。该方法通过选择性扩展相关图像,保持高达4.3倍的有效压缩精度,超越传统的文本和视觉压缩基线。在多模态文档和代码理解任务中,随着压缩增加,准确性显著提升。

LensVLM:用于文本压缩视觉表示的选择性上下文扩展

Apple Machine Learning Research
Apple Machine Learning Research · 2026-07-07T00:00:00Z
PicForge 离线批量图片压缩工具

PicForge 是一款本地优先的批量图片处理 Web 应用,支持拖入图片进行压缩,具备批量处理、主流格式支持、自由调参和离线使用等功能,用户可方便地调整图片尺寸和质量。

PicForge 离线批量图片压缩工具

Dejavu's Blog
Dejavu's Blog · 2026-07-06T14:32:30Z

本章探讨了Parquet格式的编码与压缩机制,强调编码降熵与通用压缩的两层结构。实测结果显示,低基数列适合字典编码,近似等差整数列使用差分编码效果最佳,而高熵随机数据则难以压缩。总结了编码与压缩的选择原则,强调匹配数据模式的重要性。

【数据湖与开放表格式】列式编码与压缩

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-30T00:00:00Z
构建 Jaeger 的 ClickHouse 后端:对 1000 万个跨度实现 8.6 倍压缩

Jaeger v2.18.0 现已支持 ClickHouse,提供高效的分布式追踪存储。ClickHouse 的列式存储优化了数据压缩和查询速度,适合处理大量事件数据。通过集成 ClickHouse,Jaeger 能快速计算服务性能指标,提升微服务监控能力。

构建 Jaeger 的 ClickHouse 后端:对 1000 万个跨度实现 8.6 倍压缩

Cloud Native Computing Foundation
Cloud Native Computing Foundation · 2026-06-23T11:00:00Z
Workflow SDK 现在压缩运行和步骤的负载

Workflow SDK 5 beta 现在自动使用 zstd 压缩所有运行、钩子和步骤的输入输出,大数据包在存储前会被压缩,节省存储空间并加快读取速度。典型的 AI 对话 JSON 数据存储成本可降低多达 85%。请更新至 workflow@5.0.0-beta.19 或更高版本以获取更多信息。

Workflow SDK 现在压缩运行和步骤的负载

Vercel News
Vercel News · 2026-06-22T00:00:00Z

本文讨论了ClickHouse的列存储压缩技术,包括专用编码(如Delta和Gorilla)与通用压缩(如LZ4和ZSTD)。不同数据类型适用不同的编码策略,压缩效果需通过实测来验证。建议根据数据特征选择合适的CODEC,以优化存储和查询性能。文章还提到与PostgreSQL的对比,以及在高并发环境下的插入策略和性能监控。

【列存引擎内核】压缩与编码

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-18T00:00:00Z
压缩就是智能:用初中数学语文解释什么是香农熵

本文探讨了信息论中的熵与压缩的关系,提出“压缩即智能”的观点。通过机器人搬砖的例子,说明如何利用概率优化指令编码以实现信息压缩的极限。训练AI模型的目标是提高预测准确性,降低交叉熵,从而实现更高效的文本压缩。

压缩就是智能:用初中数学语文解释什么是香农熵

极道
极道 · 2026-06-10T11:54:00Z
压缩管理器Bandizip自带签名工具存在白加黑滥用风险 可用于加载任意DLL

压缩管理器Bandizip的签名工具存在安全缺陷,攻击者可利用该缺陷加载任意DLL文件,可能导致后门程序的触发。该工具未进行路径和签名校验,存在中等风险。建议班迪软件加强检测机制,企业用户应限制使用以防攻击。

压缩管理器Bandizip自带签名工具存在白加黑滥用风险 可用于加载任意DLL

蓝点网
蓝点网 · 2026-06-08T02:00:26Z

Trifecta Tech Foundation 发布了 libzstd-rs-sys,这是一个纯 Rust 实现的 Zstandard 压缩库,旨在提高可移植性和生态独立性。该库支持与 C 参考实现兼容的静态库,已完成解压缩和字典构建器的清理工作。虽然默认性能稍逊于 C 实现,但可通过特性提升性能。

【Rust日报】2026-06-08 宣布 Rust 实现的 Zstandard:面向现代 CPU 的纯 Rust 压缩库

Rust.cc
Rust.cc · 2026-06-08T01:06:48Z
Google Gemma 4 QAT量化压缩解析:手机上跑本地模型

Google推出的Gemma 4 QAT模型通过量化感知训练技术,将AI模型从4GB压缩至1GB,使其能够在普通手机上本地运行。这项技术提升了隐私保护和响应速度,普通用户可以轻松下载和使用这些模型,未来将带来更多应用场景。

Google Gemma 4 QAT量化压缩解析:手机上跑本地模型

极道
极道 · 2026-06-05T22:42:00Z

Gemma 4最近发布了优化的量化感知训练(QAT)检查点,提升了模型在移动设备上的效率,减少了压缩时的质量损失,显著降低了内存占用,适合在日常边缘设备上运行。新模型支持多种开发工具,用户可轻松下载和部署。

Gemma 4 QAT模型:优化移动设备和笔记本电脑的模型压缩效率

The Keyword
The Keyword · 2026-06-05T16:00:00Z
机器视觉压缩的三种途径:VCM、FCM 和 V-Nova 通配符

视频编码技术正向机器视觉优化发展,主要有三种方案:面向机器的视频编码(VCM)、面向机器的特征编码(FCM)和V-Nova的LCEVC。VCM优化像素处理以支持机器任务,FCM直接传输神经网络特征,LCEVC结合低分辨率基础层与高分辨率增强层,兼顾机器分析与人工视觉需求。

机器视觉压缩的三种途径:VCM、FCM 和 V-Nova 通配符

实时互动网
实时互动网 · 2026-06-04T06:17:44Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码