小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
DeepSeek V4的CSA和HCA:如何把百万上下文压缩到不烧显卡

DeepSeek V4引入CSA和HCA两种压缩注意力机制,以提高大模型处理超长上下文的效率。CSA通过分组压缩和稀疏选择保留更多细节,而HCA则实现极端压缩并对所有条目进行密集注意。两者结合使用,既保留重要信息,又降低计算成本。尽管效率提升显著,处理百万级token仍需高性能硬件,主要面向大规模推理场景。未来可能探索动态压缩率等新方向。

DeepSeek V4的CSA和HCA:如何把百万上下文压缩到不烧显卡

极道
极道 · 2026-07-12T00:48:00Z
大模型军备竞赛升级:GPT-6/Fable 5.1/V4 GA三强争霸

AI大语言模型竞争加剧,OpenAI提前发布GPT-6,性能显著提升。Anthropic即将推出Fable 5.1,注重安全性和复杂推理能力。国内DeepSeek的V4 GA版本已准备就绪,力争超越GLM-5.2。各大模型在参数、训练策略和上下文窗口等方面全面升级,未来几个月将迎来AI工具的质变。

大模型军备竞赛升级:GPT-6/Fable 5.1/V4 GA三强争霸

极道
极道 · 2026-07-09T00:55:00Z
破天荒!DeepSeek V4正式版居然要涨价,而且翻着倍地涨

DeepSeek V4正式版将于下月上线,尽管高峰时段价格上涨,但仍被认为便宜。公司正在建设数据中心以应对算力需求,并计划优化模型性能。用户反馈主要集中在幻觉率高、上下文稳定性差和复杂代码任务表现不足等问题,期待模型在能力、价格和速度等方面进一步提升。

破天荒!DeepSeek V4正式版居然要涨价,而且翻着倍地涨

量子位
量子位 · 2026-06-30T04:08:11Z
DeepSeek V4正式版7月中旬上线 API高峰时段价格翻倍

DeepSeek V4正式版将于7月中旬上线,带来功能优化和性能提升。新版本引入峰谷定价机制,高峰时段API价格将提高,并具备百万字超长上下文,采用新注意力机制,显著降低计算需求。

DeepSeek V4正式版7月中旬上线 API高峰时段价格翻倍

TechWeb 全站精华
TechWeb 全站精华 · 2026-06-30T01:01:02Z
Artitalk V4: 从Leancloud迁移至Vercel

Artitalk v4 更新了数据存储和服务架构,摆脱了对 LeanCloud 的依赖,改为使用 Vercel 和 Neon Postgres。用户需迁移旧数据并重新配置管理员账户。新版本保持原有功能,提供更清晰的配置和独立的数据存储方案,确保项目可持续维护。

Artitalk V4: 从Leancloud迁移至Vercel

HCLonely
HCLonely · 2026-06-18T07:46:47Z
早报|微软发布Windows「梦中神机」/腾讯云DeepSeek-V4最高降价97.5%/徕卡相机或被中国资本收购

微软在Build 2026大会上发布了七款自研AI模型,涵盖推理、代码、图像和语音等领域,并推出了强大算力的开发者设备“梦中神机”。OpenAI扩展Codex生态,推出多项新功能,支持更广泛的知识工作。腾讯云大幅下调DeepSeek-V4模型价格,Alphabet计划融资800亿美元用于AI基础设施。

早报|微软发布Windows「梦中神机」/腾讯云DeepSeek-V4最高降价97.5%/徕卡相机或被中国资本收购

爱范儿
爱范儿 · 2026-06-03T00:29:20Z
DeepSeek V4芯模协同背后,国产算力生态开始飞轮加速

国产算力生态正从“芯片被动适配模型”转向“芯模协同”新阶段,开发者逐渐独立解决问题,推动生态迭代。鲲鹏昇腾的适配效率和性能显著提升,开发者开始主动贡献代码,形成良性循环,生态自增长趋势明显,标志着国产算力的成熟。

DeepSeek V4芯模协同背后,国产算力生态开始飞轮加速

量子位
量子位 · 2026-05-28T13:32:39Z

雷蛇新一代毒蝰V4 Pro在外观上变化不大,但内在升级显著。新款采用第三代Focus Pro 50K光学传感器,提供更高精度和稳定性,续航表现优秀。鼠标重量减轻,涂层更细腻,握持舒适。整体性能提升,适合高强度竞技需求。

吓哭了!六冠王的认可,聊聊当代“鼠王”雷蛇毒蝰V4 Pro

熊猫不是猫QAQ
熊猫不是猫QAQ · 2026-05-28T10:11:38Z
雷鸟双品齐发:GT 系列、V4 同台亮相,次世代 AI 眼镜雷鸟 iO 提前预告

雷鸟于5月27日发布了GT系列专业影视级AR眼镜和新一代AI拍摄眼镜V4。GT系列售价1899元起,提供影院级观影体验;V4售价2199元起,具备超长续航和多项新技术。雷鸟致力于提升智能眼镜的用户体验,推动其融入日常生活。

雷鸟双品齐发:GT 系列、V4 同台亮相,次世代 AI 眼镜雷鸟 iO 提前预告

量子位
量子位 · 2026-05-27T11:55:55Z

DeepSeek-V4通过创新技术实现高性价比,采用MoE模型分离总参数与每token成本,结合混合注意力CSA和HCA降低计算需求,引入mHC和Muon优化训练稳定性,利用磁盘缓存减少重复计算成本,最终实现1M上下文的高效推理。

【大模型基础设施工程·特别篇】27:DeepSeek-V4 的极致性价比从哪来

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-05-27T00:00:00Z
DeepSeek V4还能更省!新工具缓存命中率高达99.82%,2折稳定到手

Reasonix是为DeepSeek设计的终端编程工具,旨在降低长会话的成本。通过优化缓存机制,Reasonix将账单从61美元降至12美元,缓存命中率达到99.82%。其工作流程通过固定上下文和追加新消息提高效率,用户可轻松安装使用。尽管有人质疑其必要性,但大家对省钱的方案表示欢迎。

DeepSeek V4还能更省!新工具缓存命中率高达99.82%,2折稳定到手

量子位
量子位 · 2026-05-25T04:40:14Z
DeepSeek V4价格打骨折,宁王京东网易抢着入场,梁文锋:目标是AGI

DeepSeek宣布V4-Pro API永久降价,并正在进行700亿元融资,估值达450亿美元。宁德时代计划投资DeepSeek,以扩展其在数据中心的布局。梁文锋表示将优先推进人工智能研究,并承诺坚持开源路线。融资细节尚未确定,京东和网易也在洽谈参与。

DeepSeek V4价格打骨折,宁王京东网易抢着入场,梁文锋:目标是AGI

量子位
量子位 · 2026-05-23T09:46:37Z

深度求索宣布将DeepSeek V4 Pro模型价格永久降至原价的1/4,百万输入命中缓存仅需0.025元,未命中缓存3元,百万输出6元。此举旨在提升开发者的使用体验。模型支持1M长度和384K输出,企业可申请更高并发限制。

深度求索宣布将DeepSeek V4 Pro永久降价到原价的1/4 也就是优惠价变正价

蓝点网
蓝点网 · 2026-05-23T03:38:02Z
Redis之父antirez发布DeepSeek V4 Flash专用推理引擎,128GB MacBook本地跑284B参数大模型

意大利程序员Salvatore Sanfilippo(antirez)发布了新开源项目ds4.c,专为DeepSeek V4 Flash设计的推理引擎。该项目利用Metal GPU,支持高达100万Token的上下文窗口,推理速度极快,适合长文档处理。ds4.c提供CLI和服务器模式,支持本地HTTP服务和磁盘KV缓存,提升了Agent客户端的使用体验。

Redis之父antirez发布DeepSeek V4 Flash专用推理引擎,128GB MacBook本地跑284B参数大模型

dotNET跨平台
dotNET跨平台 · 2026-05-10T00:01:48Z
Redis之父下场,给DeepSeek V4单独造了一台推理引擎

DeepSeek V4发布后,开发者antirez推出了专属推理引擎ds4.c,旨在提升Mac上的运行效率。该引擎使用C和Metal编写,专注于本地推理,支持高效的量化和KV缓存。测试表明,ds4.c在高端Mac上表现优异,生成速度快。antirez希望通过此项目推动本地推理的发展,并强调AI辅助开发的重要性。

Redis之父下场,给DeepSeek V4单独造了一台推理引擎

量子位
量子位 · 2026-05-08T08:20:40Z
DeepClaude省下17倍成本:把Claude Code脑子换成DeepSeek V4 Pro,

DeepClaude项目通过将Claude Code的推理引擎替换为DeepSeek V4 Pro,将成本降低至原来的17分之一。该方案适合编写代码的任务,但不支持多模态输入和并行工具调用。整体上,DeepSeek在日常开发中表现良好,适合预算有限的独立开发者和小团队。

DeepClaude省下17倍成本:把Claude Code脑子换成DeepSeek V4 Pro,

极道
极道 · 2026-05-04T02:44:00Z
DeepSeek-V4——迈向百万token上下文:保留V3的MoE和多token预测机制,提出混合注意力机制(CSA/HCA)、流形约束超连接mHC(替代残差)、Muon优化器(取代AdamW)

DeepSeek-V4系列模型推出了1.6T和284B参数的两个版本,采用混合注意力架构和流形约束超连接,提升了长上下文处理效率。通过Muon优化器和多项基础设施优化,模型在训练和推理阶段展现出更高的稳定性和效率。预训练后,DeepSeek-V4在多个基准测试中超越前代,设立了新的性能标准。

DeepSeek-V4——迈向百万token上下文:保留V3的MoE和多token预测机制,提出混合注意力机制(CSA/HCA)、流形约束超连接mHC(替代残差)、Muon优化器(取代AdamW)

结构之法 算法之道
结构之法 算法之道 · 2026-05-03T15:54:48Z
DeepSeek V4最大的遗憾

Engram是DeepSeek与北大联合开源的知识查找模块,旨在提升大模型的记忆与效率。尽管在DeepSeekV4中未出现,Engram的理念和应用仍在发展。研究表明,Engram通过优化Transformer结构,提升了模型的推理能力和知识检索效率,显示出在内存管理和视觉任务中的潜力。

DeepSeek V4最大的遗憾

量子位
量子位 · 2026-05-03T03:43:37Z
DeepSeek V4 发布没炸场,却靠降价掀起革命?

DeepSeek V4 发布后,通过降价策略打破了高 Token 价格和订阅套餐的束缚,用户可按需付费,吸引了更多低频用户,改变了市场格局。

DeepSeek V4 发布没炸场,却靠降价掀起革命?

硕鼠的博客站
硕鼠的博客站 · 2026-05-01T01:01:54Z
Zed AI 白嫖免费模型,搭配 DeepSeek v4,玩转 Agent 编程技巧 - 曦远Code

Zed 编辑器功能灵活,支持多种 AI 模型,用户可通过 ACP 协议配置 agent。虽然 AI 功能有限,但适合日常开发和文档生成,提供免费模型使用,配置简单。文档结构清晰,但插件生态不足,影响用户体验。

Zed AI 白嫖免费模型,搭配 DeepSeek v4,玩转 Agent 编程技巧 - 曦远Code

程序设计实验室
程序设计实验室 · 2026-04-29T09:40:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码