小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
420 RPS卡死CPU 9%?虚拟线程固定Pinning元凶与JDK 24终极修复

420请求秒杀一切:你的Loom应用在CPU 9%时精准卡死,还敢说虚拟线程没毛病? Java 21的虚拟线程本应撑起百万并发,但一段看似无害的同步代码就能把吞吐量钉死在CPU核心数上。这场性能灾难的元凶叫Pinning,它能让你的应用在无报错、无警告、CPU空闲时彻底罢工。本文用一场420 RPS的故障现场,拆解Pinning的两大触发机制、JDK...

420 RPS卡死CPU 9%?虚拟线程固定Pinning元凶与JDK 24终极修复

极道
极道 · 2026-07-20T02:24:00Z
CPU、GPU、TPU 到底谁更“聪明”?从逻辑运算到光互连,一篇看懂 AI Infra

朋友问了两个问题:GPU 逻辑运算是不是不如 CPU?CPO 出来后光模块是不是就没未来了?两个问题都把系统问题压成了单点对决。本文从 CPU、GPU、TPU 的设计出发点讲起,经过内存墙、互连和软件栈,最后回到光模块,把这条线走完。不背产品参数,只讲“为什么这样设计”--参数每年都换,设计逻辑十年不变。

CPU、GPU、TPU 到底谁更“聪明”?从逻辑运算到光互连,一篇看懂 AI Infra

碎碎念
碎碎念 · 2026-07-19T13:00:00Z
Agent要数量也要脑子!浪潮信息一边单柜养4万Agent,一边让大模型组队答题

浪潮信息在2026开放计算大会上发布了支持384颗CPU的原生液冷整机柜,能够同时运行超过4万个智能Agent。随着AI基础设施需求的变化,CPU的重要性提升,液冷方案成为必选。新产品通过多模融合API提升Agent智能,优化算力配置,降低延迟,推动企业级AI应用的发展。

Agent要数量也要脑子!浪潮信息一边单柜养4万Agent,一边让大模型组队答题

量子位
量子位 · 2026-07-13T11:59:57Z
老黄RTX Spark真机现身Bilibili World!CPU和GPU直接焊在一起,笔记本跑120B大模型

英伟达在ComputeX发布了“超级芯片”RTX Spark,搭载Blackwell GPU和Grace CPU,专为个人智能体设计,具备1Petaflop算力和128GB统一内存,支持本地运行大模型,提升AI创作和游戏体验。同时推出DGX Spark,面向开发者,支持更大模型的训练和微调,强调安全性和隐私保护,推动个人智能体的发展。

老黄RTX Spark真机现身Bilibili World!CPU和GPU直接焊在一起,笔记本跑120B大模型

量子位
量子位 · 2026-07-12T01:37:11Z
如何调优美颜SDK以降低CPU占用?

本文讨论了降低即构 AI 美颜 SDK(ZegoEffects SDK)CPU 占用的优化方法,包括使用 Texture 路径减少 CPU 拷贝、按需加载资源和功能、根据设备等级动态降级、调整人脸检测采样策略,以及控制美颜渲染分辨率和复杂度。这些措施能显著提升性能,降低资源消耗。

如何调优美颜SDK以降低CPU占用?

实时互动网
实时互动网 · 2026-07-10T06:26:39Z

在使用curl连接持续推送数据的流服务器时,可能会出现100% CPU占用的问题。这是因为stdin未加入curl_multi_poll的pollset,导致在上传和下载之间形成忙等循环。解决方案包括不使用-T选项,或在源码中优化回调逻辑,以减少CPU负担。

[AI] curl -NT. 导致100% CPU原因

Est's Blog
Est's Blog · 2026-07-08T08:05:00Z
WebRTC SEI帧透传实现 + 高CPU负载深度优化

在WebRTC实时视频开发中,解决了帧级元数据透传和CPU性能优化问题。通过H.264标准SEI机制,实现视频帧绑定元数据,CPU占用从198.7%降至74.73%,提升了服务稳定性,解决了卡顿和延时问题。后续可通过降低分辨率和迁移至GPU等方式进一步优化。

WebRTC SEI帧透传实现 + 高CPU负载深度优化

实时互动网
实时互动网 · 2026-07-08T03:04:48Z
AI创新者采用NVIDIA Vera——为何大规模单线程CPU至关重要

NVIDIA Vera是一款高性能单线程CPU,专为代理AI时代设计,旨在提升AI工厂效率。其核心Olympus具备更高的指令执行能力和高带宽内存,确保在负载下快速完成任务。Vera在数据处理和任务执行速度上表现出色,满足未来数十亿代理的需求。

AI创新者采用NVIDIA Vera——为何大规模单线程CPU至关重要

NVIDIA Blog
NVIDIA Blog · 2026-07-07T15:00:52Z
早报|曝华为Mate90将搭载「韬定律」新麒麟芯片/英特尔上调CPU售价/企业微信发布AI录音硬件

华为Mate90系列将搭载新麒麟芯片,基于“韬定律”提升性能。苹果与博通延长合作至2031年,共同开发AI定制芯片。三星第二季度利润预计增长18倍,受AI需求推动。优必选回应仿生机器人争议,强调其产品为情感陪伴。金山办公表示WPS基础功能将继续免费。宇树科技科创板IPO注册生效,预计成为A股人形机器人第一股。

早报|曝华为Mate90将搭载「韬定律」新麒麟芯片/英特尔上调CPU售价/企业微信发布AI录音硬件

爱范儿
爱范儿 · 2026-07-07T00:14:24Z
英特尔悄然提高Core Ultra 200S Plus系列CPU价格 发售3个月就涨价50美元

英特尔悄然提高了Core Ultra 200S Plus系列处理器的建议零售价,最高涨幅达50美元。例如,270K Plus的发售价从299美元涨至349美元。尽管需求回升,涨价可能与供应链成本和市场策略有关,实际购买价格可能更高,增加了消费者的成本。

英特尔悄然提高Core Ultra 200S Plus系列CPU价格 发售3个月就涨价50美元

蓝点网
蓝点网 · 2026-07-06T01:00:46Z
LakeNetworks意大利VPS年付特价:€13.5/年起,1Gbps不限流量+金牌CPU,米兰机房解锁本地业务

LakeNetworks推出特价意大利VPS年付套餐,最低仅需13.5欧元,配置金牌CPU和SSD硬盘,支持1Gbps不限流量,适合高性价比用户。

LakeNetworks意大利VPS年付特价:€13.5/年起,1Gbps不限流量+金牌CPU,米兰机房解锁本地业务

老董日志
老董日志 · 2026-07-05T23:23:05Z
Kubernetes团队信任自动化交付代码,但不信任其调整CPU,而人工智能正在提高风险

Kubernetes团队在自动化资源优化中面临信任问题。尽管82%的从业者信任自动化交付控制,但71%仍需人工审核资源调整。AI推理工作负载增加了成本和复杂性,团队需逐步建立对自动化的信任,采用适应性自主设计以降低风险并提高效率。

Kubernetes团队信任自动化交付代码,但不信任其调整CPU,而人工智能正在提高风险

The New Stack
The New Stack · 2026-06-23T20:56:47Z

Zombie memory cgroups 是 Linux 内核中的一种机制,导致 CPU 资源浪费。进程退出后,未回收的 cgroup 统计结构会使内核反复执行无用操作。Pinterest 的研究表明,过多的 zombie 会显著降低系统性能。建议通过重启服务或机器,及时处理频繁重启的容器,以避免资源浪费。

TIL:zombie memory cgroups 让 CPU 做无用功

暗无天日
暗无天日 · 2026-06-23T00:00:00Z
NVIDIA Vera CPU为洛斯阿拉莫斯国家实验室的智能科学AI铺平道路

洛斯阿拉莫斯国家实验室将建设三台新超级计算机,采用NVIDIA Vera CPU,旨在加速科学发现和材料模拟。这些计算机将支持智能AI代理,帮助科学家进行假设、实验规划和结果分析。Vera CPU性能显著优于现有系统,预计于2027年投入使用。

NVIDIA Vera CPU为洛斯阿拉莫斯国家实验室的智能科学AI铺平道路

NVIDIA Blog
NVIDIA Blog · 2026-06-22T13:00:20Z
两万美元一颗CPU:英伟达Vera八月来华,中国客户先测三百台

英伟达推出新型Vera中央处理器,预计八月到货,旨在应对美国出口限制导致的高端AI芯片出货停滞。Vera专为代理型AI设计,性能比竞品快1.8倍,单颗售价超两万美元。中国云公司计划订购三百台进行测试,但软件兼容性和迁移成本仍是挑战。全球CPU缺货为英伟达提供机会,但需面对英特尔和AMD的竞争。

两万美元一颗CPU:英伟达Vera八月来华,中国客户先测三百台

极道
极道 · 2026-06-13T22:39:00Z

Wasmer 将七年历史的 Django 后端重写为 Rust,显著提升性能,CPU 降低89%,内存减少92%。此迁移解决了 Django 的异步 ORM 支持不足和启动慢等问题。同时,Chipmunk 4.0 完成了从 Electron 到 egui 的重写,内存占用减少80%,体积缩小90%。此外,cheadergen 发布,支持多 crate 的 C 头文件生成,提升了宏支持和类型分析。

【Rust日报】2026-06-12 Wasmer 将 Django 后端迁移到 Rust:CPU 降 89%,内存减 92%

Rust.cc
Rust.cc · 2026-06-12T01:06:01Z

BPF程序在内核中执行时无法访问全局变量和调用内核函数,唯一的持久化机制是BPF map。本文分析了BPF map的内核实现,包括hash表和数组的结构、并发模型及适用场景。hash map使用分桶链表和预分配策略,而array map则采用连续内存布局,支持零拷贝。per-CPU变体允许每个CPU独立操作,避免缓存行竞争。理解这些并发模型对优化BPF程序性能至关重要。

【eBPF 内核实现深度拆解】Map 内核实现(上):hash / array / per-CPU 的数据结构与并发模型

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-06-12T00:00:00Z
Windows 11低延迟配置文件推送到正式版(CPU加速) 点击菜单时反应更快

Windows 11 推出了低延迟配置文件,通过更新 KB5094126 提升用户在点击开始菜单、搜索框和通知中心时的响应速度。该功能瞬时提高 CPU 频率,缩短菜单反应时间。用户可通过 ViveTool 手动启用此功能,若未自动启用。测试显示,点击菜单时 CPU 倍频迅速增加,随后恢复正常,确保不会长时间占用 CPU 资源。

Windows 11低延迟配置文件推送到正式版(CPU加速) 点击菜单时反应更快

蓝点网
蓝点网 · 2026-06-10T05:00:47Z
Supermicro推出一系列搭载Arm AGI CPU的AI解决方案

Supermicro推出搭载Arm AGI CPU的AI解决方案,旨在支持代理式AI的快速扩展。新平台包括风冷和液冷服务器,优化计算性能与能效,降低能源需求,提升AI在数据中心的应用。Arm AGI CPU具备高密度136核心微架构,提供高内存带宽和优化的内存访问,支持可扩展的基础设施。

Supermicro推出一系列搭载Arm AGI CPU的AI解决方案

全球TMT-美通国际
全球TMT-美通国际 · 2026-06-08T10:05:05Z

Trifecta Tech Foundation 发布了 libzstd-rs-sys,这是一个纯 Rust 实现的 Zstandard 压缩库,旨在提高可移植性和生态独立性。该库支持与 C 参考实现兼容的静态库,已完成解压缩和字典构建器的清理工作。虽然默认性能稍逊于 C 实现,但可通过特性提升性能。

【Rust日报】2026-06-08 宣布 Rust 实现的 Zstandard:面向现代 CPU 的纯 Rust 压缩库

Rust.cc
Rust.cc · 2026-06-08T01:06:48Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码