小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Qwen3.8: 从 0 到 1 用 Rust 重写 Mooncake: Suncake

本文介绍作者用Rust重写Mooncake存储模块为Suncake项目,通过Qoder和Qwen3.8从零开发,仅用37个提交完成。相比C++版,性能提升显著:墙钟时间约为C++的52%,get尾部延迟改善数百倍,线程数从266降至21。作者认为Rust的async/await更适合IO密集型应用,并指出项目零单测等弱点。

Qwen3.8: 从 0 到 1 用 Rust 重写 Mooncake: Suncake

学习让我快乐 学习让我快乐 · 2026-09-04T16:00:00Z
Legora利用GPT-6 Astra在几分钟内审阅了41份文件

Legora利用GPT-6 Astra处理复杂金融文档,自动完成财务报表核对,在41份文件中几分钟内检查所有余额并记录结果,发现全部四个错误。相比旧模型,性能提升近40%,同时保持人类专家对最终判断的负责,扩展至审计、税务等领域。

Legora利用GPT-6 Astra在几分钟内审阅了41份文件

OpenAI OpenAI · 2026-09-03T12:00:00Z
谷歌六周内推出第三款Gemini Flash模型

谷歌发布Gemini Flash 3.8及Cyber模型,性能显著提升,尤其在编程和智能体任务上,价格优惠至2026年底。Cyber版专供网络安全防御者,通过Fairwind项目向650家伙伴开放。模型在多个基准上超越竞品,但成本较高,且仍落后于Anthropic旗舰模型。谷歌计划持续快速迭代Flash系列。

谷歌六周内推出第三款Gemini Flash模型

The New Stack The New Stack · 2026-09-02T16:56:52Z
Claude Fable 5.1和Mythos 5.1发布:性能炸裂 成本大降25%

Anthropic发布Claude Fable 5.1和Mythos 5.1,缓存读取价格降75%,典型任务成本降25%。Fable面向大众,Mythos需专家认证。科研能力得分翻倍,编程通过率提升。新增企业数据留存选项,兼顾安全与隐私。此举标志AI竞争转向性价比与信任。

Claude Fable 5.1和Mythos 5.1发布:性能炸裂 成本大降25%

极道 极道 · 2026-09-01T21:18:00Z
Python 3.15.0候选版本2发布!

Python 3.15.0候选版本2发布,包含约144项修复,是最终候选版。正式版定于2026年10月1日发布,此后无ABI变更。新特性包括显式惰性导入、frozendict和sentinel内置类型、性能提升、默认UTF-8编码等。官方鼓励第三方项目提前测试并构建兼容版本。

Python 3.15.0候选版本2发布!

Python Insider Python Insider · 2026-09-01T00:00:00Z
Parquet文件写入支持、布隆过滤器、性能提升:Hardwood 1.1.0.Beta1发布

Hardwood 1.1 Beta1发布,首次支持Parquet写入,提供RowWriter和ColumnWriter两种API,并优化查询层(Bloom过滤器、字典行组剪枝)及性能(固定长度列表快速路径等)。CLI改用Æsh框架,启动更快,新增AI代理技能和WebAssembly实验版本。此版本修复109个问题,兼容DuckDB和parquet-java,未来将完善写入功能。

Parquet文件写入支持、布隆过滤器、性能提升:Hardwood 1.1.0.Beta1发布

morling.dev -- Blog morling.dev -- Blog · 2026-08-31T19:36:00Z

Cloudflare优化DNS缓存,通过五项措施使每个条目内存占用减少56%,节省约100TB内存。这些措施包括替换数据结构、合并存储列表、省略冗余字段、使用Box减少枚举浪费及原始字节存储,从而提升性能并降低内存使用。

2026 08 29 HackerNews

介绍 on SuperTechFans 介绍 on SuperTechFans · 2026-08-28T22:31:20Z

Cloudflare通过五项优化,将1.1.1.1 DNS缓存每条目内存占用从953字节降至420字节,节省约100TB内存。优化包括用Box替代Vec、合并列表、省略重复所有者、装箱枚举及存储原始数据,同时提升插入吞吐量43%和降低查找延迟19%。

我们如何通过优化1.1.1.1的DNS缓存节省了100TB内存

The Cloudflare Blog The Cloudflare Blog · 2026-08-27T17:02:35Z
千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

千问办公首发上线Qwen3.8-Flash模型,推出标准模式,提升速度并降低Token消耗。新模型性能超越Claude Opus 4.6,经办公场景优化,单任务生成速度提升约100%,Token消耗减少75%。未来仅分标准和高级模式,95%日常任务用标准模式即可完成,打破性能、成本和速度的“不可能三角”。

千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

量子位 量子位 · 2026-08-27T01:45:08Z
推出v5 Droplets:新一代性能,按工作负载定制

DigitalOcean推出新一代v5 Droplets,基于第五代AMD EPYC处理器,性能较前代提升30%。用户可独立选择vCPU、内存和存储,按需付费,账单透明。支持共享和通用型配置,适用于AI、游戏服务器等负载。现有Droplet计划不变,v5已在多个地区上线。

推出v5 Droplets:新一代性能,按工作负载定制

The DigitalOcean Blog The DigitalOcean Blog · 2026-08-26T02:19:47Z
苹果发布新款Mac Studio,搭载号称“史上最强芯片”的M5 Ultra

苹果发布新款Mac Studio,搭载M5 Max和全新M5 Ultra芯片,后者号称“史上最强”,性能大幅提升,AI计算快4.3倍,图形快1.8倍。起售价分别为2499美元和5499美元,9月22日上市,最高配512GB内存版10月底推出,价格未定。

苹果发布新款Mac Studio,搭载号称“史上最强芯片”的M5 Ultra

The Verge The Verge · 2026-08-25T13:00:00Z
苹果新款Mac Mini搭载全新M6和M5 Pro芯片——价格也更高

苹果发布新款Mac Mini,提供M6和M5 Pro芯片版本,起售价分别为899美元和1699美元,较上代均涨100美元。设计不变,但性能提升,存储速度翻倍,配备2.5GbE网口和Wi-Fi 7。M6为2nm工艺,CPU性能提升40%;M5 Pro支持更强AI负载。预购今日开始,9月22日发货,预装macOS 27。

苹果新款Mac Mini搭载全新M6和M5 Pro芯片——价格也更高

The Verge The Verge · 2026-08-25T13:00:00Z
每瓦特性能提升高达30倍:NVIDIA Vera Rubin NVL72为AI代理树立新效率标准

NVIDIA Vera Rubin NVL72在代理式AI工作负载中,每兆瓦吞吐量比GB300 NVL72高30倍,每百万token成本低35倍。该平台通过软硬件协同设计,支持分离式服务、专家并行、KV缓存等优化,提升推理效率,适合大规模AI工厂部署。

每瓦特性能提升高达30倍:NVIDIA Vera Rubin NVL72为AI代理树立新效率标准

NVIDIA Blog NVIDIA Blog · 2026-08-24T15:00:19Z
使用Redis 8.10的HIMPORT高效批量插入哈希数据

本文介绍Redis新命令HIMPORT,用于高效批量导入哈希数据。通过HIMPORT PREPARE预定义字段集,减少重复传输字段名,节省网络带宽。支持自动准备和管道模式,实测导入速度提升11%,字段越多效果越显著,适合大规模数据导入场景。

使用Redis 8.10的HIMPORT高效批量插入哈希数据

Redis Blog Redis Blog · 2026-08-24T00:00:00Z
开源杀出重围!OpenAI 亲述:如何把Codex变成谁都能装进产品里的“智能体引擎”

OpenAI将Codex开源,核心是可复用的Agent harness(执行框架),而非仅App、CLI、IDE插件三种界面。文章提出三种集成路径:codex exec、SDK和app-server,分别适用于脚本、应用和产品级嵌入。数据显示,优化harness可大幅提升模型性能(ARC-AGI-3得分从13.3%升至38.3%)。GitHub、Cisco等已落地应用,验证了“Agent进产品”的理念。

开源杀出重围!OpenAI 亲述:如何把Codex变成谁都能装进产品里的“智能体引擎”

Tony Bai Tony Bai · 2026-08-23T23:00:00Z
用Yac给WordPress做缓存:比Memcached快19%

作者用自研PHP扩展Yac替换WordPress的Memcached对象缓存,实测吞吐提升约19%,延迟降低15%。Yac将缓存存于FPM共享内存,免去网络往返,优势恒定。文章提供安装配置方法,并指出单机场景最适合,多机集群仍需Memcached/Redis。

用Yac给WordPress做缓存:比Memcached快19%

风雪之隅 风雪之隅 · 2026-08-20T12:04:11Z
DeepSeek V4 Flash凭借一项编码技能,完成率飙升14.61%!

DeepSeek V4 Flash通过Autoprompt自动生成提示词,在Terminal-Bench 2.1测试中完成率从67.42%升至82.02%,提升14.61个百分点。Autoprompt规划、构建、测试、审查、修复提示词,减少人工翻译意图的循环,但耗时增3倍、Token翻倍。官方82.7分因框架不同不可直接比较,提升稳定性待验证。

DeepSeek V4 Flash凭借一项编码技能,完成率飙升14.61%!

极道 极道 · 2026-08-19T22:27:00Z
27B的Qwen3.8与3.6架构相同!性能怎么反超50%?

阿里巴巴发布Qwen3.8-27B,与3.6版架构相同,但性能大幅提升,编程测试领先,部分超越闭源旗舰。提升源于训练数据优化和推理深度调节,代价是token消耗和耗时增至三倍。用户需权衡智能与成本,引发对“性能提升”本质的讨论。

27B的Qwen3.8与3.6架构相同!性能怎么反超50%?

极道 极道 · 2026-08-15T06:22:00Z
GLM-5.3未改变基础模型——其编码能力提升从何而来?

Z.ai发布GLM-5.3编码与智能体模型,性能较前代提升50%,在终端基准和DeepSWE测试中大幅进步,支持百万级上下文。模型强化后训练,专注实际工作环境,但API定价未公布,旧版本调用自动重定向至新模型,影响对比测试。网络安全能力增强,但漏洞利用仍逊于竞品,权重两周后开放。

GLM-5.3未改变基础模型——其编码能力提升从何而来?

The New Stack The New Stack · 2026-08-14T15:20:24Z
刚刚在DeepSWE上拿下65%的AI模型,并非谷歌承诺的那款。

谷歌发布Gemini 3.7 Flash,专为编码代理和自动化工作流设计,性能优于3.6 Flash,代码得分提升,且不易卡住。API初始价格减半,但2027年将翻倍。支持低中高思考级别,需注意迁移调整。虽改进显著,但测试可靠性仍待验证,3.5 Pro仍未发布。

刚刚在DeepSWE上拿下65%的AI模型,并非谷歌承诺的那款。

The New Stack The New Stack · 2026-08-13T19:59:34Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码