小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Qwen3.8: 从 0 到 1 用 Rust 重写 Mooncake: Suncake

本文介绍作者用Rust重写Mooncake存储模块为Suncake项目,通过Qoder和Qwen3.8从零开发,仅用37个提交完成。相比C++版,性能提升显著:墙钟时间约为C++的52%,get尾部延迟改善数百倍,线程数从266降至21。作者认为Rust的async/await更适合IO密集型应用,并指出项目零单测等弱点。

Qwen3.8: 从 0 到 1 用 Rust 重写 Mooncake: Suncake

学习让我快乐 学习让我快乐 · 2026-09-04T16:00:00Z
阿里更新旗舰模型Qwen3.8-Max,前端编程能力跃居全球第一

阿里发布旗舰模型Qwen3.8-Max新版本,性能显著提升,尤其在编程和办公领域。在CodeArena榜单中得分1691,居全球第一,且性价比高,每百万Tokens仅5美元。该模型参数达2.4万亿,支持100万上下文,已上线API服务。

阿里更新旗舰模型Qwen3.8-Max,前端编程能力跃居全球第一

量子位 量子位 · 2026-09-02T06:10:26Z
在线教程丨Qwen4架构抢先体验,Qwen3.8-Flash-Next开源,训练成本仅为前代1/9

阿里通义千问发布Qwen3.8-Flash-Next,作为Qwen4架构预览,采用多模态MoE设计,通过混合注意力、门控残差和N-gram嵌入提升效率,主模型125B参数,激活仅6B,训练成本降至1/9,支持262K上下文,可扩展至百万Token,并已上线HyperAI教程供一键部署体验。

在线教程丨Qwen4架构抢先体验,Qwen3.8-Flash-Next开源,训练成本仅为前代1/9

HyperAI超神经 HyperAI超神经 · 2026-09-01T09:47:22Z
阿里巴巴发布Qwen3.8-Flash:“Qwen4架构的早期预览”

阿里巴巴发布Qwen3.8-Flash,一款1250亿参数的开源多模态MoE模型,作为Qwen4的架构预览。该模型在编码和办公任务上性能优越,训练资源仅需同类模型的九分之一,成本更低。它支持26万token上下文,可扩展至百万,并已在Hugging Face和ModelScope开放。开发者反应不一,有人称赞其能在消费级硬件运行,也有人认为本地模型尚不足以替代远程服务。

阿里巴巴发布Qwen3.8-Flash:“Qwen4架构的早期预览”

The New Stack The New Stack · 2026-08-28T18:27:06Z
阿里云下调Qwen3.8-Flash调用价格 调整后比智谱GLM-5.3-Flash便宜1毛钱

阿里云下调Qwen3.8-Flash调用价格,输入降至0.8元/百万,输出降至2.7元/百万,调整后比智谱GLM-5.3-Flash原价便宜0.1元,但智谱当前限时5折,价格仍具优势。阿里云调价对标智谱原价,两周后或显优势。

阿里云下调Qwen3.8-Flash调用价格 调整后比智谱GLM-5.3-Flash便宜1毛钱

蓝点网 蓝点网 · 2026-08-27T05:28:26Z
千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

千问办公首发上线Qwen3.8-Flash模型,推出标准模式,提升速度并降低Token消耗。新模型性能超越Claude Opus 4.6,经办公场景优化,单任务生成速度提升约100%,Token消耗减少75%。未来仅分标准和高级模式,95%日常任务用标准模式即可完成,打破性能、成本和速度的“不可能三角”。

千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

量子位 量子位 · 2026-08-27T01:45:08Z
Qwen3.8-Flash-Next开源实测:1/9成本干翻自家397B旗舰!

阿里通义千问发布Qwen3.8-Flash-Next开源模型,采用MoE、GDN、QSA、Gated Residual和N-gram Embedding等创新架构,125B参数仅激活6B,成本为前代九分之一,性能超越397B旗舰。训练中发现Muon优化器下Batch Size Warmup无效,可节省18.8%算力,引发行业反思。

Qwen3.8-Flash-Next开源实测:1/9成本干翻自家397B旗舰!

极道 极道 · 2026-08-26T22:39:00Z
从代码开发到自动化执行,Muse-Glimmer-30B让本地Agent更强大;Qwen3.8-27B-FP8发布,270亿参数挑战高效推理极限

Muse-Glimmer-30B是Meta推出的300亿参数多模态智能体模型,支持本地运行,融合推理、工具调用和多模态理解,性能优异。文章还介绍了HyperAI平台更新的数据集、教程及社区内容,涵盖人物画像、车辆检测、分子处理、语音识别等AI资源。

从代码开发到自动化执行,Muse-Glimmer-30B让本地Agent更强大;Qwen3.8-27B-FP8发布,270亿参数挑战高效推理极限

HyperAI超神经 HyperAI超神经 · 2026-08-22T09:16:25Z
阿里千问Qwen3.8-27B实测碾压Opus 5!一张3090就够了

阿里开源Qwen3.8-27B模型,在编程等任务上超越Claude旗舰,仅需一张二手3090显卡即可运行。其Sharp聊天模板优化了性能,引发对云端订阅价值的质疑。但测试条件存疑,结果可能仅在特定配置下成立,开源与闭源模型竞争仍存变数。

阿里千问Qwen3.8-27B实测碾压Opus 5!一张3090就够了

极道 极道 · 2026-08-18T22:56:00Z

本文介绍如何用三条命令将Qwen3.8-27B模型配置为本地AI编程助手。首先检查硬件(建议24GB显存和32GB内存),然后安装Ollama、下载模型,最后在OpenCode中启动。测试显示模型能快速构建并测试应用,适合初学者快速体验本地AI编程,无需复杂配置。

仅需三条命令,将Qwen3.8-27B配置为本地AI编程助手

KDnuggets KDnuggets · 2026-08-18T14:00:29Z
在线教程丨Qwen3.8-27B重磅开源,推理/编程/Agent能力齐升级

Qwen3.8-27B开源模型发布,拥有270亿参数,强化推理、编程与Agent能力,在代码、多模态和智能体评测中表现优异,接近顶级闭源模型。支持图像视频理解及灵活思考控制,HyperAI已上线教程供开发者快速调用。

在线教程丨Qwen3.8-27B重磅开源,推理/编程/Agent能力齐升级

HyperAI超神经 HyperAI超神经 · 2026-08-18T09:54:13Z
两块RTX 3090跑105 tok/s!Qwen3.8-27B本地部署实测

阿里开源Qwen3.8-27B模型,270亿参数,支持262K上下文,性能接近闭源旗舰。社区实测在双RTX 3090上达105 tok/s,通过量化、MTP加速等技术实现。模型Apache 2.0协议,48小时下载86万次。但速度受场景、配置影响大,多卡未必更快,且长上下文需量化KV缓存牺牲质量。

两块RTX 3090跑105 tok/s!Qwen3.8-27B本地部署实测

极道 极道 · 2026-08-17T04:23:00Z
Mac mini本地部署Hermes+Qwen3.8:慢30倍却省爆!

本地AI代理实验:用户用799美元Mac mini M4 24GB运行Hermes Agent和Qwen3.8-27B模型,夜间花1小时42分钟生成AI新闻播报,全程本地推理、零API费用。对比RTX 5090,速度慢30倍但成本低,电费不足一美分。文章分析显性成本(硬件、电费)与隐性成本(调试时间、折旧、机会成本),并质疑模型基准真实性,探讨速度与数据主权的权衡。

Mac mini本地部署Hermes+Qwen3.8:慢30倍却省爆!

极道 极道 · 2026-08-17T00:28:00Z
Qwen3.8-27B在Mac上快3倍:mlx-dspark无损加速实测揭秘

mlx-dspack项目在Mac上通过投机解码技术,将Qwen3.8-27B模型推理速度提升至3倍,8-bit量化下性能优于4-bit。项目基于DeepSeek的DSpark和z-lab的DFlash,支持自动调参优化草稿长度。实测显示8-bit加投机解码比4-bit普通解码快39%,但加速效果受硬件、量化方式和MLX版本影响,长上下文和内存限制仍是瓶颈。

Qwen3.8-27B在Mac上快3倍:mlx-dspark无损加速实测揭秘

极道 极道 · 2026-08-15T22:53:00Z
27B的Qwen3.8与3.6架构相同!性能怎么反超50%?

阿里巴巴发布Qwen3.8-27B,与3.6版架构相同,但性能大幅提升,编程测试领先,部分超越闭源旗舰。提升源于训练数据优化和推理深度调节,代价是token消耗和耗时增至三倍。用户需权衡智能与成本,引发对“性能提升”本质的讨论。

27B的Qwen3.8与3.6架构相同!性能怎么反超50%?

极道 极道 · 2026-08-15T06:22:00Z
源神启动!一张消费级显卡跑“Opus级”Agent,Qwen3.8-27B多项榜单反超Claude

Qwen3.8-27B开源,拥有270亿参数,支持原生多模态和262K上下文,可扩展至100万Token。在SWE-bench Pro和QwenSWEBench上超越Claude Opus 4.6 Max,Agent和多模态评测表现优异。内置推理档位可调,支持关闭Thinking模式,默认开启preserve_thinking。量化后可在24GB显存显卡运行,支持Transformers、vLLM等部署。

源神启动!一张消费级显卡跑“Opus级”Agent,Qwen3.8-27B多项榜单反超Claude

量子位 量子位 · 2026-08-15T06:05:31Z
刚刚,Qwen3.8-27B 开源了!家用显卡也能跑

Qwen3.8系列模型正式开源,所有开发者、科研机构和企业可免费下载、部署及商用。其中27B参数模型支持原生多模态和262K上下文,编程和办公性能大幅提升,新增推理控制功能。模型以Apache2.0协议开放,累计开源460余个模型,全球下载超30亿次。

刚刚,Qwen3.8-27B 开源了!家用显卡也能跑

量子位 量子位 · 2026-08-14T15:41:12Z
开源Qwen3.8 2.4T发布:本地跑不动,量化救不了贫穷

通义千问发布2.4万亿参数开源模型Qwen3.8-2.4T,权重达4.9TB,普通硬件无法运行。量化压缩至FP8仍超消费级显卡极限,且无QAT优化,性能受损。开源版剥离视觉功能、缩短上下文,实为商业引流。1bit压缩虽减至397GB,但精度损失严重。模型性能跑分高但实际存疑,价格战加剧硬件负担。大模型竞赛受物理限制,普通用户难以参与。

开源Qwen3.8 2.4T发布:本地跑不动,量化救不了贫穷

极道 极道 · 2026-08-12T22:23:00Z
千问功能上新:推出思考研究、定时任务、办公助理、语音通话等多项新功能,并支持 Qwen3.8-MAX

千问推出多项新功能,包括思考研究模式以强化复杂推理和决策支持,定时任务实现周期工作自动化,办公助理可连接应用并自主完成多步骤任务,输出成品文档。同时更新语音通话和智能体广场,覆盖多领域生活服务,支持跨端协同,提升用户体验。

千问功能上新:推出思考研究、定时任务、办公助理、语音通话等多项新功能,并支持 Qwen3.8-MAX

实时互动网 实时互动网 · 2026-08-07T02:34:08Z
Artificial Analysis榜单:阿里Qwen3.8Agentic能力得分全球第一

阿里Qwen3.8-Max在Artificial Analysis智能体能力排行榜中以55.4分超越Claude Opus5和GPT5.6,位列全球第一。该能力代表AI调用工具解决复杂问题的潜力,此前冠军多由Claude、GPT垄断,中国模型最佳成绩为Kimi K3的50.1分。

Artificial Analysis榜单:阿里Qwen3.8Agentic能力得分全球第一

量子位 量子位 · 2026-08-06T07:43:56Z
  • <<
  • <
  • 1 (current)
  • 2
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码