内容提要
阿里巴巴发布新一代基座大模型Qwen3.8-Max,总参数2.4万亿,在编程、专业工作、长程任务、多模态智能体等场景表现突出,权威榜单中位列全球第一梯队。该模型价格低廉,国内每百万Tokens输入12元、输出36元,仅为Opus 5的40%和24%。实测中,它能从零开发完整项目、交叉分析复杂文档、处理长视频,能力与性价比兼备。
延伸解读
价格与性能的平衡点
文章强调Qwen3.8-Max在性能对标Claude系列的同时,价格远低于Opus 5,国内输入每百万Tokens仅12元,输出36元,隐式缓存命中仅1.5元。这种定价策略可能降低高端模型的使用门槛,尤其对频繁调用API的开发者或企业而言,成本优势明显。但需注意,价格优势是否长期持续,以及国际定价是否同样具有竞争力,文中未提供更多细节。
实测场景的参考价值
文中实测展示了模型在编程、长文档交叉分析、长视频理解等场景的表现,例如从零开发完整项目、定位论文中跨章节的图表数据、生成播客时间轴。这些案例说明模型具备较强的端到端任务执行能力,但实测结果可能受提示词质量影响,且未与其他模型进行严格对比,读者应谨慎看待其绝对能力,更多关注其在实际工作流中的适用性。
开源生态的支撑作用
文章提到阿里累计开源400多个模型,衍生模型超20万,下载量破10亿,并强调Qwen系列迭代节奏快。开源生态可能为模型提供了广泛的应用场景和反馈,加速技术迭代。但开源模型与闭源模型(如Claude)在服务稳定性、企业支持等方面存在差异,用户在选择时需权衡自身需求。
Q&A
Qwen3.8-Max的总参数量是多少?
Qwen3.8-Max的总参数量达到2.4万亿。
Qwen3.8-Max在哪些场景表现突出?
Qwen3.8-Max在编程、专业工作、长程任务、多模态智能体等场景表现突出。
Qwen3.8-Max的定价是多少?与Opus 5相比如何?
国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元;国际价格输入和输出分别为Opus 5的40%和24%。
Qwen3.8-Max在权威榜单Arena中的表现如何?
在最新放榜的权威第三方榜单Arena中,Qwen3.8-Max冲到全球大模型第一梯队,表现直逼Anthropic的Claude系列模型,在编程表现上甚至超过了Claude Opus 5和Fable 5的High版本。
Qwen3.8-Max在编程方面有什么实测表现?
实测中,Qwen3.8-Max能根据一整页产品需求从零开发一个可运行的AI资讯网页,包括需求拆解、技术选型、项目结构、功能实现,并自动进行问题解决和功能验收,全程无需人工干预。
Qwen3.8-Max在长文档交叉分析方面表现如何?
实测中,Qwen3.8-Max能对几十页的论文进行跨章节交叉分析,结合正文、表格和附录图表,准确回答关于ILSVRC和PASCAL VOC难度比较的问题,并生成有理有据的分析报告。
Qwen3.8-Max在多模态长视频分析方面有什么能力?
实测中,Qwen3.8-Max能对近70分钟的视频播客生成完整的主题时间轴,按话题观点定位原始片段,每个话题采用先总结再展开的结构,并标注时间戳,方便用户精准跳转。
Qwen3.8-Max背后的开源生态如何?
从2023年开源至今,阿里累计开源400多个模型,衍生模型超过20万个,累计下载量突破10亿次,Qwen成为全球规模最大、覆盖最全的开源大模型家族。
Qwen3.8-Max目前在哪里可以使用?
Qwen3.8的API已上线千问AI平台,并接入了阿里推出的Agent产品「千问办公」,用户可以通过这些平台使用。