内容提要
阿里巴巴发布新一代基座大模型Qwen3.8,总参数2.4万亿,编程和办公能力大幅提升,在权威榜单中位列全球第一梯队。API已上线,国内价格优惠,国际价格低于竞品。模型支持视觉理解,上下文1M Tokens,在多项评测中创佳绩,能自主完成编程项目和专业任务,展现系统级规划与自适应学习能力。
延伸解读
价格策略与市场定位
Qwen3.8的API定价显示其市场策略:国内输入每百万Tokens 12元、输出36元,隐式缓存命中仅1.5元;国际价格仅为Opus5的40%和24%。这表明阿里试图以高性价比吸引开发者,同时通过缓存优惠降低高频调用成本。对于企业用户,需根据实际调用量评估成本效益,但文章未提供与其他模型的直接对比数据。
编程能力的实际应用场景
文章强调Qwen3.8能自主完成真实项目,如从空文件夹构建自进化智能体框架,运行16天后交付开源项目。这暗示模型在长周期、多步骤任务中具备自主规划能力,但实际效果可能依赖任务复杂度和环境支持。开发者可关注其开源版本(下周发布)以测试在自身项目中的表现,但需注意文章未提及失败案例或局限性。
专业办公任务的效率提升
Qwen3.8在专业办公场景中展示出显著效率提升,如法务标注、篮球数据分析、金融策略研究等,将数天或数周的工作缩短至数小时。这提示企业可探索将重复性、规则明确的任务交给模型处理,但需注意文章未说明模型输出的准确率或人工审核需求,实际部署时仍需验证质量。
视觉理解与长上下文能力
模型支持1M Tokens上下文和视觉理解,能处理200页PDF或100小时视频,并在无源码情况下复刻应用。这扩展了多模态应用场景,但长上下文可能带来推理成本增加。文章未提及具体成本或性能权衡,用户需根据实际需求评估是否启用这些功能。
Q&A
阿里最新发布的Qwen3.8模型总参数量是多少?
Qwen3.8的总参数量为2.4万亿(2.4T),激活参数为95B。
Qwen3.8在权威榜单Arena中的排名如何?
在Arena榜单中,Qwen3.8仅次于Anthropic的Claude系列,整体性能处于全球大模型第一梯队。
Qwen3.8的API价格是多少?
国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元;国际价格输入和输出分别为Opus5的40%和24%。
Qwen3.8在编程能力上有哪些突破?
Qwen3.8在CodeArena榜中位居全球第四,能自主完成真实项目交付,例如从空文件夹开始,自主搭建循环工程框架,独立运行16天后开发出可用的自进化智能体框架'oh-my-cli'。
Qwen3.8在专业办公(Cowork)方面有哪些应用案例?
Qwen3.8能在一小时内完成法务助理一周的合同标注工作,数十分钟拆解篮球比赛录像并输出战术报告,还能自主完成量化策略研究并实现盈利。
Qwen3.8的上下文长度和视觉理解能力如何?
Qwen3.8支持视觉理解,上下文长度达1M Tokens,能读懂200页的财报PDF、看懂超100小时的长视频,并在Vision Arena榜单中排名全球第二。
Qwen3.8在长周期任务中展现出哪些能力?
Qwen3.8在长周期任务中涌现出系统级自主规划与全栈闭环自适应学习能力,通过'执行-反馈-迭代'的自适应闭环,在数千轮交互中实现算法与策略的深度重构。
Qwen3.8的开源计划是什么?
Qwen3.8-Max预计下周开源,同时还将开源Qwen3.8-27B。