实测千问 Qwen3.8 预览版,国产模型开始围攻 Fable 5

实测千问 Qwen3.8 预览版,国产模型开始围攻 Fable 5

💡 原文中文,约3700字,阅读约需9分钟。
📝

内容提要

国产大模型密集发布,Kimi K3与Qwen3.8-Max预览版相继亮相。实测Qwen3.8-Max在网页生成和3D游戏开发上速度飞快,但效果不稳定,复杂任务表现粗糙。国产开源模型数量已超美国,性能逼近闭源模型,差距缩小,未来竞争焦点或转向价格。

🔎

延伸解读

预览版与正式版差距需警惕

文章实测Qwen3.8-Max预览版,虽然生成速度快,但复杂任务效果粗糙,如3D游戏和艺术世界生成均不理想。作者提醒,预览版能力可能无法代表正式版,此前Hy3的预览版与正式版差距巨大,几乎像两个模型。因此,用户不应过早依赖预览版,应等待正式版发布后再评估其真实性能。

国产开源模型数量领先,性能逼近闭源

文章指出,今年以来国产模型发布数量已超过美国,且开源模型占多数。国产开源模型如GLM-5.2、Kimi K3等性能接近甚至超越部分闭源模型,与Fable 5的差距缩小。这标志着开源与闭源、国产与海外模型的竞争格局正在变化,用户将有更多选择,不再局限于少数海外闭源模型。

模型能力接近,价格或成竞争焦点

随着国产模型性能提升,模型之间的差距逐渐缩短。文章预测,未来竞争焦点可能转向价格。当能力相近时,用户更倾向于选择性价比高的模型。因此,谁能率先降低价格,谁就可能赢得更多用户。这也意味着AI服务的普及化,用户有望以更低成本获得强大AI能力。

Q&A

Qwen3.8-Max-Preview 相比上一代 Qwen3.7-Max 在参数量上有何变化?

Qwen3.8-Max-Preview 的参数量为 2.4T,而 Qwen3.7-Max 是超万亿参数模型。

Qwen3.8-Max-Preview 在哪些场景下表现较好?

在 Qoder 应用中,它生成网页和 3D 游戏的速度很快,且能提供多种风格参考,并支持直接编辑网页元素。

Qwen3.8-Max-Preview 在复杂任务上表现如何?

在复杂任务上表现不稳定,例如生成莫奈睡莲世界时结果抽象,复刻 Flighty 应用时功能简陋,且不同平台(如 Qoder Work 和网页版)效果差异大。

国产开源模型在数量上与美国相比如何?

今年以来累计 39 次模型发布,其中国产 21 个,美国 18 个;开源模型中 13 个来自中国,4 个来自美国。

国产开源模型与闭源模型的差距如何?

差距正在缩小,国产开源模型性能逼近闭源模型,例如 Kimi K3 在某些测试中击败国外闭源模型,GLM-5.2 接近 Opus 水平。

未来模型竞争的焦点可能转向什么?

随着模型能力接近,竞争焦点可能转向价格,谁先把价格打下来,谁就能让用户用上更强的 AI。

🏷️

标签

➡️

继续阅读