K3 之后,Qwen 3.8 要来了!
昨天, 阿里官方宣布称, Qwen3.8 即将推出,并开源权重!
对于这个 2.4T 参数的大家伙,阿里称“我们相信它是当今最强大的模型之一,可与领先的前沿 AI 模型媲美,仅次于 Fable 5”。
目前, Qwen3.8-Max-Preview 已经在阿里巴巴的 Token Plan、Qoder 和 QoderWork 上亮相,社交媒体上也开始出现了首批试用者的体验反馈。
X 上流出的Qwen 3.8 基准测试结果显示,它击败了所有 Opus 模型,仅次于 Fable。
有自称前字节程序员的开发者在评测后发文称, Qwen3.8-Max-Preview 这次最亮眼的地方,不是参数有多大,而是真的能快速出活。
同一个 3D 射击游戏任务,Qwen3.8 大约 15 分钟就做出了能玩的版本。移动、难度、基本玩法都有,第一版已经能交付。
对比之下,Fable 5 花了约 50 分钟才完成。
Fable 5 的最终效果确实更精细,但 Qwen3.8 用这么短的时间做到这个完成度,“已经很能打了”。
“更关键的是,这还只是 Preview”,2.4T 参数,后面还会开放权重,所以值得期待。
另一位用户还让 Qwen3.8 做了 Minecraft 风格的体素游戏。结果同样是,界面干净、可以直接玩,第一版完成度不低。
所以“它现在给人的感觉很明确,不是慢慢憋一个看起来很强的答案,而是真的能先把东西做出来”。
这可能才是 Agent 模型最有价值的地方。
而且, Qwen3.8 不是单纯的代码模型。从现有测试反馈来看,它已经开始处理网页、视觉生成、游戏和长任务。
部分视觉对比里,它的文字处理和构图还不如 Kimi K3;网络安全任务也有过反复绕路、最后没做出来的情况。
但要知道,这还只是一款刚开放测试的 Preview,直接拿它和 Kimi K3、GPT-5.6、Fable 5 放在一起 PK,已经不差。
还有个国外开发者反馈称,他让 Qwen 3.8 和 Kimi K3 都为一个售价 10,000 美元的断头台面包切割机,生成一个登陆页面。
K3 优势明显,但 Qwen 的能力仍然令人信服。它成功创建了一个出色的断头台 3D 模型。
值得一提的是,Qwen 生成这个登陆页面的速度是 Kimi 的 3 倍。
该开发者做了三轮对比测试,大概结论都是,K3 效果更好更精细,但时间长、Token 消耗大; Qwen 3.8 完成度高,时间短、前端设计水平高。
还有开发者惊呼 Qwen 3.8 的“性价比高到离谱”,被严重低估了。
Polymarket 上的盘面显示,Qwen 的胜算定为 70%,认为“它将在7 月成为最佳中文 AI”。
值得一提的是,最近中国开源模型的集体开挂态势。
先是 GLM 5.2 逼近 Claude Opus 水平,Kimi K3 挑战 Fable 5 。
现在是Qwen 3.8 达到 2.4T 参数,自称“天下第二 ”,接下来还有 DeepSeek V4 、MiniMax M3 Pro,以及 GLM 5.5,全都瞄准了当前的封闭前沿模型。
以前国产模型经常被拿来讨论“能不能用”,现在大家讨论的是“离最强模型还差多少”,这个转变本身就有意思。
这些都不是小步的迭代,巨大的参数规模、巧妙的效率技巧,以及模型权重正以一种让封闭实验室难以持续的节奏被开源,难怪最近美国 AI 圈开始反思甚至声讨自己的 AI 监管政策和封闭的生态文化。

