最近国产大模型的发布节奏简直势不可挡,每隔几天就有新模型亮相,令人振奋。这段时间,不少读者留言希望实测一下千问家族的最新力作——Qwen3.8-Max-Preview。尽管目前仍处于预览阶段,但其参数量已经飙升至2.4T,官方甚至宣称“可能除了Fable 5之外最强模型”。这一说法瞬间点燃了大家的好奇心,都想亲眼看看它的实际表现究竟如何。
今天抽空用两个任务进行了深度实测:一个检验模型干活是否扎实,另一个看它能否玩出创意。本次测试选择在Qoder CN版本上运行,打开即可直接使用模型,无需繁琐地接入Claude Code。

克隆网站
前不久,我分享过一款能克隆任意网站的Skill:ai-website-cloner-template。为了实现最佳复刻效果,它会将整个网站的所有内容完整抓取并重建。这极其考验模型的长程任务处理能力和前端编码水平,正好用来检验Qwen3.8的实力。
为测试其极限,我选择克隆一个拥有丰富动画交互、复杂页面结构以及大量图标视频资源的Bun官网。在Qoder中输入一句指令,Qwen3.8便立即调用clone-website技能,将任务拆解为6个子任务,按顺序依次执行。

Qoder内置了浏览器,技能可直接打开网站页面进行对照复刻,无需额外启动Chrome。不得不说,目前使用该工具的人还不太多,模型响应速度极快。直接来看效果对比:

原站截图(可以上下滚动)

复刻结果(可以上下滚动)
几乎是一比一完美复刻,页面上的字体、颜色、动效等细节全部还原,甚至连视频资源也一并保留。可见Qwen3.8在多模态理解、复杂任务拆解、编码开发等方面都展现出了不俗的能力。
3D 游戏生成
自从Fable 5、GPT-5.6问世后,许多网友开始用它们制作各种3D游戏场景。这次我也测试了Qwen3.8的表现,让它用Three.js构建一个“3D漂移赛车”游戏。

模型很快完成了代码编写,但实际游玩时发现,车辆行驶到某个赛道区域会出现黑屏。说实话,起初我认为让模型精准修复这个Bug难度很大,因为只能模糊描述问题。以往做项目时,遇到Bug还有错误日志输出,丢给模型处理即可;而现在只能口头描述,这对模型的排查、分析及代码修复能力提出了很高要求。
但出乎意料的是,Qwen3.8竟然主动启动浏览器,亲自“玩”了一遍游戏,发现了问题并成功修复。

这种能力在真实项目开发中极为实用,尤其是面对那些没有日志、又难以精准描述的问题时。
最后展示一下完成的游戏效果,我也亲自体验了一把,感觉相当不错。整体3D效果出色,车辆行驶设计合理:弯道减速、急弯漂移、氮气加速,甚至还加入了音效。
两个既长又复杂的任务跑下来,我顺便看了一眼消耗情况,比想象中便宜不少。而且发现Qwen3.8-Max-Preview正在推出限时折扣活动:白天常规时段(08:00到22:00)直接1折,夜间错峰时段(22:00到次日08:00)低至0.2折,相当于省下98%的积分。

写在最后
回顾这次实测,并非所有任务都由模型一次性完美完成——比如赛车游戏的第一版就存在Bug。但恰恰是这个Bug,让人看到了比“一次成型”更宝贵的东西:模型能够自己打开浏览器,验证实现效果是否出现问题,检查代码中存在的Bug。比起单纯的模型参数,这种“自我验证”的能力更贴近真实生产力。未来模型之间的差距,或许就在于谁能从头到尾把活干完,并且顺利交付。
另外,最近明显感受到国产大模型的能力越来越强,完全有实力与全球顶级模型一较高下。这次使用Qoder作为编程工具,体验确实不错——内置了终端、浏览器和编辑器,整体感受与Codex相差无几,Claude Code再也不是不可替代、独一无二的选择了。可以预见,未来还会有更多国产AI崭露头角,国内外差距将逐渐缩小乃至归零,甚至实现反超。
