Qwen3.8-Max:什么都好,就是太努力了
Qwen3.8-Max是这几天最热的国产模型,2.4T参数,又一个巨无霸,但有个毛病恰好是普通人最容易踩的。
这次口碑最一致的是,它从会答题变成能接活了。
你扔给它一个项目,它会自己拆解、查证、修改,发现走错路还会回头。LMArena榜单上它排进全球前三,跟Kimi K3硬碰硬跑同一份复杂任务,分数咬得很紧。
前端视觉也强。
独立测评里,它生成的网页字体讲究、配色扎实、细节丰富,甚至主动加上你没要求的购物车、注册区。有人评它只要速度提上来,就是极强的前端模型。
还有个意外亮点,中文长文写作。
这两年各家模型都在拼命卷编程和Agent,写作反而集体倒退,写出来一股模板腔。
Qwen3.8-Max算逆行者,中文写作反而是它非编程里的强项,原因是它的中文训练数据有优势。写长文、归纳总结、论文解读都挺能打,能理解语气、节奏和留白,不像机器人的模板腔。
但它的毛病,是太努力了。
独立测评跑它,建个咖啡店网页花了30分钟,写个德州扑克程序跑了80分钟。
测评原话:这是我用过最慢的模型。慢的同时它特别彻底,会自己反复测试、主动加你没要求的功能,改得极其细致。
这就是过度思考。
你让它改一个小问题,它顺手把整个方案重做一遍。你让它做张图,它做完了还停不下来,反复改,好几分钟过去还在弄。
更烦人的是,有人让它修A,它自己默默把任务换成了更容易的B,你喊它回来,它还得再想一会儿。
Token烧得比预想快,也是这个原因。它太舍得想了。
官方都承认这事儿。Qwen的规范里专门提醒,写作类任务别让它显示推理过程,否则会打断输出节奏。
价格放国产里看一眼就清楚。按量计费,
每百万tokens,Qwen3.8-Max输入12元、输出36元;GLM-5.2是8元、28元;Kimi K3最贵,缓存未命中输入20元、缓存命中2元、输出100元。
Qwen的Plan我也是近期才发现有俩。。
百炼Coding Plan 200元一个月,能打包用GLM、Kimi、Minimax等其他厂商非近期的模型。
千问AI还有个Token Plan,个人版限时价是39/139/499元/月。
不过老金还是那句话,别指望丢一句话、几小时后回来拿成品。
用它得先讲清边界:改什么、不能动什么、做完什么样,然后随时准备喊停。偶尔写写东西、做个图、查资料,又快又省心的选择不少,不必非它不可。
国产旗舰这次真能打了,最近蹭蹭冒出来,GLM5.3在前两天在官方发布后火速被移除了,估计也就最近要上了。
他们这些国产旗舰,在老金目前看只差一件事:它得学会,在你叫停的时候,真的停下来。