【事件】阿里 7 月 19 日把 Qwen3.8-Max-Preview 接入 Alibaba Token Plan、Qoder 与 QoderWork,并披露总参数量为 2.4 万亿。官方把它称作当前最强 Qwen,并宣称综合能力“仅次于 Claude Fable 5”。需要严格拆开两层事实:模型和三个访问入口已经上线,2.4T 是厂商披露;但发布时没有同步完整基准表、模型卡、训练数据说明、权重下载及许可文本,因此“全球第二”不能改写成独立评测结论,也不能把 Preview 写成正式开源发布。
【背景】Qwen 此前以开放权重家族扩大开发者覆盖,Max 级模型则更多承担阿里云付费推理与 Qoder 编程入口的能力上限。7 月 16 日发布的 Kimi K3 已用 2.8T 总参数和即将开放权重吸引跨平台测试,Qwen3.8 选择先进入自有 Token 套餐和编码产品,说明竞争焦点不只是参数规模,而是模型能否迅速转化为可购买的推理额度和可持续使用的 Agent 工作流。两家都给出强势厂商评测,真正可比的数据仍要等同一任务、同一推理预算和同一工具权限下的复测。
【信号】企业不应依据“第二名”直接迁移生产负载,合理做法是先锁定五项验收:SWE-bench Verified 的可复现实验、长任务一次完成率、工具调用失败率、百万 Token 实际账单以及数据驻留条款。若正式版继续只在阿里入口提供,Qwen 的商业价值主要体现为云与 Qoder 的交叉销售;若权重、许可证和推理配方随后开放,它才会对私有部署市场形成第二层冲击。接下来应跟踪正式版日期、模型卡、权重许可、第三方编码基准和 Token Plan 的限额/价格,任何一项缺席都应下调对“性能领先”和开发者迁移速度的判断。