铭鸿体育资讯网

阿里Qwen3.8-Max在编程榜超越Claude Opus 5

阿里 Qwen3.8-Max 在编程排行榜超越 Claude Opus 5

阿里Qwen3.8-Max-0902一度在Code Arena的WebDev排行榜上超越了Claude Opus 5,但实时排名已经发生变化。真正重要的是:阿里在不提高模型价格情况下,究竟提升了多少编码性能。
阿里巴巴的 Qwen3.8-Max-0902 在 2026 年 9 月 2 日迎来了它的高光时刻。Arena.ai 在 X 上表示,该模型在 Code Arena 的 WebDev 排行榜上首次亮相便获得了 1,691 分,比 Claude Opus 5 Max 高出 3 分,比 Kimi K3 Max 高出 17 分,比之前的 Qwen3.8-Max 快照版高出 22 分。
这足以颠覆人们习以为常的秩序。但这并没有持续多久。
截至9月7日,Arena.ai的WebDev实时排行榜再次发生变化,Claude Fable 5.1 Max位列1896分,GPT-6 Astra Max位列
1860分,Claude Opus 5 Max位列1766分,Qwen3.8-Max-0902以1754分暂列第四。这并非阿里巴巴的失败,而是一个警示:切勿将任何实时AI排行榜视为奖杯陈列柜。排行榜瞬息万变,榜首位置并非永久拥有,而是暂时的。
9 月 2 日的结果仍然意义重大,因为它与价格有关。Qwen3.8-Max-0902 的定价为每百万个输入Token 2 美元,每百万个输出Token 6 美元,与之前 Qwen3.8-Max 系列的公开价格相同。Arena.ai 当天还称该模型是其帕累托前沿上得分最高的模型,综合价格为每百万个Token 5 美元。这价格相当低廉。对于一位每天都要支付编码Agent费用的创始人来说,这个数字比吹嘘的资本更有价值。
Qwen团队发布了Qwen-Image-VAE-2.0,这是一款高压缩率的VAE套件,旨在提升图像重建、文本保真度和扩散训练效率。此次发布意义重大,因为更高效的压缩技术能够使图像生成工具在文档处理、设计工作流程和实际商业应用中更加可靠。 #商业 #科技 #人工智能 #编程 #大模型