來源:量子位查看原文 ↗
原文著作權歸來源方所有,本站僅作收錄、翻譯或格式整理。
事實脈絡
编程、专业工作、长程任务、多模态分析统统梭哈
解讀與影響
导读摘要
阿里巴巴发布总参数量达2.4万亿的Qwen3.8-Max模型,在权威评测中冲入全球第一梯队,编程能力超越Claude Opus 5,且以极低的价格策略震动市场。
正文
在能力表现上,Qwen3.8-Max在编程和长程任务方面展现出显著提升。根据Arena最新榜单,其整体性能紧随Anthropic的Claude系列,位居全球第二,而在前端编程能力评测中,甚至超越了Claude Opus 5和Fable 5的High版本[来源:智源社区]。官方披露的一个内部案例显示,该模型曾自主花费16天时间,独立开发并优化了一套命令行工具,体现了其在无需人工干预下完成长周期、多步骤复杂任务的能力[来源:鞭牛士]。
与性能同样引人注目的是其激进的定价策略。Qwen3.8-Max国内每百万Tokens输入价格仅为12元,输出36元,而隐式缓存命中更是低至1.5元。其输入与输出价格分别仅为Claude Opus 5的40%和24%[来源:智源社区]。这种“便宜大碗”的定位,叠加模型在编程、专业工作等场景的实测表现,使得该模型在海外开发者社区迅速引发热议,并直接推动了阿里股价上涨[来源:Yellow.com]。
值得注意的是,阿里此次还宣布将首次开源Max级模型权重,预计下周发布[来源:Yellow.com]。这一举措与此前DeepSeek等模型的开源策略形成呼应,可能进一步加剧AI大模型领域的竞争,尤其是在追求高性价比的企业级应用和开发者生态中。