阿里巴巴刚刚免费提供了其最佳人工智能模型,几乎匹敌Claude和ChatGPT。

CN
Decrypt
关注
1小时前

阿里巴巴在周一发布了Qwen3.8-Max,称其为迄今为止最强大的模型。参数将在下周登陆Hugging Face和ModelScope——这是该公司首次以Max规模赠送模型。


规格非常庞大:总共有2.4万亿个参数,其中有950亿个在任何时候处于开启状态。参数是模型能够处理的拨号数量。





这对于效率至关重要,因为这意味着它运行时不需要消耗过多的资源。可以把它想象成一个巨大的图书馆,每个问题只会点亮相关书架。拥有足够优质硬件的小型企业和实验室,现在能够运行最先进的模型,而不需要花费与大型数据中心相同的费用。


阿里巴巴的发布帖子跳过了通常的基准测试叙述,而是强调了耐用性。该模型独立花费16天构建了一个编码工具——265次提交,127个拉取请求,151个问题,没有人接触键盘。它花了五天时间重现一篇从未见过代码的研究论文,然后以2.7分的优势超越了该论文的结果。在一场24小时的机器学习竞赛中,它超越了526个团队中的458个。


旨在与竞争对手的工具兼容运行


Qwen3.8-Max随附有Claude Code和Codex的使用说明,这些都是由Anthropic和OpenAI制作的编码工具。阿里巴巴的API支持这两家公司协议。它的大部分编码基准测试是在Claude Code内运行的。


而这些基准测试并没有使它感到自豪。在31个文本测试中,Anthropic的Fable 5获得了15个第一名,OpenAI的GPT-5.6 Sol获得9个,Qwen获得7个。在12个编码测试中,Qwen仅赢得一项。然而,在智能成本方面,该模型极其便宜和高效,这意味着即使它需要更多的迭代或推理,完成工作的成本也将低得多,几乎是Claude Fable 5费用的30%。




也就是说,转向多模态工作——文档、视频、空间推理——排名会反转。Qwen在大多数表格中处于领先地位。


在商业战略方面也有反转。今年四月,阿里巴巴取消了Qwen Code的免费版,团队在领导层变动后漂向封闭的付费模式。我们的Qwen 3.7 Max的评测提到Plus版本将会开放,而Max依然被锁在API后。


这扇门现在已经打开,而且这个时机并非偶然。到2026年中期,中国开放权重模型在OpenRouter上的代币份额从2024年底的不到2%上升到大约61%。Qwen超越了Meta的Llama,成为全球最多自托管的模型。


与此同时,华盛顿在六月份对Fable 5和Mythos 5实施了出口管制,而北京据报道也在考虑对中国模型出口的限制。


因此,阿里巴巴在数据上处于劣势,但在分发上获胜。如果你可以免费下载接近的东西,第二名就成为一个不错的位置。


免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下载

X

Telegram

Facebook

Reddit

复制链接