阿里巴巴发布最大模型通义千问3.8-Max

iEXExchanger
阿里巴巴发布最大模型通义千问3.8-Max

阿里巴巴发布参数达2.4万亿的通义千问3.8-Max模型,支持百万级token上下文,官方称仅次于Claude Fable 5,消息公布后港股上涨7%。

阿里巴巴发布了通义千问3.8-Max,这是公司迄今为止规模最大的模型:总参数达2.4万亿,但每次请求只激活950亿参数。这种"混合专家"架构不需要让全部参数同时运转,只唤醒真正需要的模块,规模扩大的同时反而控制了算力开销。

新模型能处理文本、图片和视频,单次上下文最多支持100万个token,相当于75万字左右——足够塞进一整本书再让它去查某一段。阿里巴巴把它定位为自主编程和长周期研究任务的工具,让模型可以连续几十步自己完成任务,不需要人不断插手。

在Arena.AI榜单上,通义千问3.8-Max一上线就成为文本类中国模型第一,视觉类全球排名第二,仅次于Anthropic旗下Claude Fable 5的一个版本。阿里巴巴自己的说法很直接:"仅次于Fable 5"。不过这是公司自己的评价,并非第三方验证,在其他基准测试里,通义千问3.8-Max更像是与月之暗面(Moonshot AI)的Kimi K3势均力敌,而非明显领先。

阿里巴巴表示开源版本将于下周发布,这标志着公司在连续几代旗舰模型闭源之后,重新回归开源路线。目前该模型已经通过Model Studio的API和同日开放公测的QwenWork平台上线。消息公布后,阿里巴巴港股上涨7%,收于125.20港元。

这背后是中国AI实验室追赶美国头部厂商的普遍策略:趁Anthropic、OpenAI和谷歌仍把最强模型锁在闭源里,先用免费开源权重抢开发者。

问答

本文相关常见问题

什么是通义千问3.8-Max?

这是阿里巴巴最新的旗舰模型,总参数2.4万亿,但每次请求只激活950亿。它能处理文本、图片和视频,上下文最多支持100万个token。

什么是“混合专家”架构?

这是一种模型设计方式,每次请求只唤醒真正需要的专业模块,而不是整套网络都运转。这样可以扩大模型规模,又不会让算力成本成比例暴涨。

通义千问3.8-Max真的超过Claude了吗?

阿里巴巴称自己仅次于Anthropic的Claude Fable 5,但这是公司自己的评价,不是第三方验证。在其他基准测试中,通义千问3.8-Max更像是与中国对手Kimi K3势均力敌。

开源权重什么时候发布?

阿里巴巴表示发布公告一周后就会推出开源版本。目前该模型只能通过Model Studio的API和同日开放公测的QwenWork平台使用。