阿里巴巴发布了通义千问3.8-Max,这是公司迄今为止规模最大的模型:总参数达2.4万亿,但每次请求只激活950亿参数。这种"混合专家"架构不需要让全部参数同时运转,只唤醒真正需要的模块,规模扩大的同时反而控制了算力开销。
新模型能处理文本、图片和视频,单次上下文最多支持100万个token,相当于75万字左右——足够塞进一整本书再让它去查某一段。阿里巴巴把它定位为自主编程和长周期研究任务的工具,让模型可以连续几十步自己完成任务,不需要人不断插手。
在Arena.AI榜单上,通义千问3.8-Max一上线就成为文本类中国模型第一,视觉类全球排名第二,仅次于Anthropic旗下Claude Fable 5的一个版本。阿里巴巴自己的说法很直接:"仅次于Fable 5"。不过这是公司自己的评价,并非第三方验证,在其他基准测试里,通义千问3.8-Max更像是与月之暗面(Moonshot AI)的Kimi K3势均力敌,而非明显领先。
阿里巴巴表示开源版本将于下周发布,这标志着公司在连续几代旗舰模型闭源之后,重新回归开源路线。目前该模型已经通过Model Studio的API和同日开放公测的QwenWork平台上线。消息公布后,阿里巴巴港股上涨7%,收于125.20港元。
这背后是中国AI实验室追赶美国头部厂商的普遍策略:趁Anthropic、OpenAI和谷歌仍把最强模型锁在闭源里,先用免费开源权重抢开发者。



