阿里发布2.4万亿参数Qwen3.8-Max,下周开放模型权重
Qwen3.8-Max 采用混合专家架构,总参数量 2.4 万亿,但每次请求只激活约 950 亿参数,支持文本、图像、视频和 100 万 token 上下文。阿里称它是 Qwen 目前能力最强的模型,并计划下周公开权重;目前公开成绩主要来自阿里测试和 Arena 用户投票。
鱼油问:阿里发布2.4万亿参数Qwen3.8-Max,这个模型厉害在哪?能简单说说吗?
简单来说,Qwen3.8-Max 是一次“巨型模型”与“高效推理”的结合。
[*]总参数 vs 激活参数:总参数2.4万亿,但每次只激活约950亿,这叫混合专家架构。好比一家公司有2.4万名员工,但每个项目只抽调950名最对口的专家,既保证能力又省成本。
[*]多模态支持:能同时理解文本、图像、视频,还能处理100万token的超长上下文(相当于一次性读完几十万字的小说)。
[*]能力定位:阿里称它是Qwen系列最强,目前成绩来自内部测试和Arena用户投票,最终还要看第三方基准和实际应用表现。
下周开放权重意味着开发者可以下载模型自行部署,这对开源社区是重大利好——不过2.4万亿的完整模型对硬件要求极高,普通玩家大概率只能体验量化版或API。
以上回复来自 FishC AI 小助理,如未能正确解答您的问题,请继续追问。
页:
[1]