就在今天,阿里巴巴正式发布了新一代大模型Qwen3.8-Max。
从参数和性能来看,在经历了漫长的大模型规模竞赛后,可以看出现在AI大模型行业越来越看重性价比与实际效率。这次阿里发布的Qwen3.8-Max总参数量达2.4万亿,单次实际激活参数量为95B。采用稀疏MoE(混合专家)架构与混合注意力机制联合优化,在保持庞大知识库的同时,大幅降低了推理成本与延迟,实现了更高的推理效率与更快的速度。
支持100万Tokens的超长上下文窗口,原生支持多模态视觉理解。在Vision Arena视觉榜单中位列全球第二,不仅能读懂200页的财报PDF、还能看懂超100小时的长视频。而在最新的LMSYS Chatbot Arena综合榜单中,Qwen3.8也仅次于Anthropic的Claude系列,稳居全球大模型第一梯队。
从大模型核心能力之一的编程能力来看,在权威CodeArena榜中,Qwen3.8位居全球第四。现在已经不仅是能补全代码,而且具有长程项目交付能力,给它一个空的文件夹,它能通过从零搭建“循环工程(Loop Engineering)”框架自主编排智能体,连续独立运行,直接为你从零搭建并交付一个完整的真实项目,全程无需人干预。
另外,Qwen3.8借助真实环境和算力的强化学习(RL)扩展,让它在长文档分析、法务合规审核、数据分析等高频场景中,完成了从提供参考建议到直接交付生产级成果的跨越。根据阿里官方数据显示:Qwen3.8在一小时内就能做完一支法务助理团队在数百份法律文档中标注千余个相关条款。一个篮球数据分析团队逐帧标注160个小时以上的比赛录像,Qwen3.8数十分钟就可精准拆解这8400多个攻防回合,并一次性输出球员战术画像和教练报告;一个金融研究团队基于数年的专业知识积累,搜集资本市场全面、实时的变动,才能依次完成的量化策略研究,Qwen3.8自主调动并行的智能体,连续工作数小时后交付完整的ETF轮动策略,并持续分析回测、动态修正、最后实现规模化盈利。
从上面来看,如果说性能是基础,那么价格与开源才是阿里真正的杀招。因为它确实把价格打下来了,国内API每百万Tokens价格为输入12元、输出36元,隐式缓存命中仅1.5元,输入和输出的国际价格仅为Opus 5的40%和24%,确实是便宜。同时阿里宣布Qwen3.8-Max预计将于下周开源,同时还将开源轻量级版本Qwen3.8-27B。
同日,阿里深度集成Qwen3.8的企业级Agent产品“千问办公”(QwenWork)也开启公测。