阿里巴巴正式推出千问系列迄今规模最大、能力最强的基座大模型——Qwen3.8,其中旗舰版本Qwen3.8-Max总参数量达2.4万亿(2.4T),激活参数950亿,依托稀疏MoE架构与混合注意力机制协同优化,实现推理效率、速度与稳定性的三重跃升。其上下文窗口扩展至100万Tokens,并原生支持视觉理解,在Vision Arena榜单稳居全球第二。在多项权威评测中表现卓越:PaperBench编程智能体评测斩获93.0分(较前代提升28.2分);WideSearch与Agent’s Last Exam通用智能体评测分别达81.9分与52.4分;IF Bench指令遵循、GPQA Diamond科学推理、BabyVision视觉推理及OSWorld-Verified电脑操作能力评测均位居主流模型前列。尤为突破的是自主编程能力——Qwen3.8在CodeArena全球排名第四,可从零启动真实项目交付:仅凭一句指令‘创建一个自进化的智能体Harness’,即自主构建Loop Engineering框架,调度多智能体协同执行任务,历时约16天完成开源项目‘oh-my-cli’(Hermes Agent级自进化CLI框架),全过程完整公开于GitHub。在专业办公(Cowork)场景中,Qwen3.8通过真实环境与算力联合强化学习,显著提升数百类高价值任务执行效能:法律条款标注提速超160倍;篮球赛事视频分析将8400+攻防回合拆解压缩至数十分钟;金融团队需数周完成的ETF轮动策略研究,Qwen3.8数小时内即可生成、回测、动态修正并支撑实盘盈利。其更展现出系统级长周期自主规划与全栈闭环自适应学习能力,在数字芯片设计、商业模拟博弈等复杂场景中,通过‘执行—反馈—迭代’机制完成数千轮超长程策略重构。此外,Qwen3.8在RecreationBench‘应用复刻’基准中,无源码、不联网,仅靠交互反馈即完整重建目标应用,标志着混合多模态智能体能力迈入新高度。硬件层面,已适配阿里真武M890超节点,实现Agentic推理性能最高提升1.5倍。即日起,Qwen3.8 API全面开放千问AI平台,国内定价每百万Tokens输入12元、输出36元,隐式缓存命中低至1.5元;国际价格仅为Opus5的40%(输入)与24%(输出),兼顾顶尖智能与极致性价比。Qwen3.8-Max与Qwen3.8-27B将于下周同步开源。
来源:量子位
