行业资讯

千问连夜开源Qwen3.8-Flash-Next,性能更强且更便宜

2026-08-28
2704次

昨夜,阿里千问团队发布了基于下一代Qwen4架构的先导预览多模态MoE模型Qwen3.8-Flash-Next并开源。该模型主干参数约125B,外加51B的N-gram嵌入,单token激活参数约6B,原生支持262,144 token上下文,借助YaRN可扩展至100万token。与上一代Qwen3.7-Plus相比,新模型在训练与推理成本上大幅下降,训练开销约为此前的1/9,同时在编程与办公等任务上表现更优,在千问团队公布的多项基准测试中,大部分成绩超过了DeepSeek-V4-Flash正式版。

在定价方面,Qwen3.8-Flash将通过千问AI平台对外提供API服务,平台上以qwen3.8-flash名义接入,支持行业标准协议,兼容OpenAI的Chat Completions与Responses API,以及Anthropic接口,并能与Claude Code、Codex等工具配合使用。平台报价为每百万Tokens输入1元、输出3元,较DeepSeek-V4-Flash空闲时段的输入与输出价格均低约33.33%。千问表示,此次提前公开结构改动,旨在在完整Qwen4家族发布前让社区检验新设计。模型权重已同步发布到主流模型平台,默认启用百万上下文并集成官方工具。

与此同时,智谱AI也开放了GLM-5系列首款原生多模态模型GLM-5.3-Flash(320B-A18B),即此前网络热传的“Ox-Alpha”模型。该模型总参数约320B,在智谱自研评测中编程能力接近Claude Opus 4.8,但定价大幅下调:常规价约为GLM-5.3的1/10,限时折扣期更低至1/20,约为Opus 4.8价格的1/40。 龙8头号玩家

在架构方面,Qwen3.8-Flash-Next在Attention、Residual、Embedding与Optimization四个维度进行了系统性优化,既提升能力又优化计算效率、模型容量与训练稳定性。千问公布的基准显示,该模型在智能体、多模态、编程和通用能力等大多数测试中,超过了Qwen3.8-27B、Qwen3.7-Plus、DeepSeek‑V4‑Flash‑0731与Claude‑Opus‑4.6(Max),位列榜首。

更具体的表现包括:纯文本任务中在10项测试中夺魁;编程能力在智能体编程DeepSWE1.1与SWE‑bench Pro多语言软件工程测试中领先,仅在仓库级代码生成(Repo‑level)测试中略逊于DeepSeek;智能体能力在长周期办公、专业工作场景与前沿智能体任务的加权得分及真实工具调用测试中名列前茅,但在前沿智能体任务的一次性完全通关率上落后于DeepSeek‑V4‑Flash;通用能力方面,指令遵循、科学推理与竞赛代码等项位居第一,仅在多学科综合推理上稍弱于Claude‑Opus‑4.6;多模态能力在所列13项任务中全面领先。多模态智能体测试则侧重模型识别截图、操作手机与电脑、复现应用与网页开发等实际操作能力,新模型在这些场景也展现出较强的理解与执行能力。

本文网址: long8cn.com/detail/303492.html

销售热线

营销一部(传统产品):王部长 15371160678
营销二部(光伏焊带):曹部长 13921871003

电子邮箱

suffocating@126.com

公司地址

清镇市今洒楼29号

 Copyright © 头号玩家-(龙8)唯一官方网站 2024 版权所有 All rights reserved 头号玩家-(龙8)唯一官方网站