17173 > 游戏资讯 > 科技新闻 > 正文

超越V4 Flash 千问Qwen3.8-Flash大模型开源:提前用上下代Qwen4架构

2026-08-26 22:00:41 神评论
17173 新闻导语

阿里千问Qwen3.8-Flash开源,提前用上Qwen4架构!125B参数MoE模型,性能超越V4 Flash,性价比极高,仅$0.16/1M输入令牌。点击了解下一代大模型技术预览。

今晚除了智谱会开源牛来大模型之外,阿里旗下的千问也发布了Qwen3.8-Flash大模型,虽然它还在用3.X版本的名字,但实际上是下一代Qwen4架构了。

千问之前就解释过,Qwen3.8-Flash是为了让开源社区提前体验Qwen4架构的新技术,是下代大模型的技术预览版。

据官方介绍,Qwen3.8-Flash是一个多模态 MoE 模型,125B 参数 + 51B N-gram 嵌入,每个令牌仅激活 6B,262K 原生上下文,可通过 YaRN 扩展至 1M。

官方表示它具有无与伦比的性价比,价格仅为$ 0.16/1M输入令牌和$0.47/1M输出令牌。

作为对比,DS V4 Flash目前的分别是0.22、0.66美元,而且高峰期还得翻倍,Qwen3.8-Flash的性价比确实很高。

技术上,Qwen3.8-Flash采用下一代架构——GDN + QSA 混合注意力、门控残差、N-gram 嵌入 & Muon 优化器,作为 Qwen4 中使用的架构的前身。

性能基准方面,Qwen3.8-Flash在 DeepSWE 1.1 上得分 58.7,在 SWE-bench Pro 上得分 62.5,在 CoWorkBench 上得分 73.9,在 AndroidWorld 上得分 84.5,在 MathVision(带 CI)上得分 95.7。

这个性能整体上是超越了V4 Flash的,而且性价比又高,实际性能如果确实如此,那大家可以换换大模型使用了。

【来源:快科技】
关于Qwen3.8-Flash,V4 Flash,Qwen4,MoE,大模型,性价比,开源,DeepSWE,SWE-bench,Muon优化器的新闻