📖 文章导读:
千问开源最新模型 Qwen3.8-Flash。总参数 125B、单 token 仅激活 6B,训练计算量为前代 1/9,却敢称“下一代 Qwen4 技术预览”。实力几何?本期实测让它与 GLM-5.3-Flash 展开正面对决,结论表明:推理能力够用但不惊艳,多模态与 Coding 才是真本事,而低到可放心高频调用的价格,是它真正搅动市场的底牌。
继 8 月初 Qwen3.8-Max 发布之后,8 月末,阿里通义实验室又开源了 Qwen3.8-Flash 。它是一款多模态 MoE 模型,总参数 125B,每个 token 实际只激活约 6B 参数,原生支持 262K 上下文,还可以扩展到 1M,可视为下一代 Qwen4 的技术预览。

1.6B 激活参数,撑起百亿级模型能力
相比过去大模型界卷参数、卷训练规模、卷旗舰模型能力的情况,怎么用更少的计算把模型能力撑起来,成为了目前的竞赛新趋势。 Qwen3.8-Flash 就是一个很典型的例子,总参数 125B,每个 token 只激活约 6B 参数,却在 Coding、Agent、专业任务和多模态场景里拿到了相当不错的成绩。与此同时,它的训练计算量相比 Qwen3.7-Plus 下降到了约 1/9,这也是这次最值得关注的地方。
2.架构全面升级,重新设计底层系统
Qwen3.8-Flash 这次将底层架构重新动了一遍,Attention 上用了 GDN + QSA,让模型处理超长上下文时可以更高效地记住和查找信息;Residual 换成 Gated Residual,把信息传递扩展成多条路径;Embedding 又加入了 51B 参数的 N-gram Embedding,相当于额外给模型配了一套巨大的局部模式记忆库。再配合 Muon Optimizer 等训练策略,这一整套改动最终指向的都是同一件事:减少不必要的计算,把算力尽量花在真正有价值的信息上。
3.真正的考题,还是实战
当然,架构再怎么升级,最后还是得落到使用体验上。尤其是 Qwen3.8-Flash 这次明显把重心放到了 Coding、Agent、办公和多模态任务上。对于这类模型来说,真正的考验在于面对一个复杂任务,它能不能自己读懂信息、调用工具、操作网页、写代码,把事情做完。

榜单排名:

目前在Artificial Analysis榜单中位列第20位,近期发布的Flash模型中,位列第三。
用户评价:

本期实测,302.AI直接拿 Qwen3.8-Flash 上手跑了一轮,从多个真实任务出发,看看这套新架构放到实际使用中能否兑现其价值。
1. 实测模型基础信息
(1)实测模型在 302.AI 的价格:
| 模型名称 | 上下文 | 302.AI内的价格 |
|---|---|---|
| qwen3.8-flash | 1000000 | 缓存写入 $0.2 / 1M tokens缓存读取 $0.016 / 1M tokens输入 $0.15 / 1M tokens输出 $0.47 / 1M tokens |
| glm-5.3-flash | 1000000 | 缓存读取 $0.015 / 1M tokens输入 $0.075 / 1M tokens输出 $0.25 / 1M tokens |
(2)测评目的:
本评测侧重模型对逻辑,数学,编程,多模态,人类直觉等问题的测试,非专业前沿领域的权威测试。旨在观察对比模型的进化趋势,提供选型参考。
(3)测评方法:
本次测评使用302.AI收录的题库进行独立测试。模型分别就逻辑与数学(共10题),人类直觉(共7题),多模态(共20题)以及编程模拟(共12题)进行案例测试,对应记分规则取最终结果,下文选取代表性案例进行展示。
题库地址:https://docs.google.com/spreadsheets/d/1sBxs60yWsxc9I5Va8Rjc1_le1Omg2hOXbwqOzpImZio/edit?gid=0#gid=0
💡记分规则:
按满分10分记分,设定对应扣分标准,最终取每轮得分的平均值。
(4)测评工具:
- 所有模型均在302.AI Stuidio客户端内使用对应模型,使用统一的提示词,取第一次生成结果
- 编程测试使用302.AI Stuidio客户端的Vibe模式:调用Claude Code沙盒
编程案例分数评级:
⭐⭐⭐⭐⭐ S 级(封神): 行业标杆,重新定义标准。
⭐⭐⭐⭐ A 级(卓越): 生产力合格,无明显短板。
⭐⭐⭐ B 级(优秀): 表现中规中矩,存在短板。
⭐⭐及以下 C级(不合格): 不可用,存在明显问题。
2. 测试结果总览
302.AI 多模态模型测评分数榜单:

3. 案例展示
案例 1:多模态逻辑推理
提示词:按照逻辑将图上四张漫画进行正确排序
正确答案:BDAC

Qwen3.8-Flash:漫画释义洞察正确。但排序错1步

GLM-5.3-Flash:逻辑解读完整,排序正确

案例 2:程序化 SVG 图形生成
提示词:绘制一幅火烈鸟在浅水中缓慢行走、啄食的动态svg图
Qwen3.8-Flash 输出效果:

GLM-5.3-Flash 输出效果:

提示词:将参考图展示的画面绘制为动态svg图
参考图 :

Qwen3.8-Flash 输出效果:

GLM-5.3-Flash 输出效果:

简评:
两组模型表现现相当,能较为精准地表达画面语义,但都在火烈鸟动态表现上明显翻车。
| 测评点 | Qwen3.8-Flash | GLM-5.3-Flash |
| 语义表达准确度 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 图形构造复杂度 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 动态实现质量 | ⭐⭐⭐ | ⭐⭐⭐ |
案例 3:Three.js 3D 微型工厂模拟
Create a polished single-page 3D animation using Three.js.
Build a miniature automated factory on a clean tabletop, with a conveyor belt, robotic arm, rotating gears, processing machine, input/output trays, and small colorful products.
The factory should run automatically in a continuous production cycle: products enter the conveyor → move to the processing machine → the robotic arm picks and places them → the machine processes them with moving mechanical parts → finished products return to the conveyor → move to the output tray.
Focus on detailed procedural 3D modeling, realistic mechanical movement, spatial relationships, and visual polish. Use beveled geometry, metallic/plastic/rubber/glass materials, soft studio lighting, shadows, and a clean light-colored background. Avoid making the scene look like simple primitive shapes.
Use only Three.js-generated geometry; no external 3D models. Add Play/Pause/Replay controls, mouse-drag camera rotation, and scroll zoom. Keep the animation smooth, responsive, and continuously looping.
Qwen3.8-Flash 输出效果:
简评:
✅ 核心优势:
- 材质与色彩体系高度风格化,使用了
clearcoat(清漆)参数,让塑料玩具和零件看起来有质感; - 生产线和动画曲线逻辑严谨,零件在传送带上模拟了移动、排队、安装等状态,产品被机械臂抓取后滑出,采用了贝塞尔曲线动画,模拟出丰富的物理状态;
- 机械臂构造完整,每一个关节都有物理联动,运动极其流畅自然。
❌ 不足之处:
- 大量的几何体、持续运行的IK求解器和粒子系统性能开销极高,低端显卡加载压力大;
GLM-5.3-Flash 输出效果:
简评:
✅ 核心优势:
- 功能架构稳健清晰,模块化封装良好,代码可读性强;
- 自实现了带惯性的轨道控制器,交互体验流畅。
❌ 不足之处:
- 视觉细节匮乏,机械臂的抓取动作缺乏IK联动,零件材质缺乏层次感,视觉实现上较为朴素;
- 动画欠缺过程感,未能较完整地表现出零件在机械内加工的过程,逻辑说服力不足。
| 测评点 | Qwen3.8-Flash | GLM-5.3-Flash |
| 视觉与交互 | ⭐⭐⭐⭐ | ⭐⭐ |
| 技术实现 | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 功能与内容完整性 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ |
案例 4:建筑草图复原
提示词:
根据参考图理解房间的空间结构,将其还原为一个可交互的Three.js 3D场景。
尽可能准确地复现图中的房间布局、建筑结构、家具位置、比例关系、材质、色彩和灯光氛围,并根据参考图合理推断不可见的空间结构。
视角支持鼠标旋转、缩放和自由查看。整体效果应尽可能还原参考图的空间感和视觉风格。
参考图:

Qwen3.8-Flash 输出效果:
简评:
✅ 核心优势:
- 极强的材质表现,通过 Canvas 程序化生成了丰富的贴图,凸显木地板、沙发、窗户等材料纹理细节,甚至墙面都是带有颗粒感的泥灰色,色板定义非常讲究(鼠尾草绿、蜜色橡木、陶土色),整个场景视觉协调度极高;
- 光影设计与明暗关系表现出色,构建了一个完整的光照生态系统(日光、灯光、地面反射光),设有日光/黄昏模式切换功能,且在地毯、沙发、落地灯下方放置半透明的阴影纹理,极大地增强了物体与地面的接触感;
- 交互体验流畅,视角预设(室内/广角/俯视)切换带有平滑动画。
❌ 不足之处:
- 空间陈列的艺术化表现,使得建模与草图中的陈设存在偏差;
- 程序化生成大量高分辨率纹理,可能导致加载卡顿。
GLM-5.3-Flash 输出效果:
简评:
✅ 核心优势:
- 使用 ES Module + importmap,符合现代前端规范,封装了
mk()通用创建函数,大幅减少重复代码; - 场景空间感更强、建模更细致,实现圆角家具,以及布料编织纹理处理,视觉效果更柔和真实;
❌ 不足之处:
- 引入了较多扩展库,增加了加载依赖;
- 落地窗外缺少天空贴图,略显空白。
| 测评点 | Qwen3.8-Flash | GLM-5.3-Flash |
| 建模质感 | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 视觉表现力 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ |
| 还原度 | ⭐⭐⭐ | ⭐⭐⭐ |
案例 5:网页复刻
仅提供公开网站网址,考察模型一次输出的还原程度
网站来源:https://fora.so/#features
Qwen3.8-Flash 输出效果:
GLM-5.3-Flash 输出效果:
简评:
显而易见,Qwen3.8-Flash 对于原网页的还原度更高,有限体现在视觉还原和交互响应上,较完整地提取了网页插图、get 到了功能框毛玻璃效果,以及每个部分的交互动态;而 GLM-5.3-Flash 最明显缺陷在于完全未做出交互还原。
| 测评点 | Qwen3.8-Flash | GLM-5.3-Flash |
| 功能完整度 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 视觉还原度 | ⭐⭐⭐ | ⭐⭐ |
| 交互与用户体验 | ⭐⭐⭐ | ⭐ |
4. Qwen3.8-Flash 模型实测结论

经过实测可以明显感受到,Qwen3.8-Flash 的定位更像是一款为真实工作流而准备的模型:多模态表现稳定,Coding 和复杂任务的完成度也比较高,很少出现会直接影响最终结果的明显短板,再加上低到可以放心高频调用的价格。它真正有竞争力的地方,在于将模型能力、任务执行和使用成本做到了一个较为均衡的水平。
1. 推理能力:够用,但不是强项
本次实测中,Qwen3.8-Flash 在逻辑和多模态推理上的表现比较稳定,但还谈不上特别惊艳。像漫画排序这种需要结合画面信息再进行多步判断的推理任务,它能够准确理解每一张图表达的内容,但最后的顺序仍然可能出错。也就是说,它对于信息的提取和理解没有太大问题,真正容易丢分的地方还是出现在后续的推理过程。
因此,对于日常问答、信息整理、内容分析,这个能力已经完全够用;但遇到比较复杂的数学、逻辑或者需要连续多步推演的问题,可能需要优先选择推理能力更强的模型。
2. 多模态 + Coding:展现出明显优势
这是真正让人眼前一亮的部分。从 Three.js 3D 场景到建筑空间还原,再到网页复刻的这几组任务里,Qwen3.8-Flash 都表现出了较高的完成度。尤其是 3D 工厂和室内场景,模型已经不只给出一个符合物理逻辑、建模完整的 Demo 这么简单,而是开始认真打磨材质、光照、动画、空间关系及交互细节。
更重要的是,它在这些任务里很少出现明显的结构性错误,也没有为了过度打磨视觉效果而忽略功能逻辑。在网页复刻案例中的表现也能说明,模型能一次产出接近预期的交付物,兼顾视觉与功能性。这一点也和模型的定位相契合,千问官方重点强化的方向正是 Coding、Agent、专业任务和多模态,而从实测来看,这些能力确实转化为了直观的用户体验。
当然,它也并非完全没有瑕疵。比如 SVG 动态效果仍然存在细节不到位的情况,3D 场景为了追求视觉效果也可能堆出比较高的性能开销。不过这些更像是是否能进一步优化细节的问题,而不是任务能否跑通的问题。
3. 价格太卷,直接改变了使用方式
极低的调用成本是 Qwen3.8-Flash 最无法忽视的优势之一。输入 $0.15 / 1M tokens、输出 $0.47 / 1M tokens,同时还支持 100 万 token 上下文,几乎秒杀了 DeepSeek-V4-Flash 这样的同级竞品。而这个定价能够带来的意义,远不止“便宜”这两个字。
当一个模型的能力已经足够应付 Coding、多模态和日常 Agent 任务时,价格下降会直接改变它的使用频率。以往可能不舍得让旗舰模型反复跑几十轮,现在这种模型完全可以放进大量任务里,再根据结果决定要不要换更贵的模型。对于需要高频使用模型的用户来说,可能比单纯追求某一项顶配能力的旗舰模型更实用。
常见问题 FAQ
Q1:Qwen3.8-Flash 是什么?和 Qwen3.8-Max 有什么区别?
Qwen3.8-Flash 是阿里巴巴通义实验室在 8 月末开源的下一代多模态 MoE 模型,总参数 125B,每个 token 只激活约 6B 参数,可视为 Qwen4 的技术预览。和 Qwen3.8-Max 相比,核心区别:1)激活参数小——Max 是 2.4 万亿总参数、950 亿激活,Flash 仅 125B 总参数、6B 激活,训练计算量约是其 1/9;2)更便宜;3)定位不同——Max 是旗舰全能选手,Flash 主打高频生产与性价比。
Q2:什么是 6B 激活参数?凭什么撑起百亿级模型能力?
6B 激活参数指的是模型虽然有 125B 总参数,但处理每个 token 时实际只调动约 60 亿参数。这是当下大模型的竞赛新趋势——用更少的计算撑起更强的能力。Qwen3.8-Flash 通过 GDN+QSA 注意力、Gated Residual、51B 参数 N-gram Embedding 和 Muon Optimizer 等架构升级,把算力集中在有价值的信息上,因此在 Coding、Agent、专业任务和多模态上仍拿到不错成绩,而训练计算量仅为前代的约 1/9。
Q3:Qwen3.8-Flash 的多模态能力如何?
Qwen3.8-Flash 原生支持多模态,在 302.AI 实测中表现稳定。典型如建筑草图复原:它能将参考图转成可交互的 Three.js 3D 场景,通过 Canvas 程序化生成木地板、沙发、窗户、墙面等丰富贴图,构建完整光照生态系统(日光、灯光、地面反射光),还带日光/黄昏模式切换和视角预设动画。在图表、漫画理解等场景也基本稳定,尤其擅长把视觉信息转化为可用的交互成果。
Q4:Qwen3.8-Flash 的 Coding 能力如何?
Coding 和 Agent 是 Qwen3.8-Flash 官方重点强化的方向,实测确实转化成了体验。在 Three.js 3D 微型工厂、建筑空间还原、网页复刻等任务中,它都表现出较高完成度:材质与色彩体系高度风格化,生产线动画逻辑严谨,机械臂关节物理联动流畅,网页复刻对原网页的视觉还原和交互响应都更好。少出现明显结构性错误,不像某些模型只顾视觉而忽略功能。
Q5:Qwen3.8-Flash 的价格是多少?比 GLM-5.3-Flash 和 DeepSeek 便宜多少?
在 302.AI 平台,qwen3.8-flash 价格为:输入 $0.15/百万 Token、输出 $0.47/百万 Token、缓存写入 $0.2/百万 Token、缓存读取 $0.016/百万 Token,支持 100 万 Token 上下文。对比 GLM-5.3-Flash(输入 $0.075、输出 $0.25),Qwen3.8-Flash 略高但同属白菜价档;对比 DeepSeek-V4-Flash 更是几乎秒杀。这种价格让高频调用成为可能,按需付费、成本可控。
Q6:Qwen3.8-Flash 的上下文窗口有多大?
Qwen3.8-Flash 原生支持 262K 上下文,可以扩展到 1M(100 万 Token)。配合 100 万 Token 的上下文和低价格,它可以一次性处理大型代码库、长篇文档、复杂项目资料。更重要的是,足够的上下文让它在 Coding、Agent 和办公任务中能保留更多任务历史,减少频繁拆材料和重复提供背景的需求,适合需要多轮迭代的工作流。
Q7:Qwen3.8-Flash 擅长哪些场景?
根据 302.AI 的 5 个实战案例,Qwen3.8-Flash 最擅长:1)多模态逻辑推理(漫画排序、图表理解);2)程序化 SVG 图形生成;3)Three.js 3D 微型工厂模拟;4)建筑草图复原;5)网页复刻。此外还适合 Coding、Agent、办公和多模态任务。它的定位更偏真实工作流,综合能力强、完成度高,很少出现影响最终结果的明显短板。
Q8:Qwen3.8-Flash 有哪些局限性?如何调用?
根据 302.AI 实测,Qwen3.8-Flash 的主要局限:1)推理能力够用但不惊艳——复杂数学、逻辑问题可能丢分;2)SVG 动态效果细节不到位;3)3D 场景性能开销较大;4)Artificial Analysis 榜单位列第 20 位。调用方式有三种:客户端输入 qwen3.8 选对应版本;应用超市→聊天机器人→开源模型→qwen3.8-flash;API超市→语言大模型→Qwen→qwen3.8-flash→Playground 在线调用。302.AI 按需付费、无需月费。
5. 如何在 302.AI 上使用
1. 使用302.AI客户端
步骤指引:对话框内选择模型菜单

输入qwen3.8即可获取相应版本调用

2. 聊天机器人中使用
步骤指引 :应用超市→聊天机器人→立即体验

选择模型:开源模型→qwen3.8-flash→确认

3. 使用模型 API
步骤指引:API超市→语言大模型→Qwen→qwen3.8-flash

点击【Playground】在线调用 API

想即刻体验 Qwen3.8-Flash 模型?
👉立即注册免费试用302.AI,开启你的AI之旅!👈
为什么选择302.AI?
● 灵活付费:无需月费,按需付费,成本可控
● 丰富功能:从文字、图片到视频,应有尽有,满足多种场景需求
● 开源生态:支持开发者深度定制,打造专属AI应用
● 易用性:界面友好,操作简单,快速上手
