CARD · 卡片档案
Qwen3.8-Flash-Next 开放权重,预览 Qwen4 架构
Qwen 发布多模态 MoE 实验预览及 FP8 版本。官方模型卡现已披露:语言模型为 125B 参数、6B 激活,另含 51B n-gram 嵌入与 4B MTP 参数;采用 Qwen Community License 1.0。
01
THE STORY · 原文与要点
读懂内容,再看适用边界。
- 原文出处官方口径https://qwen.ai/blog?id=qwen3.8-flash-next
为什么值得了解
做模型部署、量化或推理框架适配的开发者,可以基于公开权重检查新架构,并衡量它在自己任务中的速度与效果。是否替换现有模型,要同时看硬件占用、结果质量和使用许可。
适用条件与限制
6B 激活不代表按一个 6B 小模型准备内存就能运行。模型仍属实验版;许可证对模型服务及其定义的 AI 工作助手业务的商业使用要求另行授权,纯内部使用有例外。性能与成本改善尚未由本站实测。
重要补充与更正
以下日期是本站修订时间。
- 更正 ·
补入官方披露的参数与许可条件:6B 激活不等于 6B 模型的内存需求,部分商业使用需另行授权。
本次阅读进度保存在当前浏览器。 收藏或写笔记 →
02
THE THREAD · 完整时间线
16 条事件,逐条可溯。
同一张卡在不同阶段会被补充记录:新佐证进入、市场出现对比、原文发生实质变化——每条都带日期,链接到当天归档页。
- 本站收录进入 BitShovel 雷达:AIHOT 精选 收录时可见 50 条。
- 记录本站核验:ModelScope 已上线「千问3.8-Flash-Next」模型页(页面标题读取通过);TechNode 转述官方日程称含 FP8 双版本、规格暂未披露。
- 相关讨论对比评测(通义 Qwen):「Kaitchup posted Qwen3.8 27B Benchmarks for quant」——Reddit r/LocalLLaMA 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论版本动态(通义 Qwen):「通义千问发布 Qwen3.8-Max-0902:2.4T 参数、1M token 上下文」——AIHOT 精选 线索。同类的版本动作,改变市场预期与替代选项。
- 相关讨论版本动态(通义 Qwen):「Qwen3.8-Max-0902 released」——Reddit r/LocalLLaMA 线索。同类的版本动作,改变市场预期与替代选项。
- 相关讨论对比评测(通义 Qwen):「Qwen3.8-Max-0902 登顶 Code Arena 并以 $5/MToken 领跑 P」——AIHOT 精选 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论对比评测(通义 Qwen):「Opencode vs Deepseek harness: my experience with」——Reddit r/LocalLLaMA 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论对比评测(通义 Qwen):「Alibaba's Qwen3.8-Max-0902 Tops Code Arena, Beat」——alphasignal-daily 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论对比评测(通义 Qwen):「Perplexity's Lily Beats MLX-LM by 1.35x Running 」——alphasignal-daily 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论版本动态(通义 Qwen):「Perplexity open-sourced their Mac inference serv」——reddit-local-llama 线索。同类的版本动作,改变市场预期与替代选项。
- 相关讨论版本动态(通义 Qwen):「We open-sourced Paddock, our Rust/C++ inference 」——reddit-local-llama 线索。同类的版本动作,改变市场预期与替代选项。
- 相关讨论对比评测(通义 Qwen):「Updated my benchmark with a new vLLM based recip」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论对比评测(通义 Qwen):「I benchmarked 21 Qwen3.8 27B variants on 16GB VR」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论对比评测(通义 Qwen):「Qwen3.8-27B on 2× RTX 5070 Ti 16GB — llama.cpp v」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论对比评测(通义 Qwen):「NInfer vs llama.cpp vs vLLM: quality + speed com」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
- 相关讨论版本动态(通义 Qwen):「阿里千问开源 Qwen-Drive-1.0-4B:首个面向自动驾驶的视觉语言基础模型」——ithome 线索。同类的版本动作,改变市场预期与替代选项。
03
SOURCES · 来源与依据
按链接核对用途与边界。
来源与依据 · 4 条链接
逐条说明链接的用途与支持范围。链接数量不代表多方独立验证,“直接支持”也仅限下方写明的内容。
当前官方模型卡与许可证已有正文证据,“规格未披露/125B 只是传闻”已不适合作为当前说明。“开放权重”能避免把附商业条件的许可笼统当成宽松开源许可。保留原条目 publishedAt=2026-08-26T12:30:00.000Z;本次无法确认规格首次加入模型卡的日期,9 月 6 日仅记录补核验。原时间线中的发布日观察保留历史语境。抓取元数据见 evidence-manifest.json。
边界:6B 激活不代表按一个 6B 小模型准备内存就能运行。模型仍属实验版;许可证对模型服务及其定义的 AI 工作助手业务的商业使用要求另行授权,纯内部使用有例外。性能与成本改善尚未由本站实测。
- AIHOT 精选用途待说明
尚未附本链接支持范围的逐项说明。
- ModelScope 官方模型页用途待说明
尚未附本链接支持范围的逐项说明。
- TechNode 发布报道用途待说明
尚未附本链接支持范围的逐项说明。
04
EDITORIAL REVIEW · 本站编辑核验
说明与证据的核验记录。
本站编辑核验 · 已核验
· 北京时间
补充核对来源正文,更新用途、规格和使用条件。原发布日期与收录时间保留;本次编辑核验日期不代表产品刚发生变化。
此时间记录本站对卡片说明与证据的核验,不代表项目发布或产品更新。