CARD · 卡片档案

Qwen3.8-Flash-Next 开放权重,预览 Qwen4 架构

Qwen 发布多模态 MoE 实验预览及 FP8 版本。官方模型卡现已披露:语言模型为 125B 参数、6B 激活,另含 51B n-gram 嵌入与 4B MTP 参数;采用 Qwen Community License 1.0。

01
THE STORY · 原文与要点

读懂内容,再看适用边界。

为什么值得了解

做模型部署、量化或推理框架适配的开发者,可以基于公开权重检查新架构,并衡量它在自己任务中的速度与效果。是否替换现有模型,要同时看硬件占用、结果质量和使用许可。

适用条件与限制

6B 激活不代表按一个 6B 小模型准备内存就能运行。模型仍属实验版;许可证对模型服务及其定义的 AI 工作助手业务的商业使用要求另行授权,纯内部使用有例外。性能与成本改善尚未由本站实测。

重要补充与更正

以下日期是本站修订时间。

  • 更正 ·

    补入官方披露的参数与许可条件:6B 激活不等于 6B 模型的内存需求,部分商业使用需另行授权。

本次阅读进度保存在当前浏览器。 收藏或写笔记 →

02
THE THREAD · 完整时间线

16 条事件,逐条可溯。

同一张卡在不同阶段会被补充记录:新佐证进入、市场出现对比、原文发生实质变化——每条都带日期,链接到当天归档页。

卡片时间线
  1. 本站收录进入 BitShovel 雷达:AIHOT 精选 收录时可见 50 条。
  2. 记录本站核验:ModelScope 已上线「千问3.8-Flash-Next」模型页(页面标题读取通过);TechNode 转述官方日程称含 FP8 双版本、规格暂未披露。
  3. 相关讨论对比评测(通义 Qwen):「Kaitchup posted Qwen3.8 27B Benchmarks for quant」——Reddit r/LocalLLaMA 线索。同类对比与口碑,是市场面相对位置的信号。
  4. 相关讨论版本动态(通义 Qwen):「通义千问发布 Qwen3.8-Max-0902:2.4T 参数、1M token 上下文」——AIHOT 精选 线索。同类的版本动作,改变市场预期与替代选项。
  5. 相关讨论版本动态(通义 Qwen):「Qwen3.8-Max-0902 released」——Reddit r/LocalLLaMA 线索。同类的版本动作,改变市场预期与替代选项。
  6. 相关讨论对比评测(通义 Qwen):「Qwen3.8-Max-0902 登顶 Code Arena 并以 $5/MToken 领跑 P」——AIHOT 精选 线索。同类对比与口碑,是市场面相对位置的信号。
  7. 相关讨论对比评测(通义 Qwen):「Opencode vs Deepseek harness: my experience with」——Reddit r/LocalLLaMA 线索。同类对比与口碑,是市场面相对位置的信号。
  8. 相关讨论对比评测(通义 Qwen):「Alibaba's Qwen3.8-Max-0902 Tops Code Arena, Beat」——alphasignal-daily 线索。同类对比与口碑,是市场面相对位置的信号。
  9. 相关讨论对比评测(通义 Qwen):「Perplexity's Lily Beats MLX-LM by 1.35x Running 」——alphasignal-daily 线索。同类对比与口碑,是市场面相对位置的信号。
  10. 相关讨论版本动态(通义 Qwen):「Perplexity open-sourced their Mac inference serv」——reddit-local-llama 线索。同类的版本动作,改变市场预期与替代选项。
  11. 相关讨论版本动态(通义 Qwen):「We open-sourced Paddock, our Rust/C++ inference 」——reddit-local-llama 线索。同类的版本动作,改变市场预期与替代选项。
  12. 相关讨论对比评测(通义 Qwen):「Updated my benchmark with a new vLLM based recip」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
  13. 相关讨论对比评测(通义 Qwen):「I benchmarked 21 Qwen3.8 27B variants on 16GB VR」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
  14. 相关讨论对比评测(通义 Qwen):「Qwen3.8-27B on 2× RTX 5070 Ti 16GB — llama.cpp v」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
  15. 相关讨论对比评测(通义 Qwen):「NInfer vs llama.cpp vs vLLM: quality + speed com」——reddit-local-llama 线索。同类对比与口碑,是市场面相对位置的信号。
  16. 相关讨论版本动态(通义 Qwen):「阿里千问开源 Qwen-Drive-1.0-4B:首个面向自动驾驶的视觉语言基础模型」——ithome 线索。同类的版本动作,改变市场预期与替代选项。

03
SOURCES · 来源与依据

按链接核对用途与边界。

来源与依据 · 4 条链接

逐条说明链接的用途与支持范围。链接数量不代表多方独立验证,“直接支持”也仅限下方写明的内容。

发现错误或使用问题?纠错与反馈 ↗

04
EDITORIAL REVIEW · 本站编辑核验

说明与证据的核验记录。

本站编辑核验 · 已核验

· 北京时间

补充核对来源正文,更新用途、规格和使用条件。原发布日期与收录时间保留;本次编辑核验日期不代表产品刚发生变化。

此时间记录本站对卡片说明与证据的核验,不代表项目发布或产品更新。

核验来源与完整回执查看完整回执:更正前后与核验记录(JSON)