ARCHIVE · 每日精选

2026年8月29日 的精选

这一天 BitShovel 在册 29 条信号,先看 3 条焦点。本页是不可变归档:记录当时的选择,方便对照后来的变化。

01开源增长 · 新出现

Qwen 开源 Qwen3.8-Flash-Next:Qwen4 架构早期预览

阿里通义团队官宣开源 Qwen3.8-Flash-Next,并同步提供 FP8 版本;官方将其定位为基于下一代 Qwen4 架构的多模态 MoE 早期预览,让开发者提前适配即将到来的 Qwen4 家族。官方 ModelScope 的「千问3.8-Flash-Next」模型页已经可以访问。发布时官方未披露具体规格,网上流传的参数规模数字尚未获得官方口径。

为什么入选前沿模型对比组此前一直缺通义 Qwen 的纵向锚点;这次是 Qwen4 家族的第一个架构预览,直接牵动整个开源生态的版本预期与量化、推理适配节奏。

保留意见证据锚定在 Qwen 官方博客地址与 ModelScope 模型页的上线状态,发现链路为 AIHOT 精选快照;上述内容不是独立评测,发布日的聚合器与社区热度不能证明任何性能或成本主张,「125B 总参数/6B 激活」等传闻数字我们未采信。

看原文判断依据Qwen 官方博客原文,经 AIHOT 精选进入视野
02产品雷达 · 新出现

Google 发布 Gemini 3.5 Transcribe:实时语音转写进入公开预览

Google DeepMind 发布语音转文本模型 Gemini 3.5 Transcribe,官方称其为迄今最精确的转写模型:Artificial Analysis 测量的平均词错率为流式 4.0%、非流式 2.6%;自动检测并转写 85 种以上语言;对比上一代 Chirp 3,终稿转写用时缩短约 70%。模型以公开预览进入 Gemini API(AI Studio、Antigravity、Gemini Enterprise 可用),并已嵌入 Android Gboard 与 macOS 版 Gemini 应用。两条接口并行:Live API 流式版 gemini-3.5-transcribe-live 与处理预录音频的 gemini-3.5-transcribe(含说话人归属与词级时间戳)。

为什么入选前沿模型对比组同样缺 Google Gemini 成员的纵向锚点;这条还直接落在语音工作流上——85 语种覆盖加词级时间戳,对录音整理、客服质检和会议笔记类工具是一次明确的能力跳变。

保留意见全部指标出自 Google DeepMind 官方公告及其引用的 Artificial Analysis 测量;这不是独立评测,公开预览期的官方口径也不能证明生产环境下的稳定性或成本表现。

看原文判断依据Google DeepMind 官方博客原文,经 AIHOT 精选进入视野
03平台变化 · 新出现

智谱发布 GLM-5.3-Flash:前沿智能按 Flash 价格卖

智谱在官方博客发布 GLM-5.3-Flash(即此前社区跟踪的 ox-alpha 正名):MoE 架构总参数约 3,213 亿、FP8 混合精度,MIT 许可开放权重,支持中英双语与 40 万上下文。发布当日 r/LocalLLaMA 开出实测 megathread,第三方对比称其能力接近 Claude Opus 而价格约为十分之一——作为前沿模型市场的价格锚点事件值得持续跟踪。

为什么入选开源权重+前沿宣称+十分之一定价的组合直接冲击同类模型的价格与开源/闭源分界;后续同类的对比评测、价格回应与量化版本演进都是这条纵向时间线的自然续章。

保留意见[证据来源:官方博客与 HF 模型卡 + 第三方转述] “对标 Opus、十分之一价格”来自 AlphaSignal 的对比口径,不是独立评测;本地实测数据要等社区 megathread 沉淀,热度本身不能证明结论。

看原文判断依据智谱官方博客 + Hugging Face 模型卡

当日共 29 条在册信号