ARCHIVE · 每日精选
2026年9月1日 的精选
这一天 BitShovel 在册 26 条信号,先看 3 条焦点。本页是不可变归档:记录当时的选择,方便对照后来的变化。
亚马逊对英伟达 GPU 订单增至三倍:新增 200 万颗,2027-2028 年交付 AWS
英伟达 Q2 财报电话会上双方宣布:亚马逊新增 200 万颗 GPU(Blackwell Ultra、Rubin、Rubin Ultra)部署 AWS,2027-2028 年交付、本季度 Q3 起开始部署,订单规模为此前 100 万颗协议的三倍;英伟达称自上一笔协议以来「需求持续超出预期」。同期披露的还有 Vera CPU 供给与 Q2 数据中心营收 890 亿美元(同比 +117%)。
为什么入选供给端订单是最硬的需求证据:云厂商用多年期采购给 AI 算力需求背书,供给约束(而非模型能力)正在成为下一代模型迭代的实际瓶颈。这是判断算力价格走势与模型军备竞赛持续性时可直接核验的锚点。
保留意见证据为两家公司在财报电话会上的官方表态(经 TechCrunch 报道转述,非电话会逐字稿);交易财务条款未披露,「数百亿美元」为按 GPU 单价的媒体估算;本文不是独立评测,订单规模也不等于终端需求全部为真。
Google 发布 Gemini 3.5 Transcribe:实时语音转写进入公开预览
Google DeepMind 发布语音转文本模型 Gemini 3.5 Transcribe,官方称其为迄今最精确的转写模型:Artificial Analysis 测量的平均词错率为流式 4.0%、非流式 2.6%;自动检测并转写 85 种以上语言;对比上一代 Chirp 3,终稿转写用时缩短约 70%。模型以公开预览进入 Gemini API(AI Studio、Antigravity、Gemini Enterprise 可用),并已嵌入 Android Gboard 与 macOS 版 Gemini 应用。两条接口并行:Live API 流式版 gemini-3.5-transcribe-live 与处理预录音频的 gemini-3.5-transcribe(含说话人归属与词级时间戳)。
为什么入选前沿模型对比组同样缺 Google Gemini 成员的纵向锚点;这条还直接落在语音工作流上——85 语种覆盖加词级时间戳,对录音整理、客服质检和会议笔记类工具是一次明确的能力跳变。
保留意见全部指标出自 Google DeepMind 官方公告及其引用的 Artificial Analysis 测量;这不是独立评测,公开预览期的官方口径也不能证明生产环境下的稳定性或成本表现。
Qwen 开源 Qwen3.8-Flash-Next:Qwen4 架构早期预览
阿里通义团队官宣开源 Qwen3.8-Flash-Next,并同步提供 FP8 版本;官方将其定位为基于下一代 Qwen4 架构的多模态 MoE 早期预览,让开发者提前适配即将到来的 Qwen4 家族。官方 ModelScope 的「千问3.8-Flash-Next」模型页已经可以访问。发布时官方未披露具体规格,网上流传的参数规模数字尚未获得官方口径。
为什么入选前沿模型对比组此前一直缺通义 Qwen 的纵向锚点;这次是 Qwen4 家族的第一个架构预览,直接牵动整个开源生态的版本预期与量化、推理适配节奏。
保留意见证据锚定在 Qwen 官方博客地址与 ModelScope 模型页的上线状态,发现链路为 AIHOT 精选快照;上述内容不是独立评测,发布日的聚合器与社区热度不能证明任何性能或成本主张,「125B 总参数/6B 激活」等传闻数字我们未采信。
当日共 26 条在册信号