ARCHIVE · 每日精选
2026年9月5日 的精选
当天保留的选择记录中,4 条内容曾列入焦点,首页列表累计选入 7 条。这里保留累计选择;有当时快照的展示入选时资料,其余明确标注为当前资料。
当天选择与轮换记录 · 6 次
以下是保留下来的选择记录;记录时间不等同于每次线上发布时间,未留下的时刻不作推断。
历史资料恢复 当次焦点 2 条 · 今日全部数量未留存
历史资料恢复 当次焦点 2 条 · 今日全部 3 条
历史资料恢复 当次焦点 3 条 · 今日全部 4 条
历史资料恢复 当次焦点 3 条 · 今日全部 6 条
选择记录 当次焦点 0 条 · 今日全部 6 条
当次没有焦点条目
选择记录 当次焦点 0 条 · 今日全部 7 条
当次没有焦点条目
当天曾进入焦点 · 4 条
Perplexity 开源 Lily:只跑 Qwen3.6-35B-A3B 一个检查点的 Metal 推理服务器
入选时记录 · 由历史资料恢复;当时的展示时刻和文案可能不完整。
Perplexity 在 pplx-garden 仓库以 Apache-2.0 协议开源了 Lily:一款基于 Rust+Metal 的 Mac 推理服务器,其载入期校验仅放行一个检查点——mlx-community/Qwen3.6-35B-A3B-4bit(HF revision 钉死、仅 affine 4bit group 64),其余架构与量化一律拒载。它暴露 OpenAI chat completions API 的最小子集、恒贪心解码、保留两槽 LRU 前缀缓存;要求 Apple GPU family 10+(M5 起)与 macOS 26+。收录时 704 stars。AlphaSignal 称其跑 Qwen3.6 比 MLX-LM 快 1.35×;README 未给该数字,但发布了带测量契约与复现步骤的日期版基准报告。
为什么入选官方开源工具链的新能力当天就能上手验证:单检查点加 fail-closed 载入校验是 Apple Silicon 本地推理路线上态度鲜明的工程取舍,Apache-2.0 加钉死的权重 revision 让任何人都能复现同一份基准;1.35× 虽是聚合媒体口径,仓库自带复现步骤,社区可以当天复核。
保留意见证据来源为 Perplexity 官方仓库 README(自述)与 AlphaSignal、r/LocalLLaMA 聚合讨论(BitShovel 于 2026-09-03 抓取核对仓库)。1.35× 提速未见于 README、属聚合媒体口径且待独立复现;支持面窄——仅 M5 起的 Apple 芯片、macOS 26+、单一 4bit 检查点;stars 是注意力不是质量证明,上述内容不是独立评测。
查看完整档案与后来变化 →Hugging Face 发布开源工具 funes,为编码智能体提供可本地持有的记忆层
入选时记录 · 由历史资料恢复;当时的展示时刻和文案可能不完整。
Hugging Face 发布开源工具 funes,为编码智能体提供可本地持有的记忆层。标题与要点来自原文与收录源;正文结论请以原文为准。
为什么入选它代表什么:官方开源工具链的新能力当天就能上手验证,早跑通的人早拿到能力或成本差。同一窗口被 2 路独立信源各自收录,不是单点噪声。局限:内容是作者或媒体的口径,未经独立评测,多源收录不等于质量或采用;上述价值要在核对原文数据后才成立,产品与数据可能变化,部分原文域名国内访问不稳。
保留意见双源同题仅证明多源收录与原文可达;标题与结论均为作者自述或收录源转述,不是 BitShovel 的独立评测,也不能证明质量或采用;围绕它的讨论只是讨论快照式的注意力,不能证明事实成立;国内访问部分原文域名可能不稳定。
查看完整档案与后来变化 →Qwen 开源 Qwen3.8-Flash-Next:Qwen4 架构早期预览
入选时记录 · 由历史资料恢复;当时的展示时刻和文案可能不完整。
阿里通义团队官宣开源 Qwen3.8-Flash-Next,并同步提供 FP8 版本;官方将其定位为基于下一代 Qwen4 架构的多模态 MoE 早期预览,让开发者提前适配即将到来的 Qwen4 家族。官方 ModelScope 的「千问3.8-Flash-Next」模型页已经可以访问。发布时官方未披露具体规格,网上流传的参数规模数字尚未获得官方口径。
为什么入选前沿模型对比组此前一直缺通义 Qwen 的纵向锚点;这次是 Qwen4 家族的第一个架构预览,直接牵动整个开源生态的版本预期与量化、推理适配节奏。
保留意见证据锚定在 Qwen 官方博客地址与 ModelScope 模型页的上线状态,发现链路为 AIHOT 精选快照;上述内容不是独立评测,发布日的聚合器与社区热度不能证明任何性能或成本主张,「125B 总参数/6B 激活」等传闻数字我们未采信。
查看完整档案与后来变化 →Google 发布 Gemini 3.5 Transcribe:实时语音转写进入公开预览
入选时记录 · 由历史资料恢复;当时的展示时刻和文案可能不完整。
Google DeepMind 发布语音转文本模型 Gemini 3.5 Transcribe,官方称其为迄今最精确的转写模型:Artificial Analysis 测量的平均词错率为流式 4.0%、非流式 2.6%;自动检测并转写 85 种以上语言;对比上一代 Chirp 3,终稿转写用时缩短约 70%。模型以公开预览进入 Gemini API(AI Studio、Antigravity、Gemini Enterprise 可用),并已嵌入 Android Gboard 与 macOS 版 Gemini 应用。两条接口并行:Live API 流式版 gemini-3.5-transcribe-live 与处理预录音频的 gemini-3.5-transcribe(含说话人归属与词级时间戳)。
为什么入选前沿模型对比组同样缺 Google Gemini 成员的纵向锚点;这条还直接落在语音工作流上——85 语种覆盖加词级时间戳,对录音整理、客服质检和会议笔记类工具是一次明确的能力跳变。
保留意见全部指标出自 Google DeepMind 官方公告及其引用的 Artificial Analysis 测量;这不是独立评测,公开预览期的官方口径也不能证明生产环境下的稳定性或成本表现。
查看完整档案与后来变化 →当天其他曾展示内容 · 3 条
首页「今日全部」最多保留 10 条;当天其他曾展示内容仍可在这里回查。
GPT-5.6 Sol 降价讨论很热,但机会在单位经济而不是热度本身
当前资料 · 当时的文案快照未留存
OpenRouter 官方模型页在再次核验时仍标注 50% off,输入与输出价格现为每百万 Token 2 美元和 10 美元;Hacker News 讨论为 635 分、448 条评论。
当前价值判断模型成本骤变会改变批处理、长上下文和高频 Agent 工作流的单位经济;真正值得做的是拿自己的任务量重算成本,寻找此前不成立、现在可能成立的产品或服务。
保留意见这是 2026-08-22 的讨论快照。分数和评论数只是注意力,不能证明存在买家、收入、利润或可复制的赚钱机会;价格来自 OpenRouter 官方模型页且可能变化,BitShovel 未逐条核验评论,也未验证任何具体业务的完整成本。
查看完整档案与后来变化 →智谱发布 GLM-5.3-Flash:前沿智能按 Flash 价格卖
当前资料 · 当时的文案快照未留存
智谱在官方博客发布 GLM-5.3-Flash(即此前社区跟踪的 ox-alpha 正名):MoE 架构总参数约 3,213 亿、FP8 混合精度,MIT 许可开放权重,支持中英双语与 40 万上下文。发布当日 r/LocalLLaMA 开出实测 megathread,第三方对比称其能力接近 Claude Opus 而价格约为十分之一——作为前沿模型市场的价格锚点事件值得持续跟踪。
当前价值判断开源权重+前沿宣称+十分之一定价的组合直接冲击同类模型的价格与开源/闭源分界;后续同类的对比评测、价格回应与量化版本演进都是这条纵向时间线的自然续章。
保留意见[证据来源:官方博客与 HF 模型卡 + 第三方转述] “对标 Opus、十分之一价格”来自 AlphaSignal 的对比口径,不是独立评测;本地实测数据要等社区 megathread 沉淀,热度本身不能证明结论。
查看完整档案与后来变化 →Qwen3.8-27B 进入本次 HF 趋势采集筛选结果(第 2 条)
当前资料 · 当时的文案快照未留存
2026-09-05 的 HF 趋势采集按任务类型、访问条件与趋势分筛选后,Qwen/Qwen3.8-27B 列为第 2 条。该次序不是 HF 原榜名次;快照记录趋势分 551、下载计数 6,024,467、点赞 13,984。
当前价值判断这次采集提供一组可继续核查的公开模型仓库。筛选后的次序用于组织本次结果;判断是否值得试用,还需要阅读模型卡、许可证与适用任务说明。
保留意见第 N 条表示本次采集筛选后的次序,不是 HF 原榜名次或全球排名。趋势分、下载量与点赞都只是注意力,不能证明模型质量、实际采用、评测成绩或生产可用性。请回到官方模型页与模型卡核实。
查看完整档案与后来变化 →当日累计曾展示 7 条 · 最后一次「今日全部」7 条