持续专题 · 2026年9月20日整理
Jev:从快速判断,到查航班与整理论文
浏览器里下一步点哪里,一千篇论文分到哪一类?从官方能力、独立测试到开发者作品,看 Jev 怎样与聊天模型配合。

01先看用途
一封邮件该交给谁,也能成为 AI 的工作
- 读入材料
邮件内容+分类标准
- 作出判断
从售后、账单、合作中选择
- 继续处理
软件转交;需要时再生成回复
编辑示意,说明一种分工;并非本站实测返回值。 查看依据 ↗
收到一封邮件,先判断它属于售后、账单还是合作,再交给对应的人处理。这类反复出现的小判断,是 Jev 要做的事。TypeSafe AI 在 2026 年 9 月 15 日发布它,称这类专注于快速判断的模型为 System One。
使用时先给它材料和问题,再定义可以返回哪些选项。它能选择类别、按给定刻度评分,或判断一句话成立的可能性;多个问题可以一起处理。结果直接交给软件继续执行,回复邮件的文字则可以由另一个模型生成。
来源与补充
- TypeSafe:Jev 发布说明 ↗官方发布 · 9 月 15 日首次公开发布与产品定位。
- TypeSafe 快速开始 ↗官方使用示例同一份材料同时提出分类、评分与真假问题。
02建立参照
固定规则、Jev 和聊天模型,分别接哪一步
同样是处理邮件,“附件大于 20 MB”可以直接用规则判断;“这封邮件在催进度吗”需要理解语气和上下文;“请写一封得体的回复”需要生成文字。把这三步拆开,就更容易理解 Jev 在整件事里的位置。下表是工作分工示例。
| 这一步要做什么 | 可以怎样处理 | 交付什么 |
|---|---|---|
| 检查附件大小 | 固定规则 | 超过或未超过上限 |
| 判断意图与归属 | Jev;语言模型也能做分类 | 预设选项与概率 |
| 起草回复 | 能生成文字的语言模型 | 可以继续修改的文字 |
来源与补充
Jev 的概率和置信度可帮助软件决定何时继续、何时交给别的处理方式。它们不是单次答案正确的保证;输出符合预设格式,也仍可能选错。
- System One 的输入与输出 ↗官方定义支持的判断类型,以及校准不保证单次正确的说明。
- 置信度怎样参与后续处理 ↗官方文档Choice、Score 的置信度及不同处理分支。
03官方与实测
把速度、费用和接手多少任务放在一起看
官方展示的 193.6 倍速度、444.6 倍成本优势,来自自建的工作流程评估,参照答案取 Astra 与 Fable 的平均预测。它说明特定判断流程的表现,不能直接换成所有任务的快慢排行。
Nexus 另用同一批 469 个案例比较助手的检查步骤。Jev 接手其中 58%,其余交回规则。把回退也算进去,Jev 总共错 90 次,Sonnet 5 错 92 次;这次实验更鲜明的差别在等待与费用。
| 方案 | 模型接手比例 | 总错误 | 典型耗时 / 单次费用 |
|---|---|---|---|
| 仅规则 | 规则处理全部 | 148 | 约 50 ms / $0 |
| Sonnet 5 +规则 | 67% | 92 | 6.3 秒 / $0.0178 |
| Jev +规则 | 58% | 90 | 0.66 秒 / $0.00008 |
来源与补充
作者实测,本站未复跑。该组主要由 AI 标注;模型阈值调优不对等,LLM 耗时包含启动工具。结果适用于这批检查。
- TypeSafe 工作流程评估说明 ↗厂商评估公开倍数的任务、参照与测试条件。
- Nexus:在真实助手检查中测试 Jev ↗作者实测 · 9 月 17 日比较表保留回退后的总错误、耗时与费用。
04作品一
查一趟航班:选择按钮与填写文字分开做
Browser Use 的公开演示从一句要求开始:查找 9 月 20 日苏黎世到伦敦、单程、1 位成人的经济舱航班。Jev 从网页控件清单中选择下一步和目标;需要输入城市时,Mercury 2.5 负责生成文字。最终画面显示匹配航班,没有选票或预订。
作者记录的任务耗时为 7.073 秒,从首次读取首页之后开始计算,包含模型调用、填字与网页加载。视频、测量记录和代码都公开,适合一起看“选哪一步”怎样变成屏幕上的操作。
- 观看作者航班搜索演示原速记录;完成到显示结果。
- 打开作品与运行说明开发者可查看模型分工、代码与复现入口。
- Browser Use 素材许可MIT · Copyright 2026 Browser Use。
来源与补充
这是作者的一次公开任务记录,本站未运行付费模型复现。Jev 收到的是网页的文本与控件信息,演示画面不代表它直接读取图片。
- Browser Use · jev-ultrafast ↗作者代码与作品完整任务、模型分工与演示。
- 航班演示的测量记录 ↗作者测试条件初始导航与独立结果复核不计入任务时钟。
05作品二
一千多篇论文:先写摘要,再尝试更快分类

1kpapers 已经把 1,018 篇论文整理成可以按研究方向、实验室和时间浏览的目录。Hassan 在 9 月 17 日报告了一次 Jev 实验:把论文标题、DeepSeek V4 Flash 摘要和 24 个主题选项交给 Jev,分类总费用为 0.08 美元,每篇延迟中位数 256 毫秒。
摘要与分类是两笔工作:网站原有 1,000 篇摘要实验的 DeepSeek 推理费用为 3.99 美元。9 月 20 日读取的公开分类代码仍采用原有模型流程,因此这里展示的是现有论文目录与新增分类实验,不能据此认定在线标签已经全部换成 Jev。
- 打开论文目录先选一个熟悉的研究方向,看摘要怎样帮助浏览。
- 看作者的 Jev 分类实验分类费用与耗时来自作者报告。
来源与补充
- Hassan 的分类实验原帖 ↗作者报告 · 9 月 17 日论文数量、24 个主题选项与分类用量。
- 1kpapers:已有作品与摘要实验 ↗作者公开作品现有目录、摘要成本与完整方法。
- 1kpapers 公开分类代码 ↗源码 · 9 月 20 日读取当前公开流程仍使用 Together 上的 DeepSeek 与 Qwen。
06入口与费用
可以从哪里试,怎样读当前价格
截至 9 月 20 日,TypeSafe 官方列出的直接 API 价格是每百万输入 token 0.042 美元,输出免费;控制台提供试用入口,访问以账号开放情况为准。同日 Vercel AI Gateway 的 Jev 页面标注输入与输出免费,并注明促销在 9 月 25 日结束。两者是不同入口的价格。
Jev 当前读取文本,图片或音频需要先转成可读材料。官方还说明英文表现最好;面向中文邮件、评论或资料分类时,应先拿自己的样本看看。模型调用便宜,不等于整个应用的摘要、运行和其他模型费用都包含在内。
- 进入 TypeSafe 控制台官方账号与试用入口。
- 查看 Vercel 当前价格限时价格以入口显示为准。
来源与补充
- TypeSafe 模型与价格 ↗官方文档 · 9 月 20 日读取直接 API 价格、输入类型与语言说明。
- Vercel AI Gateway · Jev ↗接入平台 · 9 月 20 日读取当前免费促销及 9 月 25 日结束日期。
07接回已有使用
你常用的 AI 助手,可以多一种分工方式
如果你在用 GPT、Opus、Grok 等助手写作、编程或整理材料,理解 Jev 可以从刚才的两个作品开始:写城市名称和选择网页按钮分开,写论文摘要和判断分类分开。改变的是一项工作内部怎样分配任务,不必把新模型的出现都理解为换一个聊天订阅。
Astra 专题里的 Blender 作品展示了模型怎样把描述变成可编辑场景。接着看 Jev,可以多问一个问题:这项工作里,哪些步骤需要创造新内容,哪些只是从已有选择里作判断?这是我们从这些作品得到的使用思路,实际怎样搭配仍取决于应用接入。
- 继续看 Astra 的可编辑三维作品从生成作品这一侧,理解模型分工。
- 看官方怎样拆分智能家居指令识别设备与动作,再由程序执行。
来源与补充
- TypeSafe 智能家居示例 ↗官方工作流程展示语义判断、文字处理与执行的分工。
接下来还会关注
08继续关注
接下来还会关注
- 哪些重复判断已经在真实工具里用起来?
- 同一个任务中,规则、Jev 和语言模型怎样分工更合适?
- 中文场景、准确率与使用入口还有哪些新结果?