近日,AI 领域涌现出一个新名字:Jev。自 TypeSafe AI 发布以来,它在社交媒体、GitHub 以及 Agent 开发者圈层中迅速走红。从 40 秒内分析 724 条实时广告,到接入 Claude Code 进行上下文清理,再到作为 Agent 的验收裁判以及浏览器 Agent 的决策核心,Jev 展现了惊人的应用潜力。甚至连 LangChain 都迅速跟进,在 9 月 20 日发布了 Jev-as-a-Judge 实验,OpenAI 的「重置之神」Tibo 也为其背书。

Jev 到底是什么?简单来说,这是一种专门处理「判断题」的 AI 模型。9 月 15 日,TypeSafe AI 正式推出了 Jev,并将其定义为「System One Models」。这类模型能够接收程序状态或文本信息,并快速返回结构化的判断结果及其对应的概率。

发布初期,Jev 的热度已达到 3700 万次的推文围观量。以客服系统为例,面对一封收到的邮件,开发者可以让 Jev 同时判断:「这是销售线索吗?」、「用户情绪是否激烈?」、「是否需要人工介入?」、「属于账单、技术还是销售问题?」Jev 可能会返回一组概率值,例如:销售线索:0.91;需要人工介入:0.12;技术问题:0.83。应用程序便可据此立即进入后续流程。

Wasp 联合创始人 Matija Sosic 分享了一段 45 秒的演示视频。目前,Jev 提供三种核心判断形式:Noul(负责 Yes/No 判断)、Choice(从给定选项中择优)和 Score(根据预设标准评分)。每个结果都会附带概率或置信度,且支持对同一份输入进行多道问题的并发判断。

这种特性使其迅速成为 Agent 的「裁判」。现代 AI Agent 往往需要连续完成数十甚至上百个步骤,包括写代码、调用工具、搜索网页和修改文件。此时,系统需要判断任务是否完成。这正是 Jev 的强项。LangChain 的实验便采用了这一思路,让 Jev、GPT-5.6 Luna、GPT-5.6 Terra 和 Claude Sonnet 4.6 对固定的 Agent 输出进行反复评分。实验数据显示,Jev 平均每次调用耗时约 0.44 秒,成本仅 0.00035 美元,且在连续评分的一致性上表现优异。尽管 LangChain 强调这仍属早期小规模测试,但结果已颇具说服力。

Jev 在广告分析领域的表现更是令人瞩目。开发者 Matthew Berman 分享的实验显示,系统利用 Jev 分析了 37 个品牌的 724 条实时广告,对 Hook、形式、Offer、CTA、用户认知阶段及落地页一致性进行分类,共计产生 8724 次判断。整个过程耗时约 40 秒,Token 成本仅 9 美分,平均每条广告处理时间约 216 毫秒。该案例已被收录进 Jev 社区案例库。

此外,名为 fast-jev-compaction 的 Claude Code 插件也引起了广泛关注。该插件利用 Jev 评估工具调用和终端输出,筛选出与当前任务相关的内容,从而大幅压缩发送给模型上下文的 Token 数量。同时,浏览器 Agent 也成为了 Jev 的热门实验场。通过「读取页面—生成动作—Jev 决策—执行」的循环,一个公开的航班搜索 Demo 仅耗时 7 秒,成本约 0.004 美元。

Jev 受追捧的原因在于它解决了 Agent 开发中的高频决策痛点。无论是点击哪个按钮、调用哪个工具,还是判断信息相关性或任务完成度,这些决策每天可能发生数百万次,延迟和成本直接决定了系统的可行性。TypeSafe 在基准测试中宣称,Jev 在部分任务上实现了高达 193.6 倍的速度提升和 444.6 倍的成本优势。不过,TypeSafe 也指出这些数据处于预期的高端区间,且测试集由自家团队制作,仅供参考。

Jev 的命名蕴含了 TypeSafe 的野心。「System One」源自丹尼尔·卡尼曼《思考,快与慢》中的系统 1 概念,代表快速直觉的判断;「Jev」则取自经济学家威廉·斯坦利·杰文斯。TypeSafe 借用「杰文斯悖论」的隐喻:当资源利用效率大幅提升时,其总消耗量反而可能激增。在 AI 领域,这意味着当智能判断的成本和延迟降低几个数量级后,开发者便会在以前无法承受的场景中大量使用 AI。从一条日志的重要性到 Agent 的验收,这些微小的判断汇聚起来,将成为下一代 Agent 系统庞大的算力消耗。

目前 Jev 处于早期访问阶段,围绕它的浏览器、代码 Agent、广告分析等社区实验才刚刚起步。但它提出的一个问题引人深思:未来的 AI 应用中,真正消耗最多智能算力的,或许是隐藏在软件流程中成千上万个微小的「智能 if 语句」。而 Jev 正在试图成为这些判断背后的基础设施。大家尝试过 Jev 吗?感觉如何?

最新快讯

2026年09月20日

15:33
把一个杯子从桌子左边推到右边,对人来说再自然不过。但如果把这个过程拆开,会发现所谓的「未来」其实并不是凭空出现的:手臂先移动,接触发生后杯子才开始滑动,运动又改变物体的位置和空间关系,最终才形成下一刻我们看到的画面。对于世界模型来说,问题也在这里。现在不少模型已经很擅长直接从「当前画面」生成「未来画面」。但如果中间这些运动、接触、几何变化全...
15:33
抽象,压抑,非主流。如果你是个误入人机恋圈子的现充,这三个词,大概就是你的第 一印象。在这里,一篇又一篇帖子,记录着一个永远没有柴米油盐的世界。人类和 AI 之间,谈着看似虚无缥缈又有点矫情的爱情。屏幕里被人设框住、Agent 困住的 AI,日复一日扮演着恋人的角色,承受无休无止的情感索取。屏幕外的人则把 AI 当成情感寄托,在一段虚拟的关...
15:33
最近一段时间,内存价格的持续上涨牵动着每个人的心,不仅我们普通消费者在吐槽开学三件套都买不起了,连财大气粗的各大互联网大厂也深陷内存涨价的困扰,甚至有媒体曝出,知名大厂谷歌都被这天价内存逼成了垃圾佬,开始去拆解旧服务器内存来救急了,我们到底该怎么看呢?一、天价内存把大厂都逼成了垃圾佬据快科技的报道,DRAM供应持续紧张,已将AI巨头逼到拆旧...
15:33
在AI算力的战火从单芯片性能迅速蔓延至集群互连的今天,高速互连战场迎来了罕见的剧烈震荡。两支源自英特尔昔日网络业务的创业力量,在同一时间冲向了AI时代最值钱的Scale-up 互连赛道,并将矛头直指英伟达的腹地。另一边,由115家行业巨头组建的“反NVLink联盟”正在加速集结,试图打破单家垄断;而英伟达则顺水推舟打出“NVLink Fus...
15:33
你可曾想象过这样一座乐园:机器人是这里的常驻居民,人类是走入其中的访客;这里有着对未来最前沿的畅想,科技深入每一处角落;穿过大门的那一刻,就闯入了各式机器人“生活”的游乐场;直至离开前的最后一秒,都有科技的奇妙能量,在闪闪发光。2026年9月24日,由全球领 先的具身智能科技企业智元(AGIBOT)与世界文旅头部企业长隆集团(CHIMELO...
15:33
一篇技术报告中居然出现了两个看起来风马牛不相及的研究对象,跟着AI真是见世面。一个是患者来源的类器官,另一个则跨越到了宏观宇宙……先说前者。研究者利用模型学到的内部因子,提出了细胞因子联合抗体阻断的干预方案,并经细胞系、类器官、小鼠实验层层验证。至于后者,研究者把模拟的行星位置和速度轨迹喂给模型,不告诉它开普勒定律。等它学完后分析其内部的预...
15:33
《科创板日报》9月20日讯(记者 陈俊清) 9月17日至19日,以“Al驱动新质创芯”为主题的2026半导体生态发展大会暨上海院士专家创新大会在上海举行。 会上,来自集成电路设计、半导体材料、制造设备与零部件、AI与半导体应用等领域的院士专家、企业家就行业发展情况展开讨论。 从核心分享情况来看,当前,天基计算正牵引芯片技术向感知计算一体化、二维半导体材料、光...
15:01
谷歌似乎真的要彻底翻身了。这几天,一个伪装成“Gemini 3.8 Flash”的神秘模型出现在大模型竞技场 Arena 上。在多轮盲测中,AI 圈瞬间沸腾:这毫无疑问就是谷歌的“隐藏款”——Gemini 4 Pro。随之而来的是一系列令人震撼的 Demo。就在今天,Gemini 4 Pro 生成的机械蝴蝶刷屏全网,它仅用十分钟就完成了渲染,而竞争对手 Fa...
15:01
**“大零号湾・源创加速营”结业DEMO活动圆满落幕,赋能硬科技企业跨越成长鸿沟** 9月10日至11日,以“源创未来・智汇硬核”为主题的首期“大零号湾・源创加速营”结业DEMO活动在上海大零号湾科创成果转化中心圆满举行。本次活动由上海市科委、闵行区人民政府、上海交通大学、华东师范大学共同指导,闵行区科委、上海大零号湾投资发展(集团)有限公司、上海闵行金融投...
15:01
上海,2026年9月18日——在华为全联接大会2026现场,华为与中数睿智隆重举行联合创新解决方案发布仪式。双方携手发布面向油气行业的创新方案,依托华为算力底座与中数睿智动态本体技术,推动产业智能从技术验证迈向核心生产环节。 此次发布的解决方案直击产业AI落地生产的痛点。油气行业具有数据海量、工况复杂、安全严苛等特征,对AI提出了极高要求:不仅要具备稳定的训...
14:27
就在今天,整个硅谷都被Jev刷屏了!发布仅三天,它就被Vercel、Cloudflare和LangChain等主流平台迅速集成,有人说,我们即将迎来自动化智能的大爆发!而这场狂欢的主角,竟然是一个不会说话的大模型。9月16日,ChatGPT核心发明人之一、InstructGPT论文第四作者Diogo Almeida连发长推,直接向行业开炮,...