最近Agent圈突然开始聊一个新东西:JeVo我一开始看到这个名字的时候也有点懵:又是一个新的大模型?又要跟GPT、Claude、Gemini卷参数了?结果研究了一下发现,Jev压根不是来跟LLM抢饭碗的。它更像是在说:有些任务,真的没必要让一个几百B的大模型先“写一篇作文”再从作文里解析它到底想干嘛。很多时候,我们只需要它做一个决定。
Jev到底是什么?
它不写一句话,只负责"拍板":10月AI圈最热的新物种,叫决策模型
9月15日,一款叫 Jev 的模型上线。它不写一行字、不画图、不写代码,唯一的工作是替你做判断。 两周后,OpenAI、Cloudflare、亚马逊、上海人工智能实验室,全跟进了。 我看了眼价格——每百万输入 token 0.042 美元,输出免费——突然明白 Agent 这大半年到底卡在哪了。
01.
一、这个"只判断不说话"的模型,到底在干啥
Jev 的创始人给它起了个名字,叫"System One 模型",借的是卡尼曼《思考,快与慢》里的概念。系统一管直觉、管快速反应;系统二才管慢思考、长推理。
过去两年,几乎所有大模型都在往系统二方向卷:推理链越来越长,思考越来越深。但 Agent 真跑起来你会发现,一个任务里密集发生的,根本不是深度推理,而是海量琐碎判断——
这张工单该分给哪个团队?
这条命令能不能放行?
页面下一步该点哪个按钮?
任务到底算完成没有?
Jev 的做法很"轴":它只回答带预设选项的问题,单选、打分或者是非题,直接吐回一个带概率的结构化结果。它把"判断"从"生成"里硬生生剥离出来,做成一种廉价、高频的基础设施。
02.
二、为什么是现在?Agent 跑起来才发现,九成是碎判断
一个 Agent 任务里,密集发生的往往不是"请帮我深度思考",而是上面那种一眼就能定的小事。
过去这两类解法都别扭:交给大模型"顺便"做,先生成一大段文字再解析,又慢又贵;写死成规则,长尾场景一个都覆盖不了。
说白了,我们花了一年给模型喂推理题,却没人认真解决"它到底什么时候该拍板"这件事。等 Agent 真上生产环境,短板一下就露出来了。
所以 Jev 把判断做成独立品类,定价低到几乎可以忽略——输出免费,输入才 0.042 美元/百万 token。Vercel 后来披露,Jev 上线 24 小时内,它 AI Gateway 上13% 的付费用户就用上了,是此前任何模型发布的两倍。
当"判断"便宜到这个份上,Agent 的调用结构会被重写一遍——这是比又出一个高分模型更值得盯的信号。
03.
三、两周内从首发到群战,这个速度不正常
我拉了下时间线,真有点吓人:
9月15日,前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布 Jev;
OpenAI 在开发者日推出 Decisions API;
Cloudflare 10月1日开源 Clef;
亚马逊放出 Strands Decider;
上海人工智能实验室开源多模态决策模型 Intern-Decision;
9月30日,成立不到五个月的上海公司 StartLux(原点星辉)发布开源 StartLux-Decision,宣称在公开评测里超过 Jev——背后掌舵的是盛大网络联合创始人陈大年。
一个新品类,从"首发"走到"群战",只用了两周。这种速度在大模型圈也不多见。
04.
四、普通人现在能蹭到什么
别被"模型"两个字吓到,决策模型其实是最容易落地的那类,因为它小、便宜、输出结构化。
想自己玩:Clf 和 Intern-Decision 都是开源的,搭一层"判断层"成本很低;
做 Agent 的团队:把"判断"从"生成"里拆出来,单次调用成本能砍一大截,长尾场景也不用再写死规则;
选型时别只看分数:许可证、部署路径、社区活不活跃,比榜单排名更影响你最后能不能真用上。
这一轮真正的拐点不是"模型更聪明了",而是"判断终于成了可以单独计费的商品"。
当然,Jev 自己也有明显缺口——它只能答预设选项,遇到开放问题就傻了。所以别指望它替你写方案,它只配在流水线里当那个"拍板的"。
写在最后:大模型卷了一年系统二,10月突然所有人回头补系统一。挺好,Agent 总算有人管"小事"了。
点击前往:【https://github.com/browser-use/jev-ultrafast】