最近一个叫 Jev 的 AI 在很多媒体、朋友圈里涮屏。很多小伙伴只看到了别人在说它多牛却不知道从哪下手。这篇不聊它怎么来、谁做的只讲怎么用看完你能直接上手。01丨30 秒搞懂Jev 是个什么东西一句话ChatGPT 是会写作文的 AIJev 是只会做选择题的 AI。它不说话不聊天不写代码。你给它的永远只有两样东西一份状态要判断的材料一条客服消息、一封邮件、一段记录几道问题选项由你提前定好它返回的永远是固定格式选哪个、概率多少、有多大把握。比如给 Jev 700 个高意向潜在客户和个性化的接触消息。它在 40 秒内成功分析完。Jev 预测了每条消息的表现情况分配了置信度分数并检测了潜在客户-消息是否匹配。而这一切只花了 0.09 美元。02 丨怎么拿到它两条路。官方目前Jev 已向所有用户开放无需申请候补名单。而且所有注册用户都将获得 5 美元额度约 1.2 亿 Token。入口console.typesafe.ai三方平台走 OpenRouter注册后直接调用typesafe/jev按量付费。03 丨它只会答三种题选对题型就成功一半1. 单选Choice从最多 255 个选项里选一个。适合分类、分流、路由。比如一条客服消息进来你问它这条该派给哪个团队给三个选项退换货、物流、账务。它回你退换货还附上每个选项各自的把握。2. 打分Score在你划定的刻度上给分。适合评优先级、评质量、评风险。这里有个关键技巧每一档要写具体情境别写程度。写功能坏了但有替代办法——它能拿去比对写中等严重——它抓瞎因为中等没有参照物。3. 是 / 否Noul给一个是的概率从 0 到 1。适合做是非判断。比如问这位顾客是在要求退款吗它回 0.99意思就是几乎可以肯定。04 丨怎么问比问什么更重要第一条别问大问题拆小问题。新手最容易犯的错是直接问它这封邮件是垃圾邮件吗又大又糊。你既看不懂它凭什么这么判也没法调。正解是拆开问是不是在索要密码是不是声称你中了没参加的奖是不是在制造赶紧行动的紧迫感发件人的域名跟它自称的机构对不对得上每个问题都具体到没有含糊空间。最后你在自己的程序里把它们加权组合算出最终的风险分。第二条一次多问别省着问。这跟用大模型能少问一句是一句的思路正好相反。Jev 的多个问题并行、独立作答共用同一份状态。所以你多问几句几乎不会多花时间、不涨钱。官方甚至直接建议把这条材料上可能用到的判断一次性全问完哪怕这次用不上也没关系。05 丨最值钱的用法按“把握度”分流Jev 给每个答案都附带一个把握度confidence。普通大模型不管懂不懂都答得特别自信但Jev 会说“这题我只有五成把握。”于是你能设计出一套很像人的流程分三档把握高 → 直接自动处理把握一般 → 人工确认一下或补点信息再判把握低 → 转人工或交给更贵更强的大模型官方给的起步阈值是0.8把握低于 0.8 的交给人和大模型处理。这就是 Jev 最实用的定位——在大模型前面加一道又快又稳的闸门。八九成的请求被它挡在外面剩下的才轮到贵模型。06丨20 个直接可用的 Jev 开源项目浏览器与桌面自动化1. jev-ultrafastBrowser Use 做的高速浏览器 Agent。Jev 每一步只判断「做什么、点哪个元素」要打字才叫小模型。Google Flights 搜一次航班大约 7 秒。2. agent-desktop桌面自动化。读系统无障碍树判断下一步该点哪个按钮、菜单或输入框。上下文管理Claude Code3. fast-jev-compaction给 Claude Code 做上下文压缩。每次工具调用先让 Jev 判断还有没有用没用的删掉留下来的原文不重写。4. Winnow给 Claude Code 做上下文垃圾回收。Read / Bash / Grep 吐一大堆时Jev 先判断哪些真和当前任务有关。5. Canny防 Coding Agent 嘴硬说自己做完了。看工具输出、代码 diff 和测试结果再判断完成声明靠不靠谱。生成式 UI 与接入框架6. json-renderVercel Labs 的生成式 UI 框架。实验里 Jev 不逐 token 写 JSON只负责选组件、属性和布局。7. typesafe-mcp最适合刚拿到 API 的人。把 Jev 接进 Claude Code、Claude Desktop、Codex 和 Pi随时做 Choice / Score / Noul。8. jev-mcp现成的 Agent 判断工具箱事实核验、内容筛查、语义排序、分类和信息提取。命令行与任务路由9. SemDecide把 Jev 做成命令行。Shell 里直接分类、打分、过滤适合接爬虫、CI 和数据流水线。10. jev-codex-router先让 Jev 判断这一轮编程任务有多难再决定模型档位、推理深度和速度模式。11. Blink把 Jev 当代码库导航器。每走到一层目录就判断哪些文件和当前问题最相关再继续往下找。12. jev-review代码审查前先过一遍 Jev把高风险改动挑出来再交给更贵的大模型或人。带本地看板。游戏与硬件控制13. typesafe-mario让 Jev 玩《超级马里奥》。不看截图直接读模拟器 RAM 里的结构化状态再决定跑、跳、躲。14. jev-drone拿 Jev 控无人机。底层飞控继续负责稳定和安全Jev 只做爬升、刹车、穿越障碍这类上层判断。15. OneVOneJev浏览器里的 1v1 FPS。每个决策 tick 都要判断走位、视角、瞄准、开火和跳跃。交易与决策16. jev-traderMonad 测试网上做高频做市。Jev 根据价差和成交方向判断下一步买还是卖模型延迟大约 81ms。17. Prism不直接让 Jev 下单。它判断 toxic flow、市场压力、均值回归之类的状态再交给原来的策略。数据与知识18. neo4jev把 Jev 塞进知识图谱。每走到一个节点判断下一条最值得走的边再一路找下去。19. jev-curate拿 Jev 筛训练数据。JSONL / Parquet 先做质量、相关性和风险判断再决定哪些进后面的训练。20. killmyidea输入一个创业点子Jev 从多个维度打分最后给你 KILL、FIX 或 SHIP。07 丨上手前先知道这几个坑它不能看图只认文字输入上限约 3.2 万 token。不会幻觉指的是不会跳出你给的选项乱答不代表不会选错。它便宜是跟前沿大模型比对上轻量大模型价格和准确率基本打平。想拿它给自己日常提效大概率走不通但把它当零件做进产品才有价值。拿到 Jev 之后翻一遍你手上的业务找出那些调了大模型但其实只让它返回一个选项的地方。一个都没有就先别追这个热点。有就挑一个拿真实数据跑一次重点看它七八成把握的答案到底对了几成。过了就在大模型前面加上这道闸门。
