最近关于 Jev 的长文已经充满全网了,但可能还是有朋友一脸懵,就想知道 Jev 到底能拿它干什么?
我这帮大家整理了20个案例。有拿它查机票、分工单的,也有让它玩马里奥、控制仿真火箭着陆的。百花齐放了!
GitHub 仓库和原帖都放下面了,大家可以按需查看。
1. 查一次航班大约 7 秒|jev-ultrafast
Browser Use 做的高速浏览器 Agent。Jev 每一步只判断「做什么、点哪个元素」,需要打字时才调用小模型。Google Flights 搜一次航班大约 7 秒、$0.0039。
2. 给 Claude Code 清理上下文|fast-jev-compaction
让 Jev 判断每次工具调用的内容还有没有用,没用的删掉。留下来的原文不重写,它只负责判断删哪段、留哪段。
3. 每出一个区块,就问一次买还是卖|jev-trader
在 Monad 上运行,模型延迟大约 81ms。可以看看模型能不能跟上每个区块都做一次决策的节奏。
4. 让 Jev 操作 Mac|typesafe-computer-use
用 OCR 读取屏幕文字,再让 Jev 选下一步动作,需要打字时才调用写作模型。作者报每步大约 $0.0002,对比 Opus 5 大约 $0.032。
5. 审核弹幕、分派报警|jev-experiments
Nader Dabit 的实验合集。一份是 Twitch 规模的弹幕审核,大约 300 条/秒;另一份是应急调度,180 秒内分完 275 条报警。这类任务都需要连续处理大量信息,每条都要做判断。
6. 让 Jev 盯着 Codex 干活|foreman
Codex 在那儿干活,Jev 在旁边盯着:真做完了?测试跑了吗?有没有跑偏或者卡住?
7. 代码审查前,先挑出高风险改动|jev-review
先让 Jev 过一遍代码改动,把高风险的部分挑出来,再交给更贵的大模型或人仔细看,还带一个本地看板。
8. 让 Jev 玩马里奥|typesafe-mario
读模拟器 RAM 里的结构化状态,再决定是跑、是跳、还是躲。
9. 让 Jev 在安卓上一步步点|mobile-jev
安卓上的逐步点击 Agent。作者演示过用它走 Uber 路线,大约 21 秒、9 步。
10. 这活该用哪个模型,先让 Jev 看看|jev-router
先判断这一轮编程任务有多难,再决定交给哪个模型。简单活用便宜的,复杂任务再用更强的。
11. 在数据库里用自然语言筛数据|pg-jev
把 Jev 写进 Postgres,直接用 WHERE jev(...) 按自然语言条件过滤行,不用先建向量列。
12. 给 Codex 装一个操作电脑的技能|Jev-cu
Jev 从屏幕文字里选下一步动作,敏感操作先经过本地检查。
13. 724 条直播广告,40 秒分析完
@TheMattBerman 把 37 个品牌的 724 条广告交给 Jev,分析钩子、格式、报价、CTA、认知阶段,以及落地页是否匹配,大约 $0.09。
14. 把自己发过的 3282 条帖翻出来复盘
@iannuttall 把自己累计约 1 亿浏览的帖子交给 Jev,每条问 8 个问题。用时 8 分 34 秒、$0.13。
其中一个结果:How-to 教程帖的中位赞是 150,全部帖子的中位赞是 44。至少在他这批帖子里,差别挺明显。
15. 今天的新闻,哪些跟我的品牌有关?
@SUOHA_AI 用当天的新闻流给 15 个品牌判断「能不能借势」。作者报 Jev 28 秒处理完 428 条,同期 DeepSeek Flash 做了 6 条。
16. 500 条电商工单,看看谁分得快
@NFT_Chen 用同一套分单任务做对比:Jev 83 秒、$0.01 处理完 500 条;DeepSeek V4.1 Flash 同期做完 173 条、$0.06。
17. 给一个陌生网址,38 秒填完 16 题问卷
依旧是
@SUOHA_AI 出品。Jev 负责判断「这里该点什么」,小模型只在填空时写字,演示全程零人工操作。
18. 连仿真火箭着陆都有人试了
@uttkarsh_42 把 Falcon 9 级别的仿真助推器交给 Jev,决定点不点火、开几台发动机、什么时候收腿。
12 次试验后着陆,245 次调用、$0.04。
19. 用语音指挥浏览器点击|jev-voice-browser
@moritzkremb 做的演示:说话、转写,Jev 大约 300ms 返回概率,再由 Playwright 点击。每次决策大约 $0.0002,仓库也开源了。
20. Jev 官方说明
Jev 作者
@CompleteSkeptic 的原帖。想弄清它到底在做什么,可以从这里看起:它不聊天、不写字,只给程序做判断。
另外再附上两个案例集合地址,想要更多案例可以去这里找: